美文网首页
第五章 支持向量机(分类)

第五章 支持向量机(分类)

作者: DIO哒 | 来源:发表于2018-04-13 21:48 被阅读0次

支持向量机简介

SVM是一个非常通用的机器学习模型,可以用于线性或非线性分类,回归,甚至异常分析。
是最流行的机器学习算法之一,

1.SVM 对特征缩放非常敏感,所以要引入standardScalar
具体是这样:

from sklearn.preprocessing import StandardScaler
scaler = StandardScaler()
X_scaled = scaler.fit_transform(Xs)
svm_clf.fit(X_scaled, ys)

2.SVM中有 hard margin 和 soft margin 之分,一个边缘是硬的,一个是软的。
硬也就意味着对于异常值非常敏感,太软了又会发生欠拟合,所以为了更好的预测需要控制软和硬。
为了做到这一点,我们使用超参数 C 。

scaler = StandardScaler()
svm_clf1 = LinearSVC(C=1, loss="hinge", random_state=42)
svm_clf2 = LinearSVC(C=100, loss="hinge", random_state=42)

scaled_svm_clf1 = Pipeline([
        ("scaler", scaler),
        ("linear_svc", svm_clf1),
    ])
scaled_svm_clf2 = Pipeline([
        ("scaler", scaler),
        ("linear_svc", svm_clf2),
    ])

scaled_svm_clf1.fit(X, y)
scaled_svm_clf2.fit(X, y)
C=1与C=100之间的差距

这也意味着如果发生过拟合或者受到异常值的影响可以考虑减小C的值

如果想要做非线性回归,有三种方法
1.多项式特征=>多项式核

from sklearn.datasets import make_moons
from sklearn.pipeline import Pipeline
from sklearn.preprocessing import PolynomialFeatures

polynomial_svm_clf = Pipeline([
        ("poly_features", PolynomialFeatures(degree=3)),
        ("scaler", StandardScaler()),
        ("svm_clf", LinearSVC(C=10, loss="hinge", random_state=42))
    ])

polynomial_svm_clf.fit(X, y)

多项式核

from sklearn.svm import SVC

poly_kernel_svm_clf = Pipeline([
        ("scaler", StandardScaler()),
        ("svm_clf", SVC(kernel="poly", degree=3, coef0=1, C=5))
    ])
poly_kernel_svm_clf.fit(X, y)

3.相似特征,高斯径向基函数(Gaussian RBF)=>高斯核

rbf_kernel_svm_clf = Pipeline([
        ("scaler", StandardScaler()),
        ("svm_clf", SVC(kernel="rbf", gamma=5, C=0.001))
    ])
rbf_kernel_svm_clf.fit(X, y)
不同的C和γ对高斯核的影响

高斯核有两个重要参数,C 和 γ(gama),C就是决定边缘软硬,γ 类似于正则化的超参数,γ 越大,决策边界最终就会变得越崎岖复杂,反之则会变光滑。

如何选择一个合适的核

首先要考虑linearSVC,因为最快,尤其是当训练集非常大的时候。
如果训练集不是很大,可以尝试使用高斯RBF核,如果还有其他时间再尝试别的核。

相关文章

  • 支持向量机

    问题 1. 支持向量机是如何进行数据分类? 2. 支持向量机求解过程 3. 支持向量机是怎么对 线性不...

  • 机器学习实战:基于Scikit-Learn和TensorFlow

    机器学习实战:基于Scikit-Learn和TensorFlow---第五章笔记 支持向量机 支持向量机(简称SV...

  • 支持向量机(分类问题公式及python实现)

    NOTEBOOK支持向量机(分类问题公式及python实现) 此notebook包括:1、支持向量机介绍2、什么是...

  • 多分类

    基于LSTM的中文文本多分类实战sklearn 多种分类实现支持向量机1支持向量机2 随机森林理论内容

  • 第五章 数据分类算法——基于支持向量机的分类器

    5.3 基于支持向量机的分类器 支持向量机分类器时一种有监督学习的分类方法,属于一般化的线性分类器。 5.3.1 ...

  • 支持向量机—从推导到python手写

    笔者比较懒能截图的地方都截图了。 1 支持向量机分类 支持向量机分为三类:(1)线性可分支持向量机,样本线性可分,...

  • 支持向量机

    支持向量机(SVMs)是一组用于回归、分类和异常值检测的监督学习方法。 支持向量回归(SVR) 支持向量分类的方法...

  • Sklearn各分类算法实现

    1、逻辑回归 使用逻辑回归来实现对癌症患者的分类: 2、支持向量机 本节使用支持向量机实现对手写数字的分类 3、朴...

  • 《人工智能基础》65/71天阅读

    支持向量机 支持向量机是在特征空间上分类间隔最大的分类器,它与感知器一样,是对两个类别进行分类。 把和分类直线相接...

  • ML--支持向量机

    ML——支持向量机 支持向量机(SVM)是一种二类分类模型,其基本模型是定义在特征空间上的间隔最大的线性分类...

网友评论

      本文标题:第五章 支持向量机(分类)

      本文链接:https://www.haomeiwen.com/subject/glshkftx.html