scikit-learn 简介

scikit-learn 简介

作者: Thinkando | 来源:发表于2018-03-26 16:40 被阅读29次

Python 数据科学手册 5.2 Scikit-Learn 简
7.1 Scikit-learn库简介及快速入门
scikit-learn 简介
利用scikit-learn进行机器学习简介
机器学习入门之sklearn介绍
Python Scikit-Learn 库简介
scikit-learn 机器学习库集成环境Pythonxy
scikit-learn安装入门开源机器学习工具scikit-
使用sklearn快速入门机器学习
sklearn决策树使用（1）

1. sklearn 图谱

原版

汉化版

汉化版

2. 简介

我们可以看到，机器学习分为四大块，分别是 classification (分类)， clustering (聚类), regression (回归), dimensionality reduction (降维)。
给定一个样本特征 x, 我们希望预测其对应的属性值 y, 如果 y 是离散的, 那么这就是一个分类问题，反之，如果 y 是连续的实数, 这就是一个回归问题。
如果给定一组样本特征 S={x∈RD}, 我们没有对应的 y, 而是想发掘这组样本在 D 维空间的分布, 比如分析哪些样本靠的更近，哪些样本之间离得很远, 这就是属于聚类问题。
如果我们想用维数更低的子空间来表示原来高维的特征空间, 那么这就是降维问题。

2.1 classification & regression

无论是分类还是回归，都是想建立一个预测模型 H，给定一个输入 x, 可以得到一个输出 y:
y=H(x)
不同的只是在分类问题中, y 是离散的; 而在回归问题中 y 是连续的。所以总得来说，两种问题的学习算法都很类似。所以在这个图谱上，我们看到在分类问题中用到的学习算法，在回归问题中也能使用。分类问题最常用的学习算法包括 SVM (支持向量机) , SGD (随机梯度下降算法), Bayes (贝叶斯估计), Ensemble, KNN 等。而回归问题也能使用 SVR, SGD, Ensemble 等算法，以及其它线性回归算法。

2.2 clustering

聚类也是分析样本的属性, 有点类似classification, 不同的就是classification 在预测之前是知道 y 的范围, 或者说知道到底有几个类别, 而聚类是不知道属性的范围的。所以 classification 也常常被称为 supervised learning, 而clustering就被称为 unsupervised learning。
clustering 事先不知道样本的属性范围，只能凭借样本在特征空间的分布来分析样本的属性。这种问题一般更复杂。而常用的算法包括 k-means (K-均值), GMM (高斯混合模型) 等。

2.3 dimensionality reduction

降维是机器学习另一个重要的领域, 降维有很多重要的应用, 特征的维数过高, 会增加训练的负担与存储空间, 降维就是希望去除特征的冗余, 用更加少的维数来表示特征. 降维算法最基础的就是PCA了, 后面的很多算法都是以PCA为基础演化而来。

参考文献

相关文章

Python 数据科学手册 5.2 Scikit-Learn 简
5.2 Scikit-Learn 简介原文：Introducing Scikit-Learn 译者：飞龙协议：...
7.1 Scikit-learn库简介及快速入门
7.1.1 Scikit-learn简介 Scikit-learn（以下简称sklearn）是开源的Python机...
scikit-learn 简介
1. sklearn 图谱汉化版汉化版 2. 简介我们可以看到，机器学习分为四大块，分别是 classific...
利用scikit-learn进行机器学习简介
利用scikit-learn进行机器学习简介 Sectioncontents：在这部分，我们引入利用scikit...
机器学习入门之sklearn介绍
SKlearn简介 scikit-learn，又写作sklearn，是一个开源的基于python语言的机器学习工具...
Python Scikit-Learn 库简介
本节将向大家介绍 Python 中大名鼎鼎的机器学习工具库 Scikit-Learn。为了使大家能更加清晰地了解 ...
scikit-learn 机器学习库集成环境Pythonxy
1. scikit-learn介绍 2. scikit-learn安装 3. scikit-learn载入数据集 ...
scikit-learn安装入门开源机器学习工具scikit-
scikit-learn安装入门开源机器学习工具scikit-learn入门 Scikit-Learn是基于py...
使用sklearn快速入门机器学习
简介 sklearn（scikit-learn）是一个非常优秀的Python库，它封装了机器学习中常用的算法，包括...
sklearn决策树使用（1）
简介自2007年发布以来，scikit-learn已经成为Python重要的机器学习库了。scikit-lear...

网友评论

本文标题：scikit-learn 简介

本文链接：https://www.haomeiwen.com/subject/vvmrcftx.html

延伸阅读

深度阅读

您也可以注册成为美文阅读网的作者，发表您的原创作品、分享您的心情！

栏目导航

大数据，机器学习，人工智能

人工智能/模式识别/机器学习精华专题

机器学习与数据挖掘

热点阅读

Scikit-Learn

大数据，机器学习，人工智能

人工智能/模式识别/机器学习精华专题

机器学习与数据挖掘

关于我们|服务条款|联系我们|scikit-learn 简介|投稿指南|网站地图|RSS订阅|排版工具|手机版

提供经典美文摘抄,优美散文欣赏,现代诗歌精选,短篇小说,心情随笔,表白情书范文,故事会在线阅读欣赏

Copyright © 2014-2023 Haomeiwen.com All Rights Reserved. 好美文阅读网版权所有

备案信息：桂公网安备 45052102000051号 · 桂ICP备13007215号-3

本站所收录作品、热点评论等信息部分来源互联网，目的只是为了系统归纳学习和传递资讯

所有作品版权归原创作者所有，与本站立场无关，如不慎侵犯了你的权益，请联系我们告知，我们将做删除处理！