美文网首页
数据预处理方法(标准化)

数据预处理方法(标准化)

作者: 就叫李德新 | 来源:发表于2016-09-07 17:05 被阅读0次

今天看那么了一下数据的预处理的东西,重点就是归一化了包括MIN-MAX标准化等方法,还没有一一去验证每个方法对我论文中研究LF精炼过程钢水重点温度预报输入数据处理后,对预报工作的影响好坏,先MARK在这里日后用啦~(归一化是一种简化计算的方式,即将有量纲的表达式,经过变换,化为无量纲的表达式,成为标量。 在多种计算中都经常用到这种方法。)PS:这里我还没搞清标准化和归一化的区别,工作做到这时候应该要对这些概念搞清楚。

数据的标准化(normalization)是将数据按比例缩放,使之落入一个小的特定区间。在某些比较和评价的指标处理中经常会用到,去除数据的单位限制,将其转化为无量纲的纯数值,便于不同单位或量级的指标能够进行比较和加权。

  其中最典型的就是数据的归一化处理,即将数据统一映射到[0,1]区间上,常见的数据归一化的方法有:

min-max标准化(Min-max normalization)

  也叫离差标准化,是对原始数据的线性变换,使结果落到[0,1]区间,转换函数如下:

  其中max为样本数据的最大值,min为样本数据的最小值。这种方法有一个缺陷就是当有新数据加入时,可能导致max和min的变化,需要重新定义。

log函数转换

  通过以10为底的log函数转换的方法同样可以实现归一下,具体方法如下:

  看了下网上很多介绍都是x*=log10(x),其实是有问题的,这个结果并非一定落到[0,1]区间上,应该还要除以log10(max),max为样本数据最大值,并且所有的数据都要大于等于1。

atan函数转换

  用反正切函数也可以实现数据的归一化:

  使用这个方法需要注意的是如果想映射的区间为[0,1],则数据都应该大于等于0,小于0的数据将被映射到[-1,0]区间上。

  而并非所有数据标准化的结果都映射到[0,1]区间上,其中最常见的标准化方法就是Z标准化,也是SPSS中最为常用的标准化方法:

z-score 标准化(zero-mean normalization)

  也叫标准差标准化,经过处理的数据符合标准正态分布,即均值为0,标准差为1,其转化函数为:

  其中μ为所有样本数据的均值,σ为所有样本数据的标准差。

本文大部分参考了:

http://webdataanalysis.net/data-analysis-method/data-normalization/

网络整理归一化:

http://blog.csdn.net/zbc1090549839/article/details/39996665

相关文章

  • 数据分析:数据预处理--缺失值处理(三)

    前言 上一篇数据分析:数据预处理--标准化方法优劣了解(二)[https://www.jianshu.com/p/...

  • 机器学习面试题

    1. 什么是数据标准化,为什么要进行数据标准化? 我认为这个问题需要重视。数据标准化是预处理步骤,将数据标准化到一...

  • 03-特征预处理

    特征的预处理:对数据进行处理。通过特定的统计方法(数学方法)将数据转换成算法要求的数据 两种方式: 归一化 标准化...

  • 数据预处理方法(标准化)

    今天看那么了一下数据的预处理的东西,重点就是归一化了包括MIN-MAX标准化等方法,还没有一一去验证每个方法对我论...

  • Day 14:SVM案例

    数据下载 一、数据预处理 导入库 导入数据 分割数据集 数据标准化 二、使用SVM(linear kernel)模...

  • 数据预处理和特征工程

    1.导入数据 2.数据预处理: 2.1标准化: 把数据按比例缩放,使之落入一个小的空间里。常用的方法有: 1.z-...

  • 机器学习第三课_关于数据预处理和特征工程

    一、数据预处理:数值型特征无量纲化 1.数据标准化(Standardization) 标准化的前提是特征值服从正态...

  • 预处理

    数据预处理的常用流程 去除唯一属性 处理缺失值 属性编码 数据标准化 特征选择 主成分分析 缺失值处理的三种方法 ...

  • 转载--特征工程

    目录 1 特征工程是什么?2 数据预处理2.1 无量纲化2.1.1 标准化2.1.2 区间缩放法2.1.3 标准化...

  • 特征工程

    目录 1 特征工程是什么?2 数据预处理2.1 无量纲化2.1.1 标准化2.1.2 区间缩放法2.1.3 标准化...

网友评论

      本文标题:数据预处理方法(标准化)

      本文链接:https://www.haomeiwen.com/subject/zfgjettx.html