2.4特征预处理(机器学习)

2.4特征预处理

2.4.1 什么是特征预处理

通过

一些转换函数将特征数据转换成更加适合算法模型的特征数据过程。

1 包含内容

数值型数据的无量纲化:

归一化

标准化

2 特征预处理API

sklearn.preprocessing

为什么要进行归一化/标准化?

特征的单位或者大小相差较大,或者某特征的方差相比其他的特征要打出几个数量级,容易影响(支配)目标结果,使得一些算法无法学习到其他的特征。

我们需要用到一些方法进行无量纲化,使不同规格的数据转换到统一规格。

归一化/标准化(数学上叫做;无量纲化)

2.4.2 归一化

1 定义

通过对原始数据进行变换把数据映射到(默认为【0,1】之间。

2 公式

举例:

3 API

pycharm:

2.4.3 标准化

1 定义

通过对原始数据进行变形把数据变换到均值为0,标准差为1范围内。

2 公式

标准差:集中程度

对于归一化;如果出现异常点,影响了最大值和最小值,那么结果显然会发生改变。

对于标准化,如果出现异常点,由于具有一定数据量,shaom两点异常点对于平均值的影响并不大,从而方差改变较小。

3 API

相关推荐
jonyleek10 分钟前
【JVS更新日志】智能BI、智能排产、低代码、视频会议3.12更新说明!JVS-AI助手即将上线!
java·人工智能·低代码·团队开发·制造·软件需求·erp
带电的小王12 分钟前
【大模型基础_毛玉仁】2.3 基于 Encoder-only 架构的大语言模型
人工智能·语言模型·自然语言处理
北京青翼科技12 分钟前
【TES817】基于XCZU19EG FPGA的高性能实时信号处理平台
图像处理·人工智能·ai·fpga开发·信号处理
数智大号14 分钟前
Net5.5G引领未来:企业如何布局新一代互联网战略
人工智能
芷栀夏14 分钟前
零成本本地化搭建开源AI神器LocalAI支持CPU推理运行部署方案
linux·人工智能·ai·开源
蚝油菜花14 分钟前
MM-StoryAgent:交大阿里联合开源!多模态AI一键生成儿童故事绘本+配音
人工智能·开源
飞哥数智坊17 分钟前
Manus还没发,先复刻一套OpenManus吧!
人工智能
Coovally AI模型快速验证17 分钟前
何恺明团队新突破:用“物理直觉“重构AI视觉系统,去噪神经网络让机器看懂世界规律
人工智能·深度学习·神经网络·机器学习·计算机视觉·目标跟踪·重构
SomeB1oody17 分钟前
【Python机器学习】2.2. 聚类分析算法理论:K均值聚类(KMeans Analysis)、KNN(K近邻分类)、均值漂移聚类(MeanShift)
python·算法·机器学习·聚类·分类算法
yuanpan21 分钟前
机器学习中常用的避免过拟合的方法有哪些
人工智能·机器学习