sklearn-提取字典特征

1.所用函数

1.sklearn.feature_extraction:sklearn中的特征提取API

2.DictVectorizer:专门提取字典文本特征的函数

2.示例

python 复制代码
from sklearn.feature_extraction import DictVectorizer

##字典特征提取:可以提取是字典结构的数据或者是包含字典的迭代器
trans=DictVectorizer(sparse=False)##生成提取器对象,sparse=False表示返回的是one-hot编码的数据,不加默认是返回稀疏矩阵的形式即无0的表示方法
data=[{"city":"北京","temperature":100},{"city":"上海","temperature":60},{"city":"深圳","temperature":30}]#包含字典的迭代器
tezheng=trans.fit_transform(data)##对象.fit_transform(data)提取字典的特征数据
print(trans.feature_names_)##获取特征名称
print(tezheng)#获取特征数据是one-hot编码的形式
复制代码
one-hot编码格式

系数矩阵格式

注意:第一列是第二列values数据的位置是用下标构成的(对比one-hot图可验证)

相关推荐
雪兽软件13 分钟前
人工智能(AI)的商业模式创新路线图
人工智能
俊哥V38 分钟前
AI一周事件(2025年11月12日-11月18日)
人工智能·ai
算法与编程之美40 分钟前
提升minist的准确率并探索分类指标Precision,Recall,F1-Score和Accuracy
人工智能·算法·机器学习·分类·数据挖掘
拓端研究室42 分钟前
专题:2025年全球机器人产业发展白皮书-具身智能时代的技术突破|附39份报告PDF、数据、可视化模板汇总下载
人工智能
金智维科技官方1 小时前
政务自动化中,智能体如何实现流程智能审批?
人工智能·自动化·政务·智能体
MicroTech20251 小时前
微算法科技(NASDAQ :MLGO)混合共识算法与机器学习技术:重塑区块链安全新范式
科技·算法·区块链
xiaoginshuo1 小时前
智能体与RPA流程自动化:从工作流搭建看本质区别
人工智能·自动化·rpa
李牧九丶1 小时前
从零学算法1334
前端·算法
在繁华处1 小时前
C语言经典算法:汉诺塔问题
c语言·算法
钅日 勿 XiName1 小时前
一小时速通pytorch之训练分类器(四)(完结)
人工智能·pytorch·python