机器学习库Scikit-Learn

Scikit-Learn是Python下强大的机器学习工具包,它提供了完善的机器学习工具箱,包括数据预处理、分类、回归聚类、预测和模型分析等。

Scikit-Learn 依赖于NumPy、SciPy和 Matplotlib,因此,只需要提前安装好这几个库然后安装 Scikit-Lean,安装代码:

python 复制代码
pip install scikit-learn

创建一个线性回归示例:

python 复制代码
from sklearn.linear_model import LinearRegression #导入线性回归模型
model=LinearRegression()#建立线性回归模型
print(model)

model.fit():训练模型,对于监督模型来说是 fit(X,y),对于非监督模型是 fit(X)。

监督模型提供的接口有:

model.predict(X_new):预测新样本

model.predict_proba(X_new):预测概率,仅对某些模型有用(比如LR)

model.score():得分越高,fit越好

非监督模型提供的接口有:

model.transform():从数据中学到新的"基空间"

model.fit_transform():从数据中学到新的基并将这个

据按照这组"基"进行转换

这个库有内置数据集,比如常见的鸢尾花数据,有一百五十个鸢尾花的一些尺寸的观测值:尊片长

度、宽度,花瓣长度和宽度。还有它们的亚属:山鸢尾(Iris setosa)、变色鸢尾(Iris versicolor)和维吉

尼亚鸢尾(Iris virginica)。

下面导入鸢尾花的数据,建立线性SVM模型,对其分类,预测,并查看模型参数代码如下:

python 复制代码
from sklearn import datasets#导入数据集
Iris=datasets.load_iris()#加载鸢尾花数据集
print(Iris.data.shape)#查看数据集大小
from sklearn import svm #导入SVM模型
clf=svm.LinearSVC()#建立线性SVM分类器
clf.fit(Iris.data,Iris.target)#用数据训练模型
clf.predict([[5.0,3.6,1.3,0.25]])#训练好模型之后,输入新的数据进行预测
#查看训练好模型的参数
clf.coef_

运行结果如下:

更多资料参考:scikit-learn: machine learning in Python --- scikit-learn 1.4.1 documentation

相关推荐
再__努力1点2 分钟前
【68】颜色直方图详解与Python实现
开发语言·图像处理·人工智能·python·算法·计算机视觉
怎么全是重名8 分钟前
DeepLab(V3)
人工智能·深度学习·图像分割
m0_6501082413 分钟前
Vision-Language-Action 模型在自动驾驶中的应用(VLA4AD)
论文阅读·人工智能·自动驾驶·端到端自动驾驶·vla4ad·自动驾驶与多模态大模型交叉
爱笑的眼睛1120 分钟前
文本分类的范式演进:从统计概率到语言模型提示工程
java·人工智能·python·ai
星川皆无恙26 分钟前
基于知识图谱+深度学习的大数据NLP医疗知识问答可视化系统(全网最详细讲解及源码/建议收藏)
大数据·人工智能·python·深度学习·自然语言处理·知识图谱
美狐美颜SDK开放平台30 分钟前
自研还是接入第三方?直播美颜sdk与滤镜功能的技术选型分析
人工智能·美颜sdk·直播美颜sdk·美颜api·美狐美颜sdk
weixin_4166600731 分钟前
插件分享:将AI生成的数学公式无损导出为Word文档
人工智能·ai·word·论文·数学公式·deepseek
PM老周33 分钟前
DORA2025:如何用AI提升研发效能(以 ONES MCP Server 为例)
大数据·人工智能
皇族崛起35 分钟前
【众包 + AI智能体】AI境生态巡查平台边防借鉴价值专项调研——以广西边境线治理为例
大数据·人工智能