简单的Scikit-Learn入门示例

以下是一个简单的Scikit-Learn入门示例,该示例使用鸢尾花(Iris)数据集来演示分类问题的基本步骤。这个数据集包含了150个样本,每个样本有四个特征(花萼长度、花萼宽度、花瓣长度、花瓣宽度),以及一个目标变量(花的种类,分为山鸢尾、杂色鸢尾和维吉尼亚鸢尾)。

python 复制代码
# 导入必要的库
from sklearn.datasets import load_iris
from sklearn.model_selection import train_test_split
from sklearn.preprocessing import StandardScaler
from sklearn.svm import SVC
from sklearn.metrics import accuracy_score

# 加载鸢尾花数据集
iris = load_iris()
X = iris.data  # 特征数据
y = iris.target  # 目标变量(花的种类)

# 划分训练集和测试集
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=42)

# 数据预处理(可选步骤,这里使用特征缩放)
scaler = StandardScaler()
X_train_scaled = scaler.fit_transform(X_train)
X_test_scaled = scaler.transform(X_test)

# 选择并训练模型(这里使用支持向量机SVM)
model = SVC(kernel='linear', C=1, random_state=42)
model.fit(X_train_scaled, y_train)

# 预测测试集结果
y_pred = model.predict(X_test_scaled)

# 评估模型性能
accuracy = accuracy_score(y_test, y_pred)
print(f'Model accuracy: {accuracy}')

在这个示例中,我们首先导入了必要的库,然后加载了鸢尾花数据集。接着,我们使用train_test_split函数将数据集划分为训练集和测试集。然后,我们选择了一个数据预处理方法(特征缩放),并用它处理了训练集和测试集的特征。之后,我们选择了支持向量机(SVM)作为分类器,并使用训练集数据训练了模型。最后,我们用模型对测试集进行了预测,并计算了模型的准确率。

相关推荐
Where-7 分钟前
深度学习中的过拟合问题及解决方式
人工智能·深度学习
力学与人工智能23 分钟前
博士答辩PPT分享 | 高雷诺数湍流场数据同化与湍流模型机器学习研究
人工智能·机器学习·ppt分享·高雷诺数·流场数据同化·湍流模型
努力毕业的小土博^_^43 分钟前
【地学应用】溜砂坡scree slope / talus slope的定义、机制、分布、危害、与滑坡区别、研究方向与代表论文
人工智能·深度学习·遥感·地质灾害·地学应用
万行1 小时前
机器人系统ROS2
人工智能·python·机器学习·机器人·计算机组成原理
落雨盛夏1 小时前
26深度学习|李哥1
人工智能·深度学习
2501_941322031 小时前
【蚕桑业】【深度学习】基于VFNet的蚕虫智能检测与识别系统实现与应用
人工智能·深度学习
喝凉白开都长肉的大胖子2 小时前
将gym更新到Gymnasium后需要修改哪些位置
人工智能·机器学习·强化学习’
橙露2 小时前
时间序列分析实战:用 Python 实现股票价格预测与风险评估
人工智能·python·机器学习
啊阿狸不会拉杆2 小时前
第 3 章 灰度变换与空间域滤波
图像处理·人工智能·机器学习·计算机视觉·数据挖掘·数字图像处理
CCPC不拿奖不改名2 小时前
循环神经网络RNN:整数索引→稠密向量(嵌入层 / Embedding)详解
人工智能·python·rnn·深度学习·神经网络·自然语言处理·embedding