import numpy as np
import pandas as pd
from sklearn.model_selection import train_test_split
from sklearn.preprocessing import StandardScaler
from sklearn.linear_model import LogisticRegression
# 获得数据
names=['Sample code number','Clump Thickness','Uniformity of Cell Size','Uniformity of Cell Shape','Marginal Adhesion','Single Hpithelial Cell Size','Bare Nucle','Bland Chromatin','Normal Nucleoli','Mitomeos','Class']
data=pd.read_csv("https://archive.ics.uci.edu/ml/machine-learning-databases/breast-cancer-wisconsin/breast-cancer-wisconsin.data",names=names)
# 处理数据 处理掉数据里的缺失值
data=data.replace(to_replace="?",value=np.nan)
# 使用dropna删除替代过的数据
data=data.dropna()
# 分类数据 特征值 标准值
x=data.iloc[:,1:-1]
y=data["Class"]
# 分割数据
x_train,x_test,y_train,y_test=train_test_split(x,y,test_size=0.2,random_state=20)
# 标准化数据
transfer =StandardScaler()
x_train=transfer.fit_transform(x_train)
x_test=transfer.fit_transform(x_test)
# 训练模型
estimator=LogisticRegression()
ret=estimator.fit(x_train,y_train)
print(ret)
# 模型评估
print(estimator.score(x_test,y_test))
机器学习之逻辑回归
我叫小邋遢2023-08-19 22:53
相关推荐
胡伯来了6 小时前
08 Transformers - 微调Salt_07286 小时前
DAY 42 图像数据与显存byzh_rc6 小时前
[模式识别-从入门到入土] 高斯混合模型无心水6 小时前
【Stable Diffusion 3.5 FP8】1、Stable Diffusion 3.5 FP8 入门指南:为什么它能颠覆文生图效率?长相忆兮长相忆6 小时前
【推荐算法】PRM重排模型:Personalized Re-ranking for Recommendation没有梦想的咸鱼185-1037-16636 小时前
【降尺度】基于统计方法与机器学习技术在气候降尺度中的实践应用byzh_rc7 小时前
[模式识别-从入门到入土] 无监督学习dulu~dulu7 小时前
机器学习题目总结(二)思通数据7 小时前
AI智能预警系统:矿山、工厂与油气站安全管理架构浅析碎碎思8 小时前
FINN:FPGA AI 推理新范式 —— 定制化、高性能、量化神经网络编译器框架