sklearn函数:train_test_split(分割训练集和测试集)

函数的功能是分割训练集和测试集

函数中参数的用法:

1. test_size:float or int, default=None

测试集的大小,如果是小数的话,值在(0,1)之间,表示测试集所占有的比例;

如果是整数,表示的是测试集的具体样本数;

如果train_size也是None的话,会有一个默认值0.25

2. train_size:float or int, default=None

和test_size一样,同上

3.random_state:int or RandomState instance, default=None

这个参数表示随机状态,因为每次分割都是随机的,

设置为整数则每次分割不随机
注意:只有当shuffle=True时,random_state才起作用

4.shuffle: bool, default=True

是否重洗数据(洗牌),就是说在分割数据前,是否把数据打散重新排序这样子,看上面我们分割完的数据,都不是原始数据集的顺序,默认是要重洗的

5.stratify:array-like, default=None

这个要配合结果集使用,假设原始的结果集中有2种分类,A:B=1:2

我们在随机分配的时候,是无法保证训练集和测试集中的A与B的比例

这时候,就可以用这个参数了,设置stratify=y,就可以让测试集和训练集中的结果集也保证这种分布

相关推荐
DO_Community2 小时前
普通服务器都能跑:深入了解 Qwen3-Next-80B-A3B-Instruct
人工智能·开源·llm·大语言模型·qwen
WWZZ20252 小时前
快速上手大模型:机器学习3(多元线性回归及梯度、向量化、正规方程)
人工智能·算法·机器学习·机器人·slam·具身感知
deephub2 小时前
深入BERT内核:用数学解密掩码语言模型的工作原理
人工智能·深度学习·语言模型·bert·transformer
PKNLP2 小时前
BERT系列模型
人工智能·深度学习·bert
兰亭妙微3 小时前
ui设计公司审美积累 | 金融人工智能与用户体验 用户界面仪表盘设计
人工智能·金融·ux
AKAMAI3 小时前
安全风暴的绝地反击 :从告警地狱到智能防护
运维·人工智能·云计算
岁月宁静4 小时前
深度定制:在 Vue 3.5 应用中集成流式 AI 写作助手的实践
前端·vue.js·人工智能
galaxylove4 小时前
Gartner发布数据安全态势管理市场指南:将功能扩展到AI的特定数据安全保护是DSPM发展方向
大数据·人工智能
格林威4 小时前
偏振相机在半导体制造的领域的应用
人工智能·深度学习·数码相机·计算机视觉·视觉检测·制造
晓枫-迷麟5 小时前
【文献阅读】当代MOF与机器学习
人工智能·机器学习