机器学习基础概念(3)

小小考一下大家前两节的内容(坏笑)

我们如何评判一个机器学习模型的性能呢? 通常是判断它的泛化能力(对于未知数据的处理能力)

那么对于泛化能力是否有一个标准,比如在未知的1万个数据中,泛化能力 模型一90% > 模型二80% , 我们能说模型一就比模型二好吗? 根据NFL原则(没有绝对最好的),我们可以知道,刚刚那句话是不对的,比如对A来说,他需要前100个好就行,其他不重要,但B需要前10000个好,我们需要对他们进行定制不同的模型。

进入正题,我们手中没有没见过的数据(unseen instance),所以我们只能用已知的数据来调试模型参数,训练模型模型并模拟未知的数据来测试模型性能

调试模型就是用验证集来调试参数(这个在这篇文章的后面讲)。

训练模型就是用训练集。

测试模型就是用测试集。

这个时候就会出现两个事情:过拟合和欠拟合。

过拟合:模型对于训练数据的特征进行过度解析,导致出现不符合该问题一般特征的判断。

欠拟合:模型对于训练数据的特征解析不够,导致没有全面了解该问题一般特征,无法做出正确判断。

下图可以很好地表现

上面是直观表示,两条线,一个是真实训练效果,这个是我们训练出来出来对于未来数据的效果,实际上是先欠拟合,之后越来越好,再之后过拟合。表面训练效果就是对于训练集表现出来的表面效果,是看起来越来越好的,但是实际后面已经出现过拟合了。

之后我们需要探讨一下模型选择方面的事,有三个问题

评估方法--如何获得评测结果,获得什么样的评测结果

性能度量--如何评估性能优劣,怎么判断需要什么性能

比较检验--如何判断实质差别,用什么标准比较模型的差别

OK,这节就这样

相关推荐
后端小肥肠3 分钟前
公众号破圈难?我写了个skill把长文拆成IP卡片,小红书小绿书同时发
人工智能·aigc·agent
陈天伟教授8 分钟前
四川省中小学和职业院校教师校长省级培训专家库专家名单
人工智能·安全·架构
Uncle 城9 分钟前
AI日报速递-20260418
人工智能
F_U_N_30 分钟前
拒绝手动配环境!MonkeyCode:手机就能写项目,AI全程扛事
人工智能·ai编程
helloworddm33 分钟前
Vulkan GPU图像处理之对数变换:Kompute框架实战与性能分析
图像处理·人工智能·计算机视觉
旺仔Sec37 分钟前
一万字带您看懂:从“赛项”到“赛道”解读世界职业院校技能大赛改革与备赛策略
人工智能·世界职业院校技能大赛·大赛
海兰38 分钟前
【第2篇-续】从零开始helloworld使用openAI通用模型的完整实现示例附源代码
java·人工智能·spring boot·alibaba·spring ai
科研实践课堂(小绿书)39 分钟前
基于AI智能算法的装备结构可靠性分析与优化设计技术
人工智能·机器学习
Mr数据杨42 分钟前
纽约311工单响应时长预测实战 从结构化回归到城市服务效率分析
机器学习·数据分析·kaggle
蕤葳-1 小时前
理性分析:如何利用考证作为抓手,构建系统化知识体系与职业规划?
人工智能·网络协议·https