李宏毅机器学习深度学习:机器学习任务攻略

课程概要

介绍了当我们遇到模型效果(loss)不理想时,进行模型优化的分析方法和思路。

Part 1> 原因分析

可能的原因:

  • 数据集标签不够(标签之间的因果关联性不强)

  • 模型简单(神经元层数不够)

  • 优化问题(optimization)

  • 训练过拟合 (ovefiting)

  • 训练集和测试集 统计学数据分布不匹配(mismatch)

判断方法

是不是训练集和测试集mismatch

训练集如果loss很低,但测试集loss高,则可以分析 训练集和测试集的区别

mismatch的情况示例:

e.g.1 用动物园的图像分类模型,识别野生动物

e.g.2 用亚洲人的特征识别模型,识别欧洲人的特征

是不是过拟合

训练集如果loss很低,但测试集loss高,且不太可能是mismatch的情况,说明很可能是过拟合

模型简单

加了神经元,没有优化效果:加了神经元,训练集和测试集的loss依然很高

则排除是模型简单的原因;

是不是optimization问题

不是上述两个,则可能是optimization

Part 2> 解决思路

应对overfiting:

方法一:增加/丰富数据集

  • 收集真实数据

  • 通过小样本扩增法(e.g. 图像左右反转、镜像等合理调整)

方法二:增加限制条件

  • 简化模型------减少参数

  • 减少关联性较少的标签(features)

  • 减少训练次数

  • 【预告】regularization数据归一化处理

  • 简化模型------减少少神经元(dropout)

  • 【预告】全连接网络、CNN部分讲

Part 3> 验证效果

通过公开数据集、私有数据集和自己的数据集中划分出的validtion set验证。

public数据集验证:

目的:公众说服力

示例:MINST手写数字

private数据集验证:

目的:公众说服力 / 领域内说服力。

示例:医患数据集(医患数据涉及病人隐私,常为非公开数据集)

validation数据集验证:

目的:证明神经网络/模型结构设计合理性、可解释性(逻辑自洽);也可以证明 泛用性(可迁移性)通用性

方法:validation 数据集划分(N-flod Cross法划分, "交叉验证"取平均值)

图为N-flod中N为3的示例。

相关推荐
一点.点29 分钟前
自动驾驶(ADAS)领域常用数据集介绍
人工智能·深度学习·机器学习·自动驾驶
智驱力人工智能32 分钟前
夏季道路安全的AI革命:节省人力、提升效率
人工智能·安全·边缘计算·视觉算法·视觉分析·智能巡航·人工智能云计算
晓数2 小时前
“平价”微智码初尝试
人工智能·jetbrains
新加坡内哥谈技术2 小时前
MCP:人工智能时代的HTTP?探索AI通信新标准
人工智能·自然语言处理·chatgpt
0x2115 小时前
[论文阅读]REPLUG: Retrieval-Augmented Black-Box Language Models
论文阅读·人工智能·语言模型
JOYCE_Leo166 小时前
一文详解卷积神经网络中的卷积层和池化层原理 !!
人工智能·深度学习·cnn·卷积神经网络
~央千澈~7 小时前
对鸿蒙 Next 系统“成熟论”的深度剖析-优雅草卓伊凡
人工智能
Donvink7 小时前
【视频生成模型】通义万相Wan2.1模型本地部署和LoRA微调
人工智能·深度学习·aigc·音视频
訾博ZiBo7 小时前
AI日报 - 2025年04月29日
人工智能