模型选择+过拟合欠拟合

训练误差和泛化误差

训练误差:模型在训练数据上的误差

泛化误差:模型在新数据上的误差

验证数据集:一个用来评估模型好坏的数据集

  • 例如拿出50%的数据作为训练

测试数据集:只能用一次

K则交叉验证

在没有足够数据时使用

算法:

  • 将训练数据分割为k块
  • for i in range(0, k]
    • 使用第i块作为验证数据集,其余作为训练数据集
  • 报告k个验证集误差的平均

训练数据集:训练模型参数

验证数据集:选择模型超参数

非大数据集上通常使用K折交叉验证

过拟合和欠拟合

根据数据集的复杂度选择模型容量

本质是泛化误差和训练误差的平衡

VC维可以衡量训练误差和泛化误差的间隔,但在深度学习中很少使用

SVM能解决的问题少于神经网络,神经网络可以通过卷积得到多种特征

相关推荐
All The Way North-8 小时前
【TorchMetrics精通系列②】混淆矩阵:归一化陷阱、TP/FP推导与10分类文本热力图分析
深度学习·模型评估·评价指标·多分类·混淆矩阵·归一化·torchmetrics
东方佑8 小时前
BitsFusion + Precision Diffusion — UV 实验报告
人工智能
旅僧8 小时前
王树森老师强化学习--同声传译版3
python·深度学习
大模型码小白8 小时前
向量化引擎与 AI 排障:当 SIMD 遇到异常检测,存储诊断的范式转移
java·大数据·数据库·人工智能·python
遥感知识服务8 小时前
水库是在缓解干旱,还是把干旱重新分配?
人工智能
在水一缸8 小时前
当 AI 拥有了“核按钮”:深入解析 MCP 服务器与命令执行护栏
运维·服务器·人工智能·命令执行·智能体·ai安全·mcp
weixin_446260858 小时前
ARM++:面向深度伪造检测器的多域智能体协同可迁移对抗攻击框架
arm开发·人工智能
tinygone8 小时前
在Windows上部署Unlimited-ocr并提供给大模型使用
人工智能·windows·经验分享
阿虎儿8 小时前
Dify HTTP请求节点超时:Reached maximum retries for URL http://xxx/xxx
人工智能
fpcc8 小时前
AI和大模型——梯度散度和旋度
人工智能·机器学习