机器学习(复试)

学习分类

其学习形式主要分为:有监督学习、无监督学习、半监督学习

有监督

有监督学习(supervised learning),需要你事先需要准备好要输入数据(训练样本)与真实的输出结果(参考答案)

预测结果分类

比如有监督学习可以划分为:回归问题和分类问题

如果预测结果是离散的,通常为分类问题,而为连续的,则是回归问题。

机器学习的专业术语

  1. 模型:模型这一词语将会贯穿整个教程的始末,它是机器学习中的核心概念。
  2. 数据集
  3. 样本&特征
  4. 向量
  5. 矩阵:矩阵看成由向量组成的二维数组

假设函数和损失函数

  1. 假设函数:假设函数(Hypothesis Function)可表述为 y=f(x) 其中 x 表示输入数据,而 y 表示输出的预测结果
  2. 损失函数:损失函数(Loss Function)又叫目标函数,简写为 L(x),这里的 x 是假设函数得出的预测结果"y",如果 L(x) 的返回值越大就表示预测结果与实际偏差越大,越小则证明预测值越来越"逼近"真实值,
  3. 优化方法:"优化方法"可以理解为假设函数和损失函数之间的沟通桥梁。

拟合&过拟合&欠拟合

1)拟合:形象地说,"拟合"就是把平面坐标系中一系列散落的点,用一条光滑的曲线连接起来,因此拟合也被称为"曲线拟合"。

  1. 过拟合:过拟合(overfitting)与是机器学习模型训练过程中经常遇到的问题,所谓过拟合,通俗来讲就是模型的泛化能力较差,也就是过拟合的模型在训练样本中表现优越,但是在验证数据以及测试数据集中表现不佳。过拟合问题在机器学习中经常遇到,主要是因为训练时样本过少,特征值过多导致的,后续还会详细介绍。

  2. 欠拟合:欠拟合(underfitting)恰好与过拟合相反,它指的是"曲线"不能很好的"拟合"数据。

相关推荐
小鸡吃米…几秒前
机器学习 - 对抗性机器学习
人工智能·python·机器学习
蓝海星梦2 分钟前
GRPO 算法演进——奖励设计篇
论文阅读·人工智能·深度学习·算法·自然语言处理·强化学习
qyr67893 分钟前
废物转化为能源全球市场分析报告
大数据·人工智能·能源·市场分析·市场报告·废物转化为能源·废物能源
我材不敲代码5 分钟前
深度学习的准备工作:CUDA安装配置、pytorch库、torchvision库、torchaudio库安装
人工智能·pytorch·深度学习
格林威5 分钟前
Baumer相机系统延迟测量与补偿:保障实时控制同步性的 5 个核心方法,附 OpenCV+Halcon 实战代码!
人工智能·数码相机·opencv·算法·计算机视觉·视觉检测·工业相机
喜欢吃豆6 分钟前
Ralph 架构深度解析报告:自主代理循环与软件工程的确定性重构
人工智能·重构·架构·大模型·软件工程
喜欢吃豆6 分钟前
构建下一代语境感知型 AI Agent:AGENTS.md 与 SKILL.md 发现系统的深度工程架构报告
人工智能·架构
uesowys7 分钟前
Apache Spark算法开发指导-Gradient-boosted tree classifier
人工智能·算法·spark
yhdata8 分钟前
2032年,数字化X线平板探测器市场规模有望接近189.8亿元
大数据·人工智能
.小墨迹10 分钟前
开源的自动驾驶框架
c++·人工智能·学习·算法·ubuntu·开源·自动驾驶