第一章_机器学习概述_03.机器学习_算法分类

一、有监督学习 & 无监督学习

有监督学习:输入数据是由输入特征值和目标值所组成,即输入的训练数据有标签的。

无监督学习:输入数据没有被标记,即样本数据类别未知,没有标签,根据样本间的相似性,对样本集聚类,以发现事物内部结构及相互关系。

二、有监督分类问题 & 回归问题

三、半监督学习

工作原理:

1、让专家标注少量数据,利用已经标记的数据(也就是带有类标签)训练出一个模型

2、再利用该模型去套用未标记的数据

3、通过询问领域专家分类结果与模型分类结果做对比,从而对模型做进一步改善和提高

思考有什么好处? 半监督学习方式可大幅降低标记成本

四、强化学习

1、强化学习(Reinforcement Learning):机器学习的一个重要分支

2、应用场景:里程碑AlphaGo围棋、各类游戏、对抗比赛、无人驾驶场景

3、 基本原理:通过构建四个要素:agent,环境状态,行动,奖励,agent根据环境状态进行行动获得最多的累计奖励。

强化学习:寻找最短路径(最优解),以便获得最多的奖励。

五、总结

相关推荐
垆边人似月.4 分钟前
华为机试题 :有效的括号
c++·算法·华为
joopthd12 分钟前
工业在线 TDLAS 器件源头厂商|连续监测场景器件选型要点
机器学习·激光气体检测·tdlas分析模块·仪器集成开发·工业在线监测
方方洛30 分钟前
ray教程-00-前言与导读
人工智能·分布式·机器学习
方方洛32 分钟前
ray教程-01-认识Ray
人工智能·分布式·机器学习
A加ITIL教练长河achotsao40 分钟前
ITIL Master 战略领导者课后系列分享:AI编程正在重新划分研发与运维的边界
算法
hahaha601641 分钟前
FPGA+ARM实现AWB的全流程
人工智能·嵌入式硬件·算法·计算机视觉·fpga开发
李洱42 分钟前
LangChain 和 LangGraph 的区别:核心原理与使用场景
算法
夏幻灵44 分钟前
每日一题:LeetCode 206:反转链表——三指针与原地反转详解
算法·leetcode·链表
OCR_133716212751 小时前
智能交通底层逻辑:国内车牌分类规范与AI识别适配技术解析
大数据·人工智能·分类
岁月蹉跎的一杯酒1 小时前
CCM-可调颜色校正与噪声权衡
图像处理·算法·isp