概述:监督学习(分类,回归)与无监督学习(聚类)

目录:

一、监督学习:

1.什么是监督学习:

  • 当前创造市场价值的机器学习中99%都是监督学习。
  • 监督学习是指学习从input到output映射的算法 ,监督学习的关键是开发者提供供模型训练示例
  • 在训练阶段开发者需给定输入input和正确的输出output供模型训练,模型从输入、输出对中学习之后,在预测阶段模型只需接收输入未知input就会给出合理的预测值output。

2.监督学习类型:

  1. 分类 Classification 有限种预测结果
  2. 回归 Regression 无限种预测结果
  • 区别:分类问题预测输出的是有限集合(输入肿瘤数据预测A、B、C类有限类型肿瘤);回归问题预测输出的是无限集合(输入负荷数据预测用电量值∈R)。

二、无监督学习

1.什么是无监督学习:

  • 无监督学习是指开发者仅提供input输入,而不给定output真实值标签,由模型自主学习input中的数据集,给出数据中可能存在的模式或结构。
  • 例如:监督学习给出input:肿瘤大小、患者年龄,output:肿瘤类型,模型学习Input和output后再对未知的input预测其output。而无监督学习给出input:肿瘤大小、患者年龄,不提供output,模型仅学习input来获取数据中的一些模式(模型学习后可能会将数据分为好几组)。
  • 再例如:在监督学习时候,我可能会对模型说:"我现在给你历史病人的肿瘤数据input和这些肿瘤分别是什么类型的真实output,你需要学习他们,以便于你能帮我预测今天刚来检查肿瘤的病人,即给你他们的肿瘤数据你能帮我预测今天的病人肿瘤的类型";在非监督学习的时候,我可能会说:"我现在给你历史病人的肿瘤数据input,这些数据太多太杂乱了,你能学习一下然后找到这些历史肿瘤数据中的相关性并将他们归类吗"。
  • 监督学习需提供input和output,非监督学习仅提供input。监督学习和无监督学习的区别就在于是否提供output真实值标签供模型学习,是否带有对未知数据的预测性质。

2.无监督学习类型:

  1. 聚类 Clustering:模型根据开发者提供的input(而不提供标签)根据数据的相似度将数据分成多个组,例如谷歌通过聚类算法可以将每天的上万条新闻按照词条和相关度归类显示。(这里注意区分与监督学习中的分类问题区别,即有无标签,是否带有对未知数据的预测性质)
  2. 异常检测 Anomaly detection
  3. 降维 Dimensionality reduction
  • 区别:聚类问题
相关推荐
知识分享小能手1 小时前
统计学学习教程,从入门到精通,一元线性回归 —— 知识点详解(17)
学习·算法·线性回归
青山是哪个青山1 小时前
LangChain 1.x 学习笔记(一):为什么需要 LangChain?一文彻底理解 LangChain 生态
笔记·学习·langchain
cooldream20091 小时前
AI 时代,前端工程师的“新学习路线“—— 从“学框架“到“用 AI“
前端·人工智能·学习
CappuccinoRose2 小时前
Rust学习文档(二)
开发语言·后端·学习·rust
冻感糕人~2 小时前
大模型学习指南:收藏这份AI Agent四层工程地图(小白程序员必备)
java·大数据·人工智能·学习·大模型·agent·大模型学习
曲三酒馆2 小时前
“强比命打,钱娃D写”——这8个字就是我人生的全部了![特殊字符]
学习·生活·娱乐
统计学小王子2 小时前
《数学少年-确定与不确定》(第四章:“骰子不骗人“)
学习·初中数学科普
其实防守也摸鱼3 小时前
前端应用的离线暂停更新策略:构建稳定可靠的渐进式部署方案
服务器·前端·数据库·学习·ai·命令行·linux系统
MartinYeung53 小时前
[论文学习]Mamba:具有选择性状态空间的线性时间序列建模
学习
j7~3 小时前
【数据结构初阶】队列的实现(链式队列 + 循环队列)--详解
c语言·开发语言·数据结构·学习·队列·queue·c\c++