第1章,机器学习与深度学习

1、深度学习是什么

深度学习和机器学习的区别(仅个人理解):

(1)深度学习是机器学习的一个子集

(2)深度学习利用多层神经网络从大量数据中进行学习

狭义的机器学习:除去深度学习的机器学习

一般是基于数学,或者统计学的方法,具有很强的可解释性(就是说得通,有道理,令人信服)。

经典的传统机器学习算法:KNN, 决策树,朴素贝叶斯......

KNN: K最近邻居(K-Nearest Neighbors,简称KNN)

一种监督(有标签,比如把人分成北大和清华的)学习算法,用于分类和回归问题。它的基
本思想是通过测量不同数据点之间的距离来进行预测。

KNN的工作原理可以概括为以下几个步骤:

(1)距离度量:KNN使用距离度量(通常是欧氏距离(三维空间))来衡量数据点之间的相似性。

(2)确定邻居数量K
(3)投票机制

决策树

假如没有垃圾关键词的邮件中有垃圾邮件该怎么办?:添加特征

决策树不善于处理未见过的特征

朴素贝叶斯

  • y = c_k:表示"交通方式是飞机(或火车、自行车)"

  • x:表示"到达了 B 地"

机器学习,具有数学上的可解释性,但准确率不是百分百,且不灵活

深度学习

神经网络的任务


常见的神经网络的输入, 一般有三种数据形式。

我们想要的输出(任务类别)一般也有下面几种。

深度学习任务


大家都说深度学习需要数据,为什么?:因为要从数据中找到函数

如何从数据中找到想要的函数?

(1)定义一个函数

(2)计算LOSS

(3)根据LOSS对模型进行优化

Loss的大小就衡量了我们选择的这个函数的好坏。

当w_0处的导数大于0时:往左走

当w_0处的导数小于0时:往右走

至于这一步走多长:

导数越大可能离得越远,那就多走一些。

导数越小可能离得越近,那就少走一些。

超参数:人为规定的参数

学习率不能太大也不能太小:

(1)太大:容易走过头

(2)太小:走太慢

相关推荐
To_OC2 小时前
大模型蒸馏是啥?说白了就是大厨带徒弟的学问
人工智能·llm·agent
新手来了@click2 小时前
JAVA+AI 简化开发操作|文章被 AI Agent 技术社区收录分享
人工智能
GuWenyue3 小时前
Cursor黑盒拆解!1套LangChain.js手写Mini编程Agent,自动生成React项目,效率提升60%
前端·数据库·人工智能
GuWenyue3 小时前
传统Agent工具两大痛点!300行代码落地MCP跨语言工具,彻底解耦LLM与工具
前端·人工智能·算法
老云讲算力市场3 小时前
WAIC首日观察:国产算力与机器人加速落地,奇点算力迎来产业新机遇
人工智能·科技
糖果店的幽灵3 小时前
【DeepAgents 从入门到精通】Context Management 上下文管理
java·人工智能·后端·spring·中间件·langgraph·deepagents
小林ixn3 小时前
大模型随机说话的秘密:Temperature 和 Top K 深度解析,LangChain 实战调优
人工智能·langchain
ALINX技术博客3 小时前
ALINX 亮相 2026 WAIC 世界人工智能大会,展示 AI 视觉 FPGA+GPU 异构计算与电子后视镜解决方案
人工智能·ai·fpga·世界人工智能大会·电子后视镜
程序员老猫4 小时前
当 AI 能写 80% 的代码时,后端工程师的核心价值还剩什么?
人工智能
想会飞的蒲公英4 小时前
计算机怎样读取中文文本:编码、清洗与标准化
人工智能·python·自然语言处理