Datawhale X 李宏毅苹果书 AI夏令营 入门 Task1-机器学习

目录

机器学习基础

机器学习:机器具备有学习的能力/让机器具备找一个函数的能力。比如语音识别、图像识别、

机器学习有不同的类别。

1)回归:假设要找的函数的输出是一个数值/标量,这种机器学习的任务称为回归。

2)分类:分类任务要让机器做选择题。人类先准备好一些选项,这些选项称为类别。

3)结构化学习:机器不只是要做选择题或输出一个数字,而是产生一个有结构的物体,比如让机器画一张图,写一篇文章。这种叫机器产生有结构的东西的问题称为结构化学习。

案例分析-视频的点击次数预测

机器学习流程

1)构建模型

写出一个带有未知参数的函数(模型),用于预测未来观看次数。

例如, y = b + w x 1 y = b + wx_1 y=b+wx1,其中 y 是预测的观看次数, x 1 x_1 x1 是前一天的观看次数,b 和 w 是未知参数。

其中,带有未知的参数的函数称为模型。特征 x 1 x_1 x1是这个函数里面已知的,而 w 跟 b 是未知的参数。w 称为权重,b 称为偏置。

2)定义损失函数

损失函数用于评估模型预测值与实际值之间的差异。

例如,如果 b = 500 和 w = 1,则预测函数为 y = 500 + x 1 y = 500 + x_1 y=500+x1。

计算每一条记录的预测值与实际值之间的差距,并求平均值得到损失。

3)最优化

使用梯度下降算法来调整模型参数,以最小化损失函数。

初始参数随机选取,然后根据损失函数的梯度来更新参数。

更新规则为: w 1 ← w 0 − η ∂ L / ∂ w ∣ w = w 0 w1 ← w0 - η ∂L/∂w | w=w_0 w1←w0−η∂L/∂w∣w=w0,其中 η 是学习率。

梯度下降过程中可能遇到局部最小值,但这通常不是一个严重的问题。

4)结果

在训练数据上找到了最佳参数 w* = 0.97, b* = 100。

使用这些参数得到的平均误差约为 480。

在未见过的数据上(2021年的数据),模型的误差为 0.58。

相关公式

1.模型公式:

2.损失函数

3.参数更新

相关推荐
AIGC包拥它1 分钟前
RAG 项目实战进阶:基于 FastAPI + Vue3 前后端架构全面重构 LangChain 0.3 集成 Milvus 2.5 构建大模型智能应用
人工智能·python·重构·vue·fastapi·milvus·ai-native
Cosolar1 分钟前
AI Agent 记忆机制全景对比:OpenClaw vs QwenPaw vs Hermes vs HiClaw
人工智能·深度学习·语言模型·chatgpt·面试
禾刀围玉2 分钟前
基于FPGA的卷积神经网络实现-Step2 卷积模块设计
人工智能·fpga开发·cnn
资源分享助手2 分钟前
超级改图P图改字无限制版教程(安卓)AI改图软件、图片改字软件、安卓修图APP、智能消除工具、图片拼接APP、超级改图下载
android·人工智能
二哈赛车手4 分钟前
新人笔记---简易版AI实现以图搜图功能
java·人工智能·笔记·spring·ai
sno_guo4 分钟前
直播抠图技术100谈之25---调色中曲线是最优解
人工智能·算法·机器学习·直播·内容运营·obs抠图·直播技术
zhangxingchao6 分钟前
AI应用开发二:Embedding与向量数据库
前端·人工智能·后端
日取其半万世不竭8 分钟前
Ollama + Open WebUI 部署教程:本地运行大语言模型,自建私有 AI 助手
人工智能·语言模型·自然语言处理
weixin_4462608511 分钟前
本地部署与实践指南:构建免费的AI开发助手系统(Claude Code + Ollama)
人工智能
南宫萧幕17 分钟前
Simulink 从零搭建 HEV ECMS 环境:模块解析、排坑指南与智能算法接口预留
人工智能·算法·matlab·汽车·控制