【机器学习】机器学习工程实战

文章目录

  • [第1章 概述](#第1章 概述)
    • [1.1 符号和定义](#1.1 符号和定义)
    • [1.2 什么是机器学习](#1.2 什么是机器学习)

书籍简介
【加】安德烈布可夫(Andriy Burkov ) 著
王海鹏 丁静 译
中国工信出版集团 人民邮电出版社


第1章 概述

1.1 符号和定义

1.1.1 数据结构

标量(scala)

一个简单的数值,如15或-3.25。

取标量值的变量或常量用斜体字母表示,如x或a。
向量(vector)

是一个有序的标量值列表,这些值称为属性。

向量可以用可视化的方式表示为箭头,指向某种方向,以及多维空间中的点。

二维向量举例:a = [2,3] , b = [-2,5] , c = [1,0]

我们想向量的一个属性表示为一个带索引的值,比如w(i)或x(j)

索引j表示一个向量的特定维度(dimension),即属性在列表中的位置。例如向量a中,a(1)=2,a(2)=3。

一个变量可以有两个或更多的索引,如 x i ( j ) x_{i}^{(j)} xi(j) 或 x i , j ( k ) x_{i,j}^{(k)} xi,j(k)。

例如在神经网络中,第l层中单元u的输入特征j表示为 x l , u ( j ) x_{l,u}^{(j)} xl,u(j)。
矩阵(matrix)

是一个以行和列排列的矩形数字阵列。

A= [ 2 − 2 1 3 5 0 ] \begin{bmatrix} 2 & -2 & 1\\ 3 & 5 & 0 \end{bmatrix} [23−2510] 是一个2行3列的矩阵
集合(set)

记为大写字母S

唯一元素的无序集。

一个集合可以是有限的(包括固定数量的值)。在这种情况下,用花括号来表示。

例如{1,3,18,23,235}或(x1,x2,x3,···,xn)。

另外,一个集合也可以是无限的,包括某个区间的所有值。
交集(intersection)

S1和S2的交集S3,我们写为 S 2 ← S 1 ∩ S 2 S_2 \leftarrow S_1 \cap S_2 S2←S1∩S2
|S|

表示集合S的大小,也就是它所包含的元素数量。

1.1.2大写西格玛记法

对集合X={x1,x2,···, x n − 1 x_{n-1} xn−1,x_n}或对向量的属性x=[x1,x2,···, x m − 1 x^{m-1} xm−1,xm]求和是这样表示的:

∑ i = 1 n x i = d e f \sum_{i=1}^{n} \ x_i \overset{def}{=} ∑i=1n xi=def x 1 + x 2 + ⋅ ⋅ ⋅ + x n − 1 + x n x_1 + x_2 +···+x_{n-1} + x_n x1+x2+⋅⋅⋅+xn−1+xn

∑ j = 1 m x ( j ) = d e f \sum_{j=1}^{m} \ x^{(j)} \overset{def}{=} ∑j=1m x(j)=def x ( 1 ) + x ( 2 ) + ⋅ ⋅ ⋅ + x ( m − 1 ) + x ( m ) x^{(1)} + x^{(2)} +···+x^{(m-1)} + x^{(m)} x(1)+x(2)+⋅⋅⋅+x(m−1)+x(m)

= d e f \overset{def}{=} =def 的意思是"定义为"。

向量x的欧氏范数(Euclidean norm),用 ∥ x ∥ \|x\| ∥x∥表示,表示向量的"大小"或"长度"。

通过计算 ∑ j = 1 D ( x ( j ) ) 2 \sqrt{\sum_{j=1}^{D}(x^{(j)})^2} ∑j=1D(x(j))2 得到。

两个向量a和b之间的距离由欧氏距离(Euclidean distance)给出:

∥ x ∥ = d e f ∑ i = 1 N ( a ( i ) − b i ) 2 \|x\| \overset{def}{=}\sqrt{\sum_{i=1}^{N}(a^{(i)}-b^{i})^2} ∥x∥=defi=1∑N(a(i)−bi)2

1.2 什么是机器学习

腊肉芥末果

打了一下午的字,学习进展缓慢,主要是数学符号太难输入了。。

后续待更新

基本是在抄书,后期是想梳理总结的。

相关推荐
梦梦代码精28 分钟前
从工程视角拆解 BuildingAI:一个企业级开源智能体平台的架构设计与实现
人工智能·gitee·开源·github
supericeice28 分钟前
复杂项目管理如何用好大模型:RAG、知识图谱与AI编排的落地框架
人工智能·知识图谱
AI机器学习算法6 小时前
深度学习模型演进:6个里程碑式CNN架构
人工智能·深度学习·cnn·大模型·ai学习路线
Ztopcloud极拓云视角6 小时前
从 OpenRouter 数据看中美 AI 调用量反转:统计口径、模型路由与多云应对方案
人工智能·阿里云·大模型·token·中美ai
AI医影跨模态组学6 小时前
如何将深度学习MTSR与膀胱癌ITGB8/TGF-β/WNT机制建立关联,并进一步解释其与患者预后及肿瘤侵袭、免疫抑制的生物学联系
人工智能·深度学习·论文·医学影像
搬砖的前端6 小时前
AI编辑器开源主模型搭配本地模型辅助对标GPT5.2/GPT5.4/Claude4.6(前端开发专属)
人工智能·开源·claude·mcp·trae·qwen3.6·ops4.6
Python私教7 小时前
Hermes Agent 安全加固与生态扩展:2026-04-23 更新解析
人工智能
饼干哥哥7 小时前
Kimi K2.6 干成了Claude Design国产版,一句话生成电影级的动态品牌网站
人工智能
肖有米XTKF86467 小时前
带货者精品优选模式系统的平台解析
人工智能·信息可视化·团队开发·csdn开发云
天天进步20157 小时前
打破沙盒限制:OpenWork 如何通过权限模型实现安全的系统级调用?
人工智能·安全