【小白笔记】KNN 核心预测函数 _predict_one 的过程

KNN 核心预测函数 _predict_one 的过程,本质上就是在用 PyTorch 的能力,一步步实现欧几里得距离公式 ,并进行多数表决


核心预测函数 _predict_one 记忆口诀(三步法)

步骤 目标 核心口诀 (PyTorch 链式操作) 记忆代码行 (骨架)
第一步 算距离 (L2 范数) 扩展 → 相减 → 平方 → 求和 → 开方 torch.sqrt(torch.sum( (X_train - x_new.unsqueeze(0)).pow(2), dim=1))
第二步 找邻居 距离排序 → 取前 K 个索引 k_indices = torch.argsort(distances)[:self.k]
第三步 定类别 标签索引 → 移回 CPU → 多数表决 Counter(y_train[k_indices].cpu().tolist()).most_common(1)[0][0]

核心代码精简解读与记忆点

下面是您需要背诵的、最核心的部分,每行都给出了精简的记忆提示:

A. 步骤 1:计算欧几里得距离 (L2 Distance)
代码行 目的/功能 关键记忆点
x_new_expanded = x_new.unsqueeze(0) 形状准备 。将 ( N feat , ) (N_{\text{feat}},) (Nfeat,) 变成 ( 1 , N feat ) (1, N_{\text{feat}}) (1,Nfeat), 准备广播。 unsqueeze(0):加 1 维,激活广播。
differences = self.X_train - x_new_expanded 算差值。利用广播机制,计算新点与所有训练点的差。 X_train - ...:张量广播相减。
squared_differences = differences.pow(2) 算平方。对所有差值进行平方。 .pow(2):欧氏距离公式的第一步。
sum_squared_diff = torch.sum(squared_differences, dim=1) 算求和 。沿着特征轴 (dim=1) 求和,得到距离平方。 torch.sum(..., dim=1):沿着特征维求和。
distances = torch.sqrt(sum_squared_diff) 算开方。最终得到欧几里得距离。 torch.sqrt(...):距离计算完成。
B. 步骤 2:找到 K 个最近邻居
代码行 目的/功能 关键记忆点
k_indices = torch.argsort(distances)[:self.k] 找索引 。对所有距离排序,并取出前 K 个最小距离的索引 argsort():self.k:排序后取前 K 个。
C. 步骤 3:多数表决 (Majority Voting)
代码行 目的/功能 关键记忆点
k_nearest_labels_torch = self.y_train[k_indices] 取标签。根据索引从训练标签中取出 K 个邻居的标签。 y_traink_indices:张量索引。
k_nearest_labels_cpu = k_nearest_labels_torch.cpu().tolist() 数据桥接 。将标签张量移回 CPU 并转为 Python 列表,以使用 Counter .cpu().tolist():关键的 CPU 转换步骤。
most_common = Counter(k_nearest_labels_cpu).most_common(1) 统计投票。找出出现次数最多的类别。 Counter().most_common(1):多数表决。
return most_common[0][0] 返回结果。提取出频率最高的类别标签。 00:提取最终标签值。

掌握这三步法和对应口诀,就能快速重现 _predict_one 的核心逻辑了。

相关推荐
RainCity3 天前
Java Swing 自定义组件库分享(十二)
java·笔记·后端
LinXunFeng10 天前
Obsidian - 使用 Share Note 分享笔记并自部署
前端·笔记·github
闪闪发亮的小星星15 天前
高斯光以及高斯光公式解释
笔记
cqbzcsq15 天前
CellFlow虚拟细胞论文阅读
论文阅读·人工智能·笔记·学习·生物信息
阿米亚波15 天前
【Windows】QEMU 启动 openEuler aarch64/arm64 架构系统 + 离线软件源
linux·windows·经验分享·笔记·架构·arm
自传.15 天前
尚硅谷 Vibe Coding|第三章(1) Claude Code深度使用与进阶技巧 学习笔记
笔记·学习·尚硅谷·vibecoding
.千余15 天前
【C++】模板进阶全解:非类型参数|全特化|偏特化|分离编译完全指南
开发语言·c++·笔记·学习·其他
自传.15 天前
尚硅谷 Vibe Coding|第二章 AI编程工具生态 学习笔记
笔记·学习·ai编程·尚硅谷·vibe coding
秋波。未央15 天前
Java Agent 开发 · Day 1 学习笔记(含作业完整标准答案)
java·笔记·学习
中屹指纹浏览器15 天前
2026指纹浏览器字体指纹、字体渲染偏差检测与全维度虚拟字体池搭建方案
经验分享·笔记