技术栈
稀疏化
thesky123456
1 天前
面试
·
大模型
·
剪枝
·
知识蒸馏
·
模型蒸馏
·
稀疏化
27届大模型岗面试准备(十一):模型蒸馏与稀疏化——从软标签到结构化剪枝的压缩全景
上一篇讲推理加速时留了个尾巴:KV Cache、PagedAttention 这些手段优化的是"怎么跑得快",但模型本身的参数量没变。如果连模型都能变小、变稀疏,推理优化的天花板才能真正抬高。这就是今天的主题——知识蒸馏(Knowledge Distillation)与稀疏化(Sparsification)。
我是有底线的