编译期优化

thesky12345636 分钟前
大模型·tvm·图优化·xla·算子融合·编译期优化·推理编译
27届大模型面试准备(六十七):大模型推理编译与图优化工程——从计算图到高效内核本篇是"工程实战深化"的第 67 篇。前面我们写过推理引擎内核(A59:PagedAttention、调度器、显存管理)、注意力演进与 KV Cache(A36)、推理调度与弹性扩缩容(A66)。它们讨论的都是"运行时(runtime)"如何把已经存在的内核高效地排起来。但还有一个前置关卡经常被面试深挖:这些内核本身从哪来? 为什么同一个 Transformer,用 torch.compile 能比 eager 模式快一倍,用 TensorRT-LLM 又能再快一截?答案在"编译期"——把计算图翻译成对硬
superman超哥8 个月前
开发语言·后端·rust·rust所有权·rust零成本抽象·编译期优化
Rust 所有权与零成本抽象的关系:编译期优化的完美结合零成本抽象是 Rust 的核心设计理念——高级抽象不应该比手写的低级代码产生更多的运行时开销。这个理念源于 C++ 之父 Bjarne Stroustrup 的名言"你不需要为你不使用的东西付费"。但 Rust 更进一步——通过所有权系统在编译期完成内存管理,实现了既安全又零成本的抽象。传统语言在安全性和性能间妥协——C/C++ 的手动内存管理高效但危险,Java/Python 的垃圾回收安全但有运行时开销。Rust 的所有权系统打破了这个二元对立——编译器在编译期精确追踪每个值的生命周期,插入析构调用,
我是有底线的