Laya 源码级原理拆解之二:序列打包与决策头我在之一里把 Laya 的整体架构和运行入口拆完了,当时留了一个最关键的疑问没有展开:它号称一次前向就把判断吐出来,输出 token 还是免费的,这件事在代码层面到底是怎么发生的。这一篇我直接进 common.py 和 agent.py,把序列打包 build_sequence 和决策头 DecisionModel 的源码逐行走查一遍,再把温度缩放和那套容易踩错的双置信度说清楚。最后看一下 fast.py 和 tl_kernels.py 怎么把同样的决策换一组融合核跑在 GPU 上。