LLM论文笔记 24: A Theory for Length Generalization in Learning to Reason

  • Arxiv日期:2024.7.29
  • 机构:University of Illinois Chicago

关键词

  • 长度泛化
  • 理论证明

核心结论

  • Theorem 3.1:因果函数的学习条件

    • 因果函数 f 是完全可学习的(输入空间有限、因果函数输入维度有限),即可以通过有限的训练数据准确地学习到目标函数
  • Corollary 3.1.1:数据覆盖不足的影响

    • 训练数据未覆盖输入空间 X 的所有可能值,模型可能无法正确预测未知输入上的因果关系
  • Corollary 3.1.2:输入空间无限的后果

    • 如果输入空间 X 或输入维度是无限的,无论训练数据集有多大,模型在未知输入上的误差总是可能任意大
  • Theorem 3.2:递归推理与长度泛化

    • 如果因果函数 f 被完全学习,推理问题可以表示为有向无环图(DAG),则通过递归地应用 f ,可以解决任意长度或规模的问题

    • 训练中仅见过小规模问题的模型可以泛化到更长的推理任务

  • Theorem 3.3:局部性条件与滑动窗口机制

    • 滑动窗口是解决长度泛化问题的充分条件

    • 如果推理问题的最大输入元素距离 R < ∞ ,并且训练数据包含所有长度为 4R+1 的子序列(可以通过滑动窗口(长度为 4R+1 )唯一确定下一步推理的输入)

  • Definition 3.3:well-defined 的因果输入恢复

    • 如果推理问题是 (n, r) -一致的,可以定义一个函数 ,通过 n 个长度为 r 的子序列唯一恢复当前推理步骤所需的因果输入
  • Theorem 3.5:从 R < ∞ (1, 4R+1) -一致性

    • 如果 R < ∞ 且每个输入元素最多参与一个推理步骤,则问题是 (1, 4R+1) -一致的
  • Theorem 3.6:因果输入的可恢复性

    • 如果问题是 (n, r) -一致的:

      • 可以通过 n 个长度为 r 的子序列恢复推理步骤中所有的因果输入。

      • 因果输入集合 是well-defined 的,并可以通过函数 \gamma 唯一确定。

  • Theorem 3.7: 的学习性

    • 如果问题是 (n, r) 一致的,函数 可以通过有限训练数据学习。

主要方法

注:本系列不包括基础的知识点讲解,为笔记/大纲性质而非教程,用于论文知识点和思想和快速记忆和回顾,更多细节建议阅读论文原文

相关推荐
Yunzenn1 分钟前
深度分析字节最新研究cola-DLM第 01 章:语言生成的三次范式之争 —— 从 RNN 到 AR 到扩散
linux·人工智能·rnn·深度学习·机器学习·架构·transformer
m0_634666731 分钟前
Stability Audio 3.0 把 AI 音乐推过了一个门槛:从“音频片段”走向“完整歌曲”
人工智能·音视频
名不经传的养虾人2 分钟前
从0到1:企业级AI项目迭代日记 Vol.30|看不见的地基:从“能用”到“可信”的30天
人工智能·ai编程·企业ai
晚烛2 分钟前
CANN 数据流与内存优化:L1/L2 缓存机制与计算重叠深度解析
人工智能·python·缓存
yoona10202 分钟前
Web3 基础概念笔记:理解测试网交易、合约调用、钱包确认与链上验证
笔记·web3·区块链
薛定猫AI4 分钟前
【深度解析】从 Antigravity 2.0 看 AI Agent 的产品化演进:动态子代理、项目工作区与多模型编排实战
人工智能
2的n次方_4 分钟前
健身 Agent:不止视频,更有 AI 人物实时跟练交互
人工智能·音视频·交互·魔珐星云
前端不太难4 分钟前
CPU+GPU:开启AI推理新时代
人工智能·状态模式
chian-ocean4 分钟前
创业者实操:10 分钟搭建可商业化的交互型 AI 家电导购产品
人工智能
盼小辉丶5 分钟前
PyTorch强化学习实战——Atari游戏包装器
pytorch·深度学习·强化学习