强化学习论文查找指南

寻找高质量的强化学习(Reinforcement Learning, RL)论文,通常有以下几个主要渠道,涵盖了从顶会发表的经典论文到最新的预印本:

1. 顶级人工智能与机器学习会议 (最权威)

这是获取经过同行评审、代表当前 SOTA (State-of-the-art 最先进的) 水平论文的首选渠道。关注每年的录用名单(Accepted Papers)。

  • NeurIPS (Neural Information Processing Systems 神经信息处理系统): AI 领域的顶级会议,每年都有大量高质量的 RL 理论和应用论文。

  • ICML (International Conference on Machine Learning 国际机器学习会议
    ): 偏重机器学习理论和基础算法,RL 是其中的重头戏。

  • ICLR (International Conference on Learning Representations 国际学习表征会议
    ): 深度学习领域的顶会,深度强化学习(Deep RL)的论文非常多。

  • RLC (The Reinforcement Learning Conference 强化学习会议
    ): 特别推荐。这是专门针对强化学习的新兴顶级会议(2024年首届),由 RL 社区核心大佬们发起,内容更聚焦。

  • AAAI / IJCAI: 综合性 AI 会议,也有不少 RL 相关工作。

  • ICRA / IROS: 如果你关注机器人控制(Robotics)方向的 RL,这两个机器人顶会是必看的。

2. 论文预印本平台 (最新、最快)

如果你想看昨天或今天刚出来的论文,不需要等会议发表,可以直接去预印本网站。

  • arXiv.org: 几乎所有 CS(Computer Science 计算机科学) 领域的论文都会先挂在这里。

    • 关注分类:cs.LG (Machine Learning) 和 cs.AI (Artificial Intelligence)。

    • arXiv Sanity Preserver: 一个辅助工具,帮你过滤和推荐 arXiv 上热门的论文,比直接刷 arXiv 高效。

3. 代码与论文结合平台 (最实用)

对于初学者或工程师,能看到代码复现往往比只看公式更重要。

  • Papers with Code:

    • 必用神器。 它会将 arXiv 上的论文与 GitHub 上的代码库关联起来。

    • 你可以直接浏览 Reinforcement Learning 专区,查看当前在这个任务上排名第一(SOTA)的方法是什么。

4. 语义搜索与关联工具 (适合深入研究)

当你找到一篇好论文,想通过它找到更多相关论文时:

  • Connected Papers: 输入一篇论文标题,它会生成一个可视化图谱,显示引文网络,帮你快速找到这篇论文的"前世今生"以及相似的重要论文。

  • Semantic Scholar: 比 Google Scholar 更好用的学术搜索引擎,它的引用分析更智能,能帮你筛选出"高影响力引用"。

5. 经典入门与精选列表 (Awesome Lists)

如果你是刚入门,不要直接去啃最新的顶会论文,建议从经典综述或教程开始。

  • OpenAI Spinning Up: OpenAI 编写的深度强化学习入门教程,里面列出了"必读论文清单(Key Papers in Deep RL)",按算法分类(如 DQN, A3C, PPO, SAC 等)。

  • GitHub 上的 "Awesome Reinforcement Learning": 社区维护的资源列表,涵盖了课程、书籍、和按主题分类的经典论文。


建议的阅读路径!!:

  1. 先看 OpenAI Spinning UpKey Papers 列表,掌握经典算法。

  2. Papers with Code 查找特定领域(如多智能体、离线 RL)的 SOTA 论文。

  3. 定期刷 NeurIPS/ICLR 的获奖或高分论文以保持前沿敏感度。

相关推荐
2501_926978332 分钟前
提示工程的实战报告(二):模型的失败模式与边界行为
人工智能·深度学习·算法
行走的小派8 分钟前
Zero 4不是Zero 3W的升级版,是香橙派的策略补位
人工智能·香橙派·边缘ai
IanSkunk9 分钟前
企业AI办公落地技术拆解:从WorkBuddy任务引擎到JOTO实施路径
大数据·人工智能
Mycdn_WD26 分钟前
项目交付后的机房,能参与边缘节点协作吗?
人工智能·cdn·pcdn·城域网·pcdn资源招募
LayZhangStrive34 分钟前
线性代数 - 第1章 行列式
人工智能·线性代数·机器学习
Michaelliu_dev1 小时前
多模态大模型推理流程解析
人工智能·llm·多模态大模型·vit·llava·rope·mllm
正经教主1 小时前
Trae Work 提示词使用要求与教程
人工智能
潜龙95271 小时前
手机自动化测试AI新方案
人工智能·智能手机
烂蜻蜓1 小时前
AI入门教程(十):AI API开发:从“会用AI聊天”到“让AI在你的代码里干活”的完整指南
人工智能·ai
书签12362 小时前
产教融合的技术解法:AI数字孪生驱动的校企协同育人系统架构与实践
人工智能·系统架构