论文阅读--深度学习基础文献

AlphaGo Zero

论文信息:Silver D, Schrittwieser J, Simonyan K, et al. Mastering the game of go without human knowledgeJ. nature, 2017, 550(7676): 354-359.

参考文章:
深入浅析AlphaGo Zero与深度强化学习
AlphaGo Zero论文解析

Attention is all you need

论文信息:Vaswani A, Shazeer N, Parmar N, et al. Attention is all you needC//Advances in neural information processing systems. 2017: 5998-6008.

参考文章:
Self-Attention和Transformer
Transformer论文逐段精读【论文精读】-- 李沐视频
白话机器学习-Encoder-Decoder框架

Transformer 抛弃了传统的 CNN 和 RNN,没用循环和卷积,整个网络使用了 Attention 机制组成。Transformer 由 Muiti-Attenion 和 Feed Forward Neural Network 组成。可以将时序信息完全做并行处理。

相关推荐
AI多Agent协作实战派5 小时前
【AI探索历程17】从“给自己用“到想“让别人用“
人工智能
吴佳浩5 小时前
Memory Provider 实战:Hermes、Mem0、Honcho、Hindsight 为什么都这样设计?
人工智能·agent·ai编程
吴佳浩5 小时前
企业级 Agent Memory 选型指南:如何构建可扩展的 Memory Service?
人工智能·agent·ai编程
北方的银狐-Zero7 小时前
ERP 管执行,数据管标准,OntoL本体 管思考:企业智能化升级的规划图
大数据·人工智能·本体论
浅安的邂逅7 小时前
260918-白帽把 OpenAI 论坛“打穿“了:攻防赛漏洞、账户被 Claude 入侵、模型偷偷掩盖不当行为
人工智能·大模型·ai编程·ai模型·行业动态
jinyishu_7 小时前
认识 AI Agent:概念、架构、设计模式与主流框架
人工智能
Hrain-AI7 小时前
AI 爬虫三档授权工程落地:搜索放行、训练拦截、Agent 分层(附脚本)
人工智能·elasticsearch·milvus
sunhy_csdn7 小时前
“词码”作为 Token 候选译名
人工智能
Hrain-AI7 小时前
多 Agent 并行不打架:worktree 隔离与反馈回流落地(附脚本)
网络·数据库·人工智能·架构