深度学习中“Transformer”怎么翻译为中文?

从功能来看,我觉得翻译成"归积"比较合适,与"卷积"对应

其中"归"指的是"归一化操作",例如LayerNorm、RMSNorm、GroupNorm,虽然最新有论文Transformers without Normalization,但这篇论文引入的DyT操作可以看成是一种简化的归一化操作;另外"归"还有一层含义是"归纳",而以Transformer为基础的大语言模型擅长对信息进行"归纳"

"积"类似"卷积"里的"积",泛指加权求和操作。Multi-Head Attention和FFN都可以看成是一种加权求和操作,前者作用于Time维度,后者作用于Channel维度。同时"积"还可以理解成积分,Transformer Decoder有点像t维度上的积分操作

相关推荐
Young丶15 小时前
讲透 Claude Code 系列 (四):Claude Skills 完全指南:可复用的“专业能力包”从入门到精通
人工智能·ai·ai编程·ai coding
阿里云大数据AI技术15 小时前
Hologres:一站式 Agentic 多模态检索分析平台
人工智能
回眸&啤酒鸭15 小时前
【回眸】AI新鲜事——百度 AI 搜索实战应用场景与落地
人工智能·百度
jsl_jsl_jsl16 小时前
《Agent 的记忆怎么做:实时记忆、被动压缩与主动整理的三层设计》
人工智能
词却16 小时前
深度学习入门:数据预处理与自定义数据集
深度学习
林浩杨_16 小时前
SIGIR 2026|南京大学:Video-GAR:“通过生成 Query 来验证视频语义理解”的生成增强范式
论文阅读·人工智能·算法
speop16 小时前
Hello-Agents | Task00 环境配置
人工智能
71777716 小时前
基于 Gitee 的软件成分分析(SCA)工具选型与集成参考
人工智能·gitee
子非鱼eva16 小时前
Ascend950PR版本速配表
人工智能·ai
Henry-SAP16 小时前
SAP PP模块核心机制解析
人工智能·云原生·sap·erp