T5大模型

T5 完整全称

Text-to-Text Transfer Transformer

中文直译:文本到文本迁移Transformer模型

简短拆解含义

  1. Text-to-Text(文本转文本)
    所有NLP任务统一范式:不管翻译、摘要、问答、分类,输入一段文本、输出一段文本,靠任务前缀区分任务(比如summarize:、translate English to Chinese:)。
  2. Transfer(迁移学习)
    先在海量C4语料预训练,再小数据微调适配下游业务。
  3. Transformer
    标准Encoder-Decoder双端架构(区别于BERT仅编码器、GPT仅解码器)。

补充关键细节

  • 2019年Google Research发布,论文标题:Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer
  • 没有token_type_ids输入参数(和BERT不一样);依靠前缀指令区分任务,位置编码用相对位置偏置而非绝对position_ids
  • 衍生变体:mT5(多语言)、Flan-T5(指令微调增强)、CodeT5(代码专用)
相关推荐
回眸&啤酒鸭3 天前
【回眸】Minicart 电商购物车核心功能落地指南
人工智能
一隅论数智3 天前
给AI一张“业务概念地图“:本体如何从哲学走向企业智能
大数据·人工智能·经验分享·笔记·学习·学习方法·政务
AI的探索之旅3 天前
97 个 OpenCV 实例(三十):双目立体,从标定到点云
人工智能·opencv·计算机视觉
AlbertZein3 天前
Step-5-Preview 上手实测:3D 游戏、金融分析、网页设计一次跑完
人工智能·aigc
LaughingZhu3 天前
Product Hunt 每日热榜 | 2026-09-19
人工智能·深度学习·神经网络·搜索引擎·百度
虎头金猫3 天前
4K 视频总卡在公网带宽?用 N1 + OpenList 把网盘播放链路重新理顺
运维·服务器·网络·python·容器·beautifulsoup·pandas
美狐美颜SDK开放平台3 天前
开发直播APP时如何接入视频美颜SDK?开发流程与注意事项
android·人工智能·计算机视觉·音视频·直播美颜sdk
wukangjupingbb3 天前
智能网联汽车安全能力框架
人工智能
风合星语3 天前
2026 具身智能技术实战(一):VLA 到底怎么控制机器人?——用 LeRobot 跑通 SmolVLA 推理
pytorch·机器人·具身智能·vla·lerobot·smolvla