百度ERNIE系列预训练语言模型浅析(4)-总结篇

总结:ERNIE 3.0与ERNIE 2.0比较

(1)相同点:

采用连续学习

采用了多个语义层级的预训练任务

(2)不同点:

ERNIE 3.0 Transformer-XL Encoder(自回归+自编码), ERNIE 2.0 Transformer Encoder(自编码)

预训练任务的细微差别,ERNIE3.0里增加的知识图谱

ERNIE 3.0考虑到不同的预训练任务具有不同的高层语义,而共享着底层的语义(比如语法,词法等),为了充分地利用数据并且实现高效预训练,ERNIE 3.0中对采用了多任务训练中的常见做法,将不同的特征层分为了通用语义层(Universal Representation)和任务相关层(Task-specific Representation)。

参考

相关推荐
Fairy要carry2 分钟前
初创实习-IMU模型
人工智能·算法·机器学习
枫叶林FYL10 分钟前
【群体智能集群控制工程实践】第1章 群体智能核心原理
人工智能·深度学习
是Yu欸12 分钟前
实测openPangu-2.0-Pro:昇腾原生, 505B大模型的开源答卷
人工智能·开源·大模型·昇腾·pangu
FPGA开源工坊13 分钟前
ISP图像处理--Bayer Raw格式
图像处理·人工智能·verilog·fpga·isp
2601_9676598917 分钟前
2026停车场巡检机器人排行:地下停车场夜间巡逻怎么选
人工智能·机器人
Csvn17 分钟前
第 15 章 规划 Planning
人工智能·aigc·agent
workflower18 分钟前
TF-IDF 的基本思想
人工智能·机器学习·机器人·云计算·无人机
数据狐(Datafox)19 分钟前
mercadolibre.item_get 工程实战:美客多商品详情API技术解析与落地应用
java·人工智能·mysql·json
打破砂锅问到底00725 分钟前
2 小时从零炼一个 64M 小模型:MiniMind 源码精读与显存踩坑
人工智能