BERT 简介

BERT 是"Bidirectional Encoder Representations from Transformers"的缩写。由谷歌 AI 团队在 2018 年 10 月提出,是对Transform的谷歌的最初的尝试,在 11 项自然语言处理测试中创下最佳成绩,机器阅读理解测试上首次超越人类水平。

  1. ‌双向理解‌:传统模型只能从左到右或从右到左读文字,BERT 能同时看词语左右两边的内容,就像人读书时能联系前后文理解意思。‌‌百科‌**

  2. ‌两个训练任务‌:

    • ‌猜被遮住的词‌:随机遮住 15% 的文字,让模型根据上下文猜原词是什么。
    • ‌判断句子关系‌:给两个句子,让模型判断第二句是不是第一句的下一句。‌‌
  3. ‌模型大小‌:基础版有 1.1 亿参数,大版有 3.4 亿参数,层数分别是 12 层和 24 层。‌‌

相关推荐
机器学习之心9 小时前
DCNN-PINN锂电池SOC估计,因果空洞卷积+物理信息神经网络,把库仑定律写进损失函数,MATLAB代码
人工智能·神经网络·matlab
信马堂13 小时前
WorkBuddy 接入第三方模型 API 全流程:安装与配置实录
人工智能·大模型·token·ai算力·workbuddy
朝朝辞暮i14 小时前
VLA 系统学习第 4 课:一个 Batch 进入神经网络后,模型到底是怎么“学会”的?
人工智能·python·神经网络·vla
IT古董14 小时前
《FDE前沿部署工程师实战教程》33 - Enterprise AI Observability:从Agent Trace到全链路智能运维
数据库·人工智能
xsd2024111814 小时前
地网腐蚀AI识别算法全解析:从锈蚀图像到地下腐蚀快速定位
人工智能
oooost14 小时前
pytorch学习笔记2(transformer)
人工智能·机器学习
云杂项15 小时前
Exploring Model Inversion Attacks in the Black-box Setting(个人笔记)
人工智能
还卿一钵无情泪15 小时前
Unsloth 微调 构建自己的大模型 没有GPU也能微调
linux·开发语言·人工智能·python·大模型·nlp·unsloth
冬奇Lab16 小时前
LLM 驱动的自动化测试系列(06):移动端自动化(二)——DroidRun/Mobilerun 的角色级模型拆分
人工智能·测试
冬奇Lab16 小时前
一天一个开源项目(第230篇):HandRaw-Style —— 把 327 种手绘风格、165 种排版、36 种配色编号化,让 AI 画图不再每次都飘
人工智能·开源·资讯