BERT 简介

BERT 是"Bidirectional Encoder Representations from Transformers"的缩写。由谷歌 AI 团队在 2018 年 10 月提出,是对Transform的谷歌的最初的尝试,在 11 项自然语言处理测试中创下最佳成绩,机器阅读理解测试上首次超越人类水平。

  1. 双向理解:传统模型只能从左到右或从右到左读文字,BERT 能同时看词语左右两边的内容,就像人读书时能联系前后文理解意思。‌‌百科‌**

  2. 两个训练任务

    • 猜被遮住的词:随机遮住 15% 的文字,让模型根据上下文猜原词是什么。
    • 判断句子关系:给两个句子,让模型判断第二句是不是第一句的下一句。‌‌
  3. 模型大小:基础版有 1.1 亿参数,大版有 3.4 亿参数,层数分别是 12 层和 24 层。‌‌

相关推荐
jikemaoshiyanshi15 小时前
AWS 中国峰会 2026 有哪些 AI Agent 相关演讲可以看?按业务、研发与生产阶段选看
大数据·人工智能
网易易盾15 小时前
AI互动产品安全合规体系架构:制度/技术/运营/证据四层落地
人工智能·安全·aigc·内容安全
新知图书16 小时前
4.3 链接速读
人工智能·语音识别·ai助手·千问
江苏久众新视16 小时前
SOP-AI实战:基于AI视觉与视频检测,精准管控空调管件装配防漏防错
人工智能
u01030552717 小时前
Java AWT鼠标事件全解析
人工智能·1024程序员节
tuanxiang17 小时前
中英文AI检测的跨语系误判问题排查与修复
人工智能
冬奇Lab18 小时前
开源项目第178期:OptMem — 426 个 token 的提示词,给 AI Agent 跨会话的持久记忆
人工智能·开源·资讯
冬奇Lab18 小时前
代码库知识库系列(09):用 codebase-memory-mcp 实战——在 LightRAG 上跑三路召回
人工智能
科技圈观察18 小时前
选哪家服务商做跨境业务KYC数字身份认证和合规支持?2026出海选型参考
大数据·人工智能