BERT 简介

BERT 是"Bidirectional Encoder Representations from Transformers"的缩写。由谷歌 AI 团队在 2018 年 10 月提出,是对Transform的谷歌的最初的尝试,在 11 项自然语言处理测试中创下最佳成绩,机器阅读理解测试上首次超越人类水平。

  1. 双向理解:传统模型只能从左到右或从右到左读文字,BERT 能同时看词语左右两边的内容,就像人读书时能联系前后文理解意思。‌‌百科‌**

  2. 两个训练任务

    • 猜被遮住的词:随机遮住 15% 的文字,让模型根据上下文猜原词是什么。
    • 判断句子关系:给两个句子,让模型判断第二句是不是第一句的下一句。‌‌
  3. 模型大小:基础版有 1.1 亿参数,大版有 3.4 亿参数,层数分别是 12 层和 24 层。‌‌

相关推荐
月光船幽幽5 小时前
检测用户意图复杂性的关键方法
人工智能·python
Henry-SAP6 小时前
AI突破重塑未来科技格局
人工智能·云原生·sap·erp
空堂与归7 小时前
图像识别总是准确率低?用卷积神经网络CNN实现高效分类
人工智能·深度学习·分类·cnn
老猿AI洞察8 小时前
阿里云启用巴西数据中心,AI服务出海落子南半球
人工智能·阿里云·云计算
大金SEO8 小时前
GEO启动的正确顺序:先做信源清理,再谈内容扩张
大数据·人工智能
Bruce_Liuxiaowei8 小时前
从基础理论开始学习人工智能(三):盲目搜索——从状态空间图到生成-测试范式
人工智能·学习
qyz_hr8 小时前
拥抱AI,红海云筑牢企业组织与人力数据底层能力
人工智能
Capricorn19889 小时前
个人知识库接入大模型频现“幻觉引用”?排查 RAG 溯源失效问题,解析知芽构建可信第三大脑的底层架构
大数据·论文阅读·人工智能·笔记·架构·论文笔记
LaughingZhu9 小时前
Product Hunt 每日热榜 | 2026-08-27
人工智能·深度学习·神经网络·搜索引擎·百度