首页
看点啥
插画图片
首页 看点啥 BERT 介绍

BERT 介绍

2026-07-20 0

BERT 是"Bidirectional Encoder Representations from Transformers"的缩写。由谷歌 AI 团队在 2018 年 10 月提出,是对Transform的谷歌的最初的尝试,在 11 项自然语言处理测试中创下最佳成绩,机器阅读理解测试上首次超越人类水平。

BERT 简介

它本质上是Transformer的一个Encoder(编码器)

特征编码

开源优势: 提供预训练模型,避免从零开始训练

  1. 双向理解:传统模型只能从左到右或从右到左读文字,BERT 能同时看词语左右两边的内容,就像人读书时能联系前后文理解意思。‌‌百科‌**

  2. 两个训练任务

    • 猜被遮住的词:随机遮住 15% 的文字,让模型根据上下文猜原词是什么。
    • 判断句子关系:给两个句子,让模型判断第二句是不是第一句的下一句。‌‌
  3. 模型大小:基础版有 1.1 亿参数,大版有 3.4 亿参数,层数分别是 12 层和 24 层。‌‌

喜欢(0)

上一篇

从 Token 到 RAG:我这一周搭起的大模型基础认知地图

从 Token 到 RAG:我这一周搭起的大模型基础认知地图

下一篇

多 Agent 协同:从委派到受限执行

多 Agent 协同:从委派到受限执行
猜你喜欢