🖼️ 图片:图书馆实拍 · Wikimedia Commons(CC0)
让机器听懂人说的话、读懂人写的字,这件事叫 NLP(自然语言处理):AI 里最有用、也最难的方向之一。难就难在人话太多变——「苹果」可能是水果,也可能是手机;「它的毛很软」里的「它」是谁,还得看前面的句子才知道。
人类最早想让机器处理语言,就是在这种「一间屋子那么大」的电脑上试的。1954 年,一台 IBM 701 当众把 60 句俄语翻成了英语——规则全靠人一条条写进去,多一句就不灵了。
后来机器聪明多了,可读句子还是「排队」:一个字一个字顺着读,读到后面就忘了前面;有的干脆两个方向各读一遍,再把结果拼起来。句子一长它就开始糊涂,「它」指的是谁也分不清。
2018 年 10 月 11 日,Google 的四位科学家提出 BERT:读到一个词时,左边和右边一起看。就像我们读「小明把蛋糕藏进了冰箱」——读到「藏」的那一下,自然会想起前面的「小明」和后面的「冰箱」。
练法很像语文考试的完形填空:把句子里的词挖掉,让它靠前后文猜回来——「我 ▢ 吃苹果」,猜出「爱」;再加一道「这两句话接得上吗」。几十亿道题做下来,它就摸到了语言的规律。
2018 年 10 月底,Google 把 BERT 的代码和模型全部公开,还放出中文版——谁都能下载来用。它一口气在 11 项语言理解比赛里拿下第一,有的题目(比如阅读理解)甚至比人答得还好。
2019 年,Google 搜索用上了 BERT:你随口问的一句话,哪怕说得颠三倒四它也能懂。今天手机的输入法、翻译、客服、智能音箱背后都有它的影子——它还留下「先海量地读、再针对具体活儿练一练」这套做法,后来几乎所有大模型都照着走。NLP 从此从「机器能读」走向了「机器能懂」。
🖼️ 图片:智能音箱、1951 年 UNIVAC 电脑、排队的队伍、读书的孩子、图书馆均为真实照片(Wikimedia Commons / Computer History Museum,CC BY 2.0 / CC BY-SA 4.0 / CC BY 4.0 / CC BY-SA 3.0 / CC0);完形填空图解来自 Daniel Voigt Godoy(CC BY 4.0);GitHub 仓库与 Google 博客为真实页面截图,均仅作教学使用
点击卡片翻开,看看背后的知识~
诗句来自 zeroai / AI200 的 tanshi.txt,每句的情感标签由「大模型」预先标好。字先变成字向量,经过双向自注意力,最前面那顶「[CLS] 帽子」把整句收成一个向量,最后对 8 类情感打分。训练完还会用 500 句没读过的诗考一考它。
先点「🎬 开始可视化训练」,看它一遍遍读带标签的诗句,学会把「整句的意思」和 8 类情感对上(损失下降 + 注意力点亮);再用「👣 单步」一步步看它对一句诗怎么判断。
这 500 句是考卷——训练时 BERT 从没见过。点一句,让 BERT 现场判断;行尾的 ❓ 鼠标移上去会露出「正确答案」。
先点上方「🎬 开始可视化训练」让 BERT 读熟这些标好情感的诗句;再在框里输入一句诗(或点「🎲 换一句」),点「🧠 判情感」——下方会列出它对 8 类情感的把握,右边会亮出它「双向看完整句」时帽子❂ 和每个字的关注度(越红越关注)。
点选答案,答对会变绿、答错会变红(可重试)~
Q1. BERT 的「双向」是什么意思?
Q2. BERT 主要是靠什么方式训练的?
Q3. 2018 年 BERT 最轰动的成绩是什么?
Q4. 在唐诗实验室里,BERT 要判断的是诗句的什么?
Q5. 那个实验室一共分几类情感?
Q6. 训练用的那 3000 句唐诗,标签是谁给的?
Q7. 那 500 句「考卷」是干什么用的?
Q8. BERT 靠哪一个符号把整句收成一个向量去分类?
💭 思考一下:读书时「只看前面」和「前后都看」,理解的差别有多大?造一个需要回头看的句子,考考爸爸妈妈吧。
小小学员 完成了 本站《BERT:会读诗、懂情感的语言小天才》
学会:Google 提出双向编码器表示,刷新 11 项 NLP 任务纪录