🖼️ 图片:ChatGPT 写作文界面截图 · 公有领域 · Wikimedia Commons
在 ChatGPT 之前,大模型只会一件事:接着你的话往下写。它住在这样的巨型机器里,普通人根本碰不到——想让它干活,得会写代码、会连接口,只有工程师才玩得转。
光会写还不够——它还爱胡说、不懂礼貌。于是 OpenAI 请人当裁判(这套训练法叫「人类反馈强化学习」):回答得好就表扬、答得不好就纠正,再让模型照着改。一遍遍练下来,它才学会好好说话、不乱答。
2022 年 11 月 30 日,ChatGPT 上线。它当时的本领很单一:只会打字聊天——你打一句话,它接着往下写。但它看不懂图片、听不见声音、也不会自己上网。
就这么一个「只会聊天」的程序,上线 5 天就有 100 万人用,两个月突破 1 亿人——成了当时增长最快的应用,全世界都在跟它聊天。
2023 年 3 月,它换上 GPT-4 这个更聪明的「大脑」:考试成绩能超过大多数人,还能帮你写代码。不过这时它还是只能看字,给它一张图,它看不见。
这一年的秋天,它的本领一下多了好几样:能看懂图片(拍张照问它,它给你讲);能画出新图(说一句「画一幅下雪的圣诞树」就行);能上网查资料,还会算数、写代码。
手机版先让它走进口袋;2023 年 9 月,它就学会了听和说:你对着手机说话,它能用语音答你。2024 年 5 月发布的 GPT-4o 让语音更自然(说话可以打断、语气有起伏,7 月底起逐步开放);到了 2024 年 12 月,它还能一边看你镜头里的画面,一边讲给你听。
最近这两年,它又学会了最难的两件事:遇到难题先一步步想清楚再回答;会用工具干活——上网查、画图、跑代码、做视频,还能自己安排好几步任务。它从「会聊天的机器」变成了「会干活的助手」。
它的本领再多,也得靠你「问」出来。同样一句「帮我写作文」,说清楚「写一篇关于我家小猫的 200 字作文,要写它贪吃的样子」,回答会好得多。会提问,是和 AI 合作的第一课。
以前的 AI 住在实验室里,普通人很难用上;从 ChatGPT 开始,AI 走进了千家万户——输入法联想、翻译、客服、作业助手,背后都是它这样的聊天 AI。只要你会打字、会提问,就能请 AI 帮忙。
🖼️ 图片:超级计算机照片(Frontier,CC BY 2.0)、ChatGPT 标志与世界可用地区地图(公有领域 / CC BY-SA 4.0)、AI 生成的图像(DALL·E 3,公有领域)、声音波形图(CC BY-SA 4.0)、人类反馈训练流程图(CC BY-SA 4.0)、AI 助手界面截图(Apache 2.0 / 公有领域)等,均为真实素材,仅作教学使用
点击卡片翻开,看看背后的知识~
训练数据 = 从 zeroai 的 tanshi.txt 抽出 500 个对句 → 3000 组「6 个字 → 第 7 个字」的小样本。字先变成字向量,经过自注意力和全连接,最后算出每个字是「下一个字」的概率。
先点「🎬 开始可视化训练」看它读诗学习(损失下降 + 注意力点亮);再用「👣 单步」一步步看它怎么预测下一个字。
从 3000 组训练样本里抽出最常见的 300 个字(更生僻的字归入 □)。数字 = 它在诗里出现的次数,出现越多的排越前。点一下某个字,它会自动填进下面的「写诗」输入框。
先点上方「🎬 开始可视化训练」让 GPT 读熟唐诗;再在框里输入几个字(或点「🎲 随机开头」),点「⏭️ 生成」,看它一个字一个字接着写!右边是它写这个字时「回头看」的注意力热力图(越红越关注)。
点选答案,答对会变绿、答错会变红(可重试)~
Q1. ChatGPT 是哪一年火遍全世界的?
Q2. ChatGPT 和以前的 AI 最大的不同是什么?
Q3. 想得到好答案,最重要的是什么?
Q4. ChatGPT 刚上线时,它的本领是什么?
Q5. 它是靠什么训练才学会「好好说话」的?
Q6. 在唐诗生成实验室里,GPT 最核心的秘密是什么?
Q7. 那个实验室的「字典」里,一共收了多少个字?
Q8. GPT 写后面的字时,会做什么?
💭 思考一下:同一个问题,问得「模糊」和问得「清楚」,得到的答案会一样吗?你遇到过这样的差别吗?
小小学员 完成了 本站《ChatGPT:人人都会用的 AI》
学会:AI 走进了千家万户