还记得 2022 年底的那个夜晚吗?朋友圈和各个微信群突然被同一个东西刷屏了——一个叫 ChatGPT 的聊天框。有人晒它写的情书,有人晒它写的代码,最离谱的是,有人让它写年终总结,老板居然没看出来。那天深夜,我也点开了那个简陋的输入框,心跳莫名其妙地有点快——就像第一次点开微信摇一摇,或者第一次坐上无人驾驶出租车。输入框里光标一闪一闪的,我却在脑子里想了半天,最后敲下了一个特别没出息的问题:"你能帮我写一篇《我的家乡》吗?"三秒钟,一篇结构完整、辞藻还挺不错的作文流了出来。我盯着屏幕看了很久,脑子里只有一个念头:科幻片里演的那些事儿,好像真的要来了。
这不是夸张。从那晚开始,AI 的发展按下了快进键——快到连业内人士都直呼跟不上。今天这篇,就是「AI 发展史三部曲」的下篇,我们聊聊这四年里,大模型如何一路狂奔,把智能体和机器人的未来推到我们面前。
故事线:从一个聊天框到智能体的狂飙四年
ChatGPT:一夜爆火
2022 年 11 月 30 日,OpenAI 把 ChatGPT 扔上了互联网。五天,一百万用户——这个速度之前没有任何互联网产品做到过,连微信都望尘莫及。我记得那会儿大家玩得最疯的是"考"它:出数学题、让它写代码、让它假装成鲁迅写日记。它有时候一本正经地胡说八道(后来我们叫这叫"幻觉"),但大部分时候,它聪明得让人头皮发麻。上篇里我们聊过,AI 已经学会了"看图说话"和"下棋",而 ChatGPT 证明了一件事:语言,可能是通向通用智能最短的那条路。
GPT-4:多模态的降维打击
仅仅四个月后,GPT-4 来了。它不光更会聊天,还长出了"眼睛"——你拍一张冰箱的照片,它能给你列出一份菜谱;你随手画一张网站草图,它能直接生成网页代码。我第一次试的时候,上传了一张我家猫的照片,问它"这是什么品种",它不光答对了,还顺手提醒我"这只猫看起来有点胖,建议控制食量"——我当时就感觉,被 AI 居高临下地关心了一下,滋味很复杂。从 GPT-3.5 到 GPT-4 的那次飞跃,让所有人意识到:大模型的"涌现"不是玄学,参数和算力砸下去,智能真的会质变。
LLaMA"被泄露":开源点燃了另一团火
2023 年最有戏剧性的一幕发生了:Meta 的大模型 LLaMA 权重"意外"流出,在网上疯传。Meta 本来挺恼火的,但后来的发展让所有人大跌眼镜——全世界的极客和研究者拿着这份"泄露"的权重,魔改出了无数版本:能在手机上跑的、专门写代码的、中文优化的。开源社区的活力彻底被点燃了,Alpaca、Vicuna 这些名字一夜之间成了技术圈的热词。我当时最大的感触是:闭源巨头在前面狂奔,开源社区在后面紧追不舍,这种"猫鼠游戏"反而让整个行业跑得更快了。对普通人来说,这意味着好模型不再是少数公司的专利,选择权回到了我们手里。
Sora:视频生成的魔法时刻
2024 年初,OpenAI 又扔出一颗炸弹:Sora。输入一段文字,输出一段 60 秒的视频——"一位时尚女性走在东京街头,霓虹灯倒映在潮湿的路面上",生成的画面精美到让影视从业者集体失眠。我看演示视频的时候,第一反应是"这也太假了吧",第二反应是默默关掉了页面,因为细思极恐:以后我们看到的视频,还能信吗?Sora 证明了大模型不只会玩文字,它开始理解物理世界——光影、运动、物体的空间关系。这一步,为后面的具身智能埋下了伏笔。
Agent 与 MCP:AI 开始"动手"了
如果说之前的 AI 都是"动嘴"的,那 2024 年之后,AI 开始"动手"了。Agent(智能体)的概念火了起来:你不再是一个问题一个问题地问它,而是直接甩给它一个目标——"帮我订下周去杭州的机票和酒店,预算 3000 以内"——它自己去查、去比价、去下单,中间遇到问题还会自己调整策略。紧接着,Anthropic 推出的 MCP 协议(可以理解为 AI 的"USB 接口"),让各种工具和数据源能被 AI 统一调用。我第一次用 Agent 帮我整理报销发票的时候,看着它自己打开网页、下载文件、填表格,全程不用我动手,那种感觉就像雇了个 24 小时不睡觉的实习生,还不用发工资。
具身智能:AI 长出了手和脚
故事讲到今天,最激动人心的篇章正在展开:具身智能。简单说,就是给大模型装上身体——人形机器人。当语言大模型学会了理解世界,下一步自然是让它在物理世界里行动。2025 年以来,各家机器人公司的新品发布会一个比一个科幻:叠衣服的、做咖啡的、进工厂拧螺丝的。虽然离"每个家庭都有一个机器人管家"还有距离,但方向已经无比清晰。我有时候会想,上篇里那个在棋盘上赢了人类的 AlphaGo,和今天这个笨拙地学着叠衣服的机器人,其实是同一条路上的两个脚印——AI 正在从虚拟世界,一步步走进我们的客厅。
那些改变我生活的具体瞬间
聊了这么多大事,讲点我自己的真实体验吧,毕竟"半亩方糖"一直是个讲人话的博客。
变化最大的是写代码。以前调一个陌生的 API,我得翻半天文档;现在我把报错信息直接贴给 AI,它不光告诉我错在哪,还把改好的代码贴回来。上个月我给博客加那个"一键复制代码"功能,从构思到上线只花了一个晚上——放在两年前,我估计得折腾一个周末。当然,它也会犯蠢,有一次它信誓旦旦地给我推荐了一个根本不存在的函数,我查了半天文档才发现被它"忽悠"了。从那以后我养成了一个习惯:AI 给的答案,关键地方一定亲手验证一遍。

写文案也是一样。我现在写文章,经常先让 AI 帮我列个提纲、想几个标题备选,然后我自己往里面填血肉。它是个很好的"头脑风暴搭子",但永远替代不了我自己的观点和经历——比如这篇文章里那些深夜刷朋友圈的细节,AI 可编不出来(它编出来的都透着一股塑料味)。
关于"AI 会不会替代我"的焦虑,我的看法
这是这几年被问得最多的问题,我的朋友、同事,甚至我妈都问过。我的看法可能有点"反常识":AI 替代的从来不是"人",而是"重复性的任务"。
想想历史:计算器没有消灭数学家,Excel 没有消灭会计,真正被消灭的是"只会按计算器"和"只会填表格"的那部分工作。AI 时代也一样——会被替代的,是那些可以被清晰描述、重复执行的任务;而人的价值,会越来越集中在 AI 做不好的地方:真实的体验、独特的审美、面对面的信任、为结果负责的勇气。
我给自己的定位是"AI 的监工+合伙人":让它干 80% 的脏活累活,我负责那 20% 需要判断力和品味的部分。焦虑没有用,但行动有用——与其担心被替代,不如现在就开始练习"指挥"AI,这本身就是一种新的核心竞争力。

小结
四年,从一个小小的聊天框,到能写代码、画画、做视频的"多面手",再到开始动手干活的智能体,以及正在学走路的机器人——AI 的进化速度,超过了过去任何一次技术革命。上篇我们讲了 AI 如何学会"思考",中篇讲了深度学习如何点燃"大力出奇迹",而下篇的这四年,主题只有一个:智能正在从实验室走向每一个人的生活。
给普通人的建议,真诚版,不贩卖焦虑:不用追每一个热点,但每季度花一下午亲手试试新工具;不用学会所有技术,但要练出"判断 AI 靠不靠谱"的火眼金睛;不用担心被替代,但要主动把 AI 变成你的"外挂大脑"。技术浪潮里,淹死的都是站在原地不动的人,会游泳的,浪越大越好玩。
三部曲写到这里,就收官啦。从图灵测试的哲学思辨,到 AlphaGo 的封神之夜,再到 ChatGPT 那个改变一切的聊天框——我们用三篇文章,走完了 AI 七十多年的路。写这个系列的初衷很简单:AI 不该是新闻标题里吓人的名词,它应该是每个普通人都能聊、敢用、会用的老朋友。希望这三篇小文,能成为你理解 AI 时代的一张小地图。下一站,具身智能和通用人工智能,咱们现实里见——到时候,说不定真有个机器人帮你叠衣服呢。
Comments NOTHING