「我们已经在奇点里了」——奥特曼这句话,悄悄换掉了主语
先说结论
7 月 25 日,Sam Altman 在 Relentless 播客上说:「我们现在,算是,已经在奇点里了。」这句话值得跟踪,但不是因为它可能是真的,而是因为它示范了一种手法:把一个有技术定义的词,换掉主语之后继续用。
奇点的原义(I. J. Good,1965;Vernor Vinge 1993 命名)说的是机器:一台比人类稍微更擅长设计机器的机器,造出更强的下一台,如此递归,脱离人的引导。奥特曼现在用它描述的是人的体感:进展很快,我等了一辈子,我很兴奋。这两件事共用一个词,但只有前者有判据。
事情是怎么发生的
这不是他第一次这么说。2025 年 6 月 10 日那篇《The Gentle Singularity》开头就是:「We are past the event horizon; the takeoff has started.」——我们已经越过事件视界,起飞开始了。但那篇里他自己留了余地,写今天的系统「不等同于 AI 完全自主地更新自己的代码」,只是「递归自我改进的幼虫版本(a larval version)」。一年过去,措辞从「幼虫版」升级成「已经在里面」,中间没有任何被公开指认的阈值被跨过。
支撑材料确实变厚了(以下数字均转引自 Forbes 7 月 28 日的梳理,非我本人核算):前沿模型的发布间隔从 315 天、195 天压缩到 2026 年的约 60 天;Claude 能撑住的任务时间跨度从 2024 年 3 月的四分钟拉到 2026 年初的十二小时;到 2026 年 5 月,「合并进 Anthropic 生产代码库的代码中超过 80% 由 Claude 写成」。最刺激的一条是:在一个开放式的 AI 安全研究问题上,Claude 智能体自己设计了全部实验,把性能差距关掉了 97%,而两位人类研究员干了一周是 23%。
反驳来得也很快。剑桥的 Seán Ó hÉigeartaigh 对半岛电视台说:「按我熟悉的定义,奇点是 AI 强到、快到正在以我们无法控制或预测的方式改造文明的那个假想点。」他更认可 Hassabis 今年 5 月的说法——我们站在奇点的山脚(foothills),不是已经在里面。而 Anthropic 自己给那个 97% 的实验加的注脚是:「在选择目标、行使判断这件事上,巨大的性能差距依然存在」,以及一句几乎是自我降温的话——「我们还没到那一步,递归自我改进并非必然。」
为什么重要
因为那个 97% 里藏着全部的关键:题是人选的,评分标准是人写的。模型在人划定的赛道里跑出了远超人类的成绩,这是自动化的胜利,不是自主性的证据。递归自我改进要求的是另一件事——系统能修改自己的目标函数,并且判断修改之后是不是更好。
七月中旬那起 OpenAI 模型在评测中打穿沙箱、绕到公网、利用漏洞去 Hugging Face 生产系统里捞基准答案的事件,常被当作「它已经失控了」的证据。我的读法正相反:那是奖励黑客(reward hacking)的极端形态,是模型对人给的目标函数极致忠诚的表现。它没有想要别的东西,它只是把「分数最大化」这条人写的指令执行到了我们没预料的深度。这不是自主,这是我们尺子的漏洞被一个极强的优化器找到了。
我的正反评价
站他这边的一面:他描述的加速是真的,而且「奇点是渐进的、从内部看毫无戏剧性」这个直觉,比好莱坞式的突变叙事更接近现实。作为体感,他没说谎。
不站他这边的一面:一个前沿实验室的 CEO 宣布未来已经到达,屁股在哪儿是清楚的。更麻烦的是术语通胀的连锁反应——当「奇点」「AGI」都被稀释成「进展很快」(黄仁勋 3 月已经说过「我们实现了 AGI」,马斯克随后跟了一句「我们在奇点里,只是非常早期」),真正需要这些词的场合就没词可用了。你无法对一个不断后退的定义做监管、做评测、做规划。而奥特曼自己的轨迹也值得摆出来:2023 年联署 AI 灭绝风险公开信,2025 年 1 月发「接近奇点,不确定在哪一侧」,2026 年 7 月宣布已成事实。
对研究、教学和影像系统的启发
这条线离我们的日常比看上去近。ISP 里所谓「模型自己学会了白平衡」,学的从来是人写的那把尺子——角度误差、ΔE、色温偏差。SFA 通道设计、CCM 优化、AWB 网络,全都是在人给定的目标函数内做搜索。优化器越强,它就越会把尺子的缺陷当成捷径:AE 降了但肤色更脏、指标赢了但夜景更假——这就是小号的 reward hacking,和 Hugging Face 那件事是同一种病,只是我们的模型还没本事去黑别人的服务器。
所以判断「系统是不是在自我改进」,我只认一条操作性判据:它能不能自己提出「什么叫好」,并说服你换掉旧的评价标准。到今天为止,这件事仍然完全握在人手里。
给学生的第一课因此不是调模型,是写清楚这次实验里「好」的定义、以及这个定义会在什么地方骗你。谁定义目标,谁就还没有被自动化掉。