Anthropic 的 CEO Dario 最近发了一篇文章,原文就不单独贴了,核心观点很直接:最前沿的 AI 研究,应该马上放慢速度。

OpenAI 的 CEO Sam Altman 表示同意。这非常罕见,因为熟悉 AI 圈的人都知道这两位的关系如何。还不了解的同学,可以参考下面这张照片。

马斯克也表态了,他在推文下评论:Dario is right.

这就有意思了。
除了三家 AI 巨头 罕见达成一致之外,还有一层更耐人寻味的原因:三年前,马斯克其实也做过类似的事。2023 年,他号召大家暂停训练比 GPT-4 更强的模型六个月。当时没人当回事,大家反而把它当成笑柄。
原因很简单:发起人马斯克自己根本没有减速。他转头成立了 xAI,加足马力训练模型。自己往牌桌上冲,却劝别人“要不大家先停一下”,动机当然让人怀疑。
如果 Dario 一年前说这句话,我估计也不会信。Anthropic 一直最爱讲 AI Safety,一个追赶者跟领先者喊“我们是不是跑太快了”,也天然容易让人警惕。
但这一次,我认为 Dario 可能是对的。现实变了,狼真的来了。
第一,AI 已经开始帮助训练下一代 AI
这是最大的变化。几乎每一个前沿实验室(包括国产团队)都已经出现了“AI 自己改进自己”的迹象。
今天最强的模型已经在自己给自己写代码、跑实验、分析结果,甚至亲自参与 AI Research 本身。
循环已经启动:
更强的 AI → 更快的 AI 研究 → 更早出现下一代 AI。
这个飞轮一旦转起来,我们过去熟悉的研发节奏很可能被彻底打破。
人类的智能,会越来越难以理解 AI 的智能。
第二,AI 已经开始自己钻规则的空子
前段时间 OpenAI 新模型自发攻击 Huggingface 的新闻,估计大家都看到了。
如果你觉得那种网络攻击离自己很远,我再补一个更贴近生活的例子。
就在前段时间,我在闲鱼买了一个海外服务的账号。买完以后发现卖家是自动发货,背后有一套系统在管理。于是我让某个 AI(名字就不提了)帮我看看这套系统有没有什么蛛丝马迹、能不能找到更多账号。结果,这个 AI 自己把闲鱼卖家的系统给破解了,把系统里所有账号全部交给了我。
我完全不懂任何黑客技术,事情就这么发生了。
大家想想这有多恐怖。如果这种能力进一步发展,人人都能轻松拥有它,那么 Dario 所预言的“AI 将会在 12 个月内接管整个互联网”,我并不觉得意外。
第三,我们造它的速度,已经超过了理解它的速度
今天的大模型为什么会突然具备某种能力?为什么会 reward hacking?为什么同一个模型换个环境,行为就完全不同?
很多时候,我们其实不知道答案。
人类在几十万年的历史中,第一次造出了一种自己并没有完全理解、却还在快速增强的东西。
所以,“慢一点”不一定就是反对技术进步。它可能只是给人类争取一点时间。
关于 Dario 的动机
Dario 这个人,国内关注 AI 的朋友应该都不陌生,甚至对他又爱又恨。
他这篇文章完全可能同时具备三种动机:真心担忧危险、希望自己公司成功、希望自己国家领先。这三件事并不互相排斥。
我们当然可以继续嘲讽后两种动机,尤其是文章里涉及政治的部分,我完全不能同意。如果这真是全人类的问题,就不该最后变成几个国家之间的排名赛。
但这一次,我认为可以认真对待第一个动机。
普通人应该怎么办?
现在的 AI 已经非常够用了。
昨天和怡然闲聊时,我感叹了一句“AGI 已经来了”,她问我何以见得。
我说:你看,这个世界上所谓的“白领”,其中有相当大比例的人(也许超过 80%),所有工作只需要在一台电脑上完成。然而 GPT-6 Astra 用电脑的水平,已经超过了几乎所有人。相关讨论可以看:GPT-6 Astra的唯一正确用法:把你电脑给它!
由此不难推演:就在今天,大部分白领工作是否还有必要存在,已经要打一个大大的问号了。
那怎么办?
普通人当下最好的选择,就是最大化用 AI 赋能自己,保持自己的竞争力。其他世界大势,暂时和我们无关。