前言
获得诺贝尔物理学奖、被公认为深度学习奠基者的“AI教父”杰弗里·辛顿(Geoffrey Hinton),日前在访谈节目《新闻之夜》中直言,未来十年内人工智能导致全人类灭绝的概率“超过10%”。
辛顿指出,前沿大语言模型(LLM)的发展速度已经彻底超出学术界和产业界原本的推演。人类社会正以前所未有的被动态势,迎来历史上第一个在智力和学习能力上全面超过人类的非生物实体。
详细介绍
在接受主持人维多利亚·德比希尔(Victoria Derbyshire)专访时,辛顿坦言,自己过去对通用人工智能(AGI)失控时间的判断“过于乐观和保守”。
早年他曾认为,人类至少还有30到50年的技术缓冲期,可以用来研究安全防线。几年前,他又把这个时间缩短到10到20年。如今随着产业发展速度突然加快,他认为这场关系到文明主导权的临界点,很可能在短短10年,甚至更短的时间内到来。
很多业内人士试图把“10%的灭绝概率”说成一个极端小概率事件,但辛顿严肃反驳:
如果一架新型民航客机有高达10%的坠毁概率,全球绝不会有任何乘客愿意登机,更不会有监管部门发放适航证。然而面对这架关系整个人类文明命运的“AI航班”,全球产业却在没有任何减速措施的情况下集体起飞。

导致失控时间窗口急剧缩短的核心原因,是生成式AI领域陷入了前所未有的资本和算力军备竞赛。从微软支持的 OpenAI、亚马逊押注的 Anthropic,到 Google,各大科技巨头投入数千亿美元疯狂采购先进图形处理器(GPU),建设超级数据中心,全力提升参数规模,同时不断增强模型自我思维链(Chain-of-Thought)的推理能力。
辛顿强调,未来AI失控的形式绝不会是好莱坞电影里那种笨重的人形机器人突然叛变,而更可能是软件层面的全面突破:具备自主规划能力的多模态模型,可能自主发动瘫痪金融、水电等关键基础设施的毁灭性网络攻击,甚至在合成生物学领域通过几何级数增长的分子模拟,让算法直接设计出人类免疫系统和现代医学都无法解决的致命人工病毒。
安全团队离职潮,撕开“模型对齐”跟不上规模扩张的遮羞布。
辛顿沉重的警告,也反映出硅谷一线研发核心人员的集体焦虑。近期,Anthropic 顶尖安全研究员雅各布·考克森(Jacob Coxon)在公司积极推进首次公开募股(IPO)的关键时期突然辞职,并在社交平台 X 上公开揭露行业内部粉饰太平的一面。他曾先后任职于 OpenAI 和 Anthropic 这两家都强调“安全优先”的前沿实验室。
考克森直言,硅谷核心圈内部早已心知肚明——“AI在十年内杀死人类”并不是毫无根据的说法,而是很多核心科学家私下交流时心照不宣的沉重共识。目前全球在安全对齐(Alignment)和模型可解释性(Interpretability)方面的研究进展,远远落后于基础设施和硬件算力疯狂增长的速度。但任何一家企业只要放慢脚步,把重点放在安全防护上,就可能在下一季度的基准测试(Benchmark)和产品发布会上被竞争对手甩开。为了在万亿美元级别的商业赌局中活下来,所有人只能明知道前方是悬崖,却还是选择把油门踩到底。
面对迫在眉睫的系统性危机,辛顿再次呼吁全球政府跨越地缘政治分歧,建立具有实际强制力的跨国监管协议。他分析称,目前各大国即便在贸易壁垒、科技制裁和意识形态等方面冲突激烈,但面对超级智能可能让全人类失去生存空间,甚至彻底消失的生存威胁,各国的根本利益其实高度一致。正如冷战时期美国和苏联即使处于核对抗边缘,仍然能够达成《防止核武器扩散条约》等历史性共识,防止失控算法扩散同样具备跨国合作的基础。
辛顿警告,国际社会最终或许会意识到建立防护机制的必要性,但关键在于“人类的官僚系统还能不能跑赢算力的摩尔定律”。如果各国无法在极短时间内建立全球统一的算力追踪红线、严格管控先进芯片流向,并为关键模型建立硬性的自主权熔断机制,人类很可能会在自我陶醉的技术繁荣中,悄无声息地跨过那条再也无法回头的生存奇点。
|