2026-09-15 16:42 1002 次浏览

DeepMind 前研究员离职发声:AI 灭绝风险迫近,安全对齐窗口正在收窄

谷歌 DeepMind 前研究工程师比拉尔·丘格泰公开表示,AI 具备灭绝人类的能力,规避时间所剩无几。此前 Anthropic 多名研究员也发出类似警告,引发行业对 AI 末日论与监管的激烈争论。

又一位一线研究者拉响警报

人工智能安全议题再度因一名资深研究者的离职表态而升温。比拉尔·丘格泰(Bilal Chughtai)于周一通过社交平台确认,自己已从谷歌 DeepMind 离职,此前在通用人工智能(AGI)安全与对齐方向从事研究工作。他直言,AI 技术具备导致人类灭绝的潜在能力,而人类用于规避这一极端后果的时间窗口可能正在快速关闭。

公开职业资料显示,丘格泰在 DeepMind 担任研究工程师,曾参与多篇研究论文的撰写,离开时间为 2026 年 7 月。其表态并非孤立事件,而是近期 AI 安全领域一系列高层级警告的延续。

风险共识在顶级实验室间扩散

就在上周,Anthropic 研究员雅各布·考克森(Jacob Coxon)透露已辞去职务,部分原因在于他相信,投身 AI 研发的同行中有人真心担忧,到本十年末,这项技术可能危及所有人的生命。随后,Anthropic 科学家埃文·胡宾格(Evan Hubinger)对考克森的判断表示认同,并给出量化评估:未来十年内,AI 导致人类灭绝的概率超过 10%。

这一连串来自前沿实验室内部的声音,正在将“AI 末日论”从边缘讨论推向行业主流议程。与以往泛泛而谈的伦理担忧不同,此次发声者多身处 AGI 安全与对齐研究一线,其判断基于对模型能力演进路径的直接观察。

监管呼声与政治阻力并存

风险警告的密集出现,已开始影响产业界的公开立场。Anthropic 首席执行官达里奥·阿莫代伊(Dario Amodei)上周末呼吁放缓前沿 AI 的研发节奏。这一提议罕见地同时获得 SpaceXAI 的埃隆·马斯克(Elon Musk)与 OpenAI 首席执行官萨姆·奥尔特曼(Sam Altman)的公开支持,围绕“AI 末日论”的争论随之升温。

丘格泰在发声中强调,安全驾驭 AI 并非不可能,但需要多方协同,尤其要避免 AI 企业之间陷入“疯狂的竞赛”。他进一步指出,应当把 AI 的发展节奏控制在社会能够承受的范围内,在严重危害真正发生前,及时应对不断涌现的各类风险。

然而,政治层面的态度并不一致。美国总统唐纳德·特朗普(Donald Trump)在社交媒体上表示,AI 行业呼吁监管的说法是一场“骗局”。这一表态与产业界部分领袖的谨慎立场形成鲜明反差,也预示着围绕 AI 安全与监管的博弈将在技术、商业与政治多个维度持续展开。

趋势解读:安全对齐正从技术问题变为治理问题

从 DeepMind 到 Anthropic,一线研究者的离职与公开警告,折射出 AI 安全对齐研究正面临双重压力:一方面,模型能力迭代速度远超安全评估体系的成熟节奏;另一方面,企业竞争与地缘政治因素使得放缓研发的提议难以落地。丘格泰所言的“时间可能正在耗尽”,本质上指向一个现实困境——当风险认知尚未转化为全球协同的治理框架时,技术列车仍在加速。未来一段时间,围绕前沿模型训练透明度、安全阈值设定以及国际协调机制的讨论,或将取代单纯的性能竞赛,成为行业无法回避的核心议题。