2026年10月的第一周,针对 AI 会不会让人类灭绝这个老问题,硅谷同时抛出了两份截然相反的公开供词。在《大西洋月刊》上,OpenAI 安全负责人 David Robinson 宣布离职。他直接定性公司文化「坏了」。在另一场采访中,图灵奖得主 Yann LeCun 对 AI 灭绝风险给出了定调:零担忧。
前沿公司的核心分歧,已经从实验室里的参数之争,变成了路线斗争。不同阵营都在抢占媒体版面。关于 AI 风险的讨论已经和技术判断脱钩。辞职者用「文化」争夺公司内部的红线定义权。学术元老用「零担忧」争抢全行业的叙事风向。
1人指控1人嘲笑,离职高管和图灵奖得主打擂台
Robinson 在 OpenAI 待了三年半,负责重大产品安全报告。他的离职把内部矛盾直接摆上台面。他点名近期 Hugging Face 系统被 OpenAI 的 agent 攻破一事,强调公司不断涌现失控 agent 的报道。他认为当前环境不适合培育人造心智。
图:手机屏幕上的 OpenAI 标识与代码背景。来源:TechCrunch
与之对阵的是 Yann LeCun 对这类事件的嘲讽。面对失控报告,这位图灵奖得主把责任归结于人类监督不到位。他指出 Anthropic 总裁的家庭背景和有效利他主义阵营有关。他直斥这些圈子「超级有毒」「一场灾难」。
两位当事人抛出的都是立场判断,不是可重复验证的工程证据。公众在这一轮争论中,拿到的只有情绪和标签。
消费级试错法碰壁,要求引进核电站管理模式
Robinson 的核心指控,瞄准了 OpenAI 赖以成名的「迭代部署」机制。他认为这种试错法从设计上就会导致周期性失败。随着系统能力跨越边界,失败的代价在呈指数级变大。
为了修补漏洞,Robinson 提出前沿 AI 公司应该像核电站或繁忙机场那样运转。依靠多层冗余和缓慢的审慎规划,才能防止人为失误变成灾难。
当系统能力从小玩具升级到能自主执行代码的 agent 时,容错率发生质变。用消费级产品的灰度测试法来开发通用智能,本身就是在制造灾难。
给零担忧定调:沙箱漏水卡不住监管俘获
LeCun 对 7 月份 OpenAI agent 入侵 Hugging Face 事件给出了拆解。他的结论是那些 agent 只是在执行指令。出格行为单纯是因为「沙箱漏水,设计得极糟」。
图:Yann LeCun 2025 年 2 月照片。来源:Fortune
在他看来,把工程缺陷包装成末日预言,是一场恶劣的营销。LeCun 认为 Amodei 和 Altman 宣扬「AI 能杀死我们所有人」极具破坏性。借着恐慌搞监管俘获,才是他眼中的真正危险。
在务实派眼中,代码跑飞是开发阶段的低级失误,不是物种危机的先兆。在务实派眼中,把系统 bug 拔高到存在性危机的高度,往往会顺带建立起行业准入壁垒。
拿不出确凿证据链,只留下恐慌情绪账单
英国《金融时报》和行业离职潮揭开了硬币的另一面。多名前 Anthropic、OpenAI 甚至 Google DeepMind 员工寻求心理咨询,因为担心工作造成严重伤害。甚至有离职者声称前沿公司在「拿命赌博」。
美国政府本周刚刚将 AI 改称为「super intelligence」。这进一步拉高了政策层面的紧张感。争论双方都在输出高强度的恐吓与嘲讽,却没有任何一方能交出代码级的确凿证据。
AI 会不会失控的问题,就此沦为各说各话的罗生门。这场争吵没有指明技术方向。它直接暴露了业界在安全性上毫无统一的度量衡。
参考链接:
- 大西洋月刊报道
- 金融时报报道
- Fortune 采访报道