当一线研究者开始用“抛硬币”形容人类灭绝的概率,这已经不只是科幻式的修辞,而是一场有组织的公开表达。
发生了什么
据 The Verge 报道,非营利机构 Palisade Research 发布了一系列访谈视频,受访者包括 OpenAI、谷歌和 Anthropic 的现任及前任员工,共十余位 AI 研究者。曾在 OpenAI 和 Google DeepMind 任职的 Geoffrey Irving 在访谈中表示,在他看来,人类灭绝的概率“大约相当于抛硬币”。这些视频的核心主张是:超级智能的危险程度“和它听起来一样严重”。Palisade Research 自称是一家研究 AI 的非营利组织,但报道摘要未披露其具体研究方法和资金来源。
为什么重要
这不是孤立的声音。过去几年,AI 安全议题经历了从边缘到主流的位移:从早期只有少数研究者警告“对齐问题”,到头部实验室纷纷设立安全团队、发布负责任扩展政策,再到部分安全研究者因理念分歧离开大厂。此次访谈的特殊之处在于,发声者多为曾身处模型研发核心的一线人员,而非外部批评者。他们的判断建立在参与前沿模型训练的直接经验之上,这使得“灭绝风险”的表述不再被轻易归入危言耸听。
与此同时,行业正处于能力竞赛与安全治理的拉扯之中。模型能力持续跃升,而监管框架、评估标准和国际协调机制仍显滞后。当内部人选择以视频这种面向公众的形式发声,某种程度上说明他们认为常规的内部渠道和学术讨论已不足以匹配风险的紧迫性。
影响与看点
对行业而言,这类公开表态会进一步加剧“加速派”与“安全派”的叙事竞争,也可能影响人才流向、投资偏好和公众舆论。对开发者和研究者来说,值得关注的不是某个具体概率数字——那本质上是主观判断——而是这些访谈是否伴随可验证的技术主张,比如具体的失败模式、评估方法或治理建议。对普通用户,这轮讨论的价值在于提醒:AI 治理不是遥远的地缘政治议题,而是正在被当下每一轮模型发布所塑造的现实。
一个独立的判断是:把灭绝概率量化成“抛硬币”有助于传播,却也可能透支严肃讨论的可信度。真正推动安全进展的,往往不是耸动的概率,而是可复现的风险证据和可落地的工程约束。Palisade Research 这批视频能否超越“表态”,取决于后续是否拿出具体研究。


