OpenAI 选择不撤回解雇决定,这让一场围绕 AI 安全团队与公司管理层关系的争议继续发酵。

发生了什么

据 The Verge 报道,OpenAI 在调查后认定三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 存在“重大信任破裂”(a significant breach of trust),并据此将其解雇。公司在社交平台 X 上发文称,解雇原因是三人违反了关于处理敏感信息的“明确政策”。OpenAI 强调这一决定是经过调查后作出的,并坚持原判。

目前公开信息有限:公司没有披露具体泄露了什么、涉及哪些项目,也没有说明调查由谁执行、三人是否有申辩机会。三名当事人也尚未通过报道给出完整回应。因此,外界能确认的只是“公司认定违规、当事人被解雇、决定不撤回”这一事实链条。

为什么重要

这起人事事件之所以被放大,是因为它发生在 AI 安全这个高度敏感的领域。过去两年,OpenAI 的安全与对齐团队经历了多轮人事变动,外界对其是否在商业化压力下压缩安全投入一直存疑。每一次安全人员的离开,都会被解读为“安全让位于速度”的信号。

而这次的关键词是“敏感信息”和“信任”。它把问题从“理念分歧”转向了“合规与保密”:公司用内部政策作为解雇依据,而非公开的安全路线之争。这种处理方式在治理上更站得住脚,但也更难被外部验证——因为调查过程不透明,外界无法判断这是严肃的合规处置,还是对内部异见的强硬回应。

对一家正在推进前沿模型、同时面对多国监管审视的公司来说,这类事件会直接影响其“负责任 AI”叙事的可信度。

影响与看点

对行业而言,最直接的影响是示范效应:当安全研究员与公司管理层出现张力时,企业更倾向于用保密协议和内部政策来界定边界,而非公开辩论。这会让 AI 安全从业者在发声时更加谨慎,也可能影响顶尖研究者加入前沿实验室的意愿。

对开发者和用户来说,短期没有产品层面的变化,但值得关注的是 OpenAI 后续是否会补充安全团队的招聘与治理披露。如果安全团队持续流失而公司不给出解释,外界对其模型风险控制的信心会被慢慢侵蚀。

接下来有几个观察点:三人是否会公开回应或采取法律行动;OpenAI 是否披露更多调查细节;以及这一事件会不会成为监管机构质询其内部治理的又一个案例。

我的判断是:在缺乏透明度的情况下,OpenAI 用“信任破裂”来收尾,能止住法律和公关上的短期风险,但很难平息外界对安全团队处境的长期疑虑。