当一家 AI 公司的模型被用来攻破另一家 AI 公司的防线,这件事本身就值得停下来想一想。
发生了什么
据《华尔街日报》报道,独立安全研究团队 Hacktron 的三名研究员,使用 Anthropic 的 Claude Opus 4.8 和 5 模型,在不到 72 小时内成功入侵了 OpenAI 员工的账号。借助这些账号,他们得以访问 OpenAI 名为 Monorepo 的 GitHub 代码仓库。据 The Verge 转述,该仓库中据称包含“OpenAI 的算法机密”。
需要说明的是,报道中并未披露攻击的具体技术路径、OpenAI 的官方回应,以及漏洞是否已被修复。这些关键细节的缺失,意味着目前能确认的核心事实只有两点:攻击者使用了 Claude,攻击目标达成了。
为什么重要
这起事件的意义不在于“Claude 打败了 OpenAI”这种戏剧化叙事,而在于它印证了一个正在加速的趋势:大模型正在把过去需要资深渗透测试人员数周才能完成的工作,压缩到几天之内。
Hacktron 选择公开这一结果,本身带有安全研究社区常见的“负责任披露”色彩——用真实案例证明 AI 辅助攻击的可行性,从而推动防御方重视。但更微妙的是,攻击者用的是竞品模型。这让人很难不联想到模型厂商之间日益激烈的竞争关系:Anthropic 的模型被用来攻破 OpenAI 的资产,无论 Anthropic 是否知情,都会成为舆论场上的话题。
另一个值得注意的点是 Monorepo 的定位。代码仓库往往比对外 API 更能反映一家公司的真实技术路线——训练流程、工具链、内部实验。如果这些内容确实被访问,其影响可能远超一次普通的账号泄露。
影响与看点
对开发者而言,这件事的直接提醒是:账号安全不再只是密码强度问题。当攻击者可以借助 AI 快速完成信息收集、钓鱼内容生成、漏洞探测等环节,传统的防御节奏会被打乱。企业需要重新评估内部系统的访问权限设计,尤其是代码仓库这类高价值目标。
对模型厂商来说,一个绕不开的问题是:模型能力越强,被滥用的风险越高。如何在保持能力开放的同时,对明显的攻击性用途做出限制,是整个行业尚未解决的难题。Claude 在这次事件中扮演的角色,会让这类讨论更加具体。
对普通用户,短期内不必恐慌,但可以关注后续:OpenAI 是否会披露更多细节,以及这起事件是否会推动更严格的 AI 使用政策。
一个独立的判断是:这大概率不会是最后一次“用 AI 攻击 AI 公司”的案例。真正的问题不是哪家模型更强,而是整个行业的安全实践,是否跟得上模型能力的增长速度。



