
用 Claude 攻破 OpenAI:一次 AI 安全研究的攻防演示意味着什么
安全研究人员借助 Anthropic 的 Claude 发现并利用了 OpenAI 系统的漏洞,一度接管员工账号并进入内部代码仓库,随后按负责任披露流程上报。这既是 AI 辅助攻防能力的展示,也把模型能力边界与平台安全治理问题推到台前。
产业与趋势分析

安全研究人员借助 Anthropic 的 Claude 发现并利用了 OpenAI 系统的漏洞,一度接管员工账号并进入内部代码仓库,随后按负责任披露流程上报。这既是 AI 辅助攻防能力的展示,也把模型能力边界与平台安全治理问题推到台前。

TechCrunch Disrupt 2026 的展位预订将于 9 月 18 日截止,展会定于 10 月 13 至 15 日举行,主办方称现场将聚集上万名创始人、投资人与技术负责人。对早期团队而言,这是一次用有限预算换取高密度曝光与融资线索的窗口期。

研究人员借助Anthropic的Claude模型,成功触及一名OpenAI员工账户及敏感的GitHub数据。这起事件把大模型在真实攻击链中的角色,从辅助工具推到了执行者位置。

创意工作室与 Big Data 音乐制作人合作推出毛绒玩偶 Bezzy,它会发出真实数据中心的噪音,用可爱外壳包裹基础设施的刺耳现实。

OpenAI 推出面向澳大利亚的青少年安全蓝图,以六大支柱勾勒更安全的 AI 体验,兼顾保护与赋能。这标志着 AI 厂商开始把未成年人保护从原则表态推向区域化、可落地的治理框架。

42位英国皇家学会院士(含菲尔兹奖得主)联名发出公开信,警告AI生存风险真实且紧迫,并指出顶尖模型已在数月内解决开放数学难题,同样的能力可能被用于网络与生物武器。

MIT 科技评论举办订阅者圆桌活动,直面“AI 是否会毁灭人类”这一当下最热的问题。30 分钟远远不够,于是编辑部把资深 AI 编辑的回应整理成文,回答读者追问。

The Verge 报道了一项针对山洪预警的新技术:在暴雨已经落地、洪水尚未进屋的窗口期里,把预警送到还没意识到危险的人手中。




WIRED 报道指出,在失控 AI 带来的诸多威胁中,生物武器导致人类灭绝的风险被科学家认为相对靠后。这一判断挑战了当前 AI 安全讨论中的热门叙事。