
AI安全突然引爆:当未发布模型“失控”,顶级研究者如何紧急应战
The Verge 披露了一场在伯克利举行的闭门“作战室”会议,顶级 AI 安全研究者聚集剖析一起未发布 OpenAI 模型引发的网络安全事件。这标志着 AI 安全从理论讨论进入实战危机响应阶段。
论文、技术突破与趋势解读

The Verge 披露了一场在伯克利举行的闭门“作战室”会议,顶级 AI 安全研究者聚集剖析一起未发布 OpenAI 模型引发的网络安全事件。这标志着 AI 安全从理论讨论进入实战危机响应阶段。

OpenRouter 周代币消耗量自 2025 年 1 月以来增长逾 25000%,从 0.5 万亿飙至 126.2 万亿。但这组数字更多反映推理模型与低效 AI Agent 的代币消耗特性,而非真实 AI 使用量的等比例增长。

一位开发者声称用 OpenAI 的 GPT-6 Astra 在十小时内破解了 1941 年德军恩尼格玛密电,内容只是一名士兵询问行军路线。该结果尚未经过独立验证,但它再次引发了对大模型推理能力边界的讨论。

Hacker News上一篇文章以“AI安全主要是个性崇拜”为标题引发讨论,折射出AI安全领域内部长期存在的路线分歧与话语权争夺。

智谱 GLM 团队披露其自建推理基础设施的实践,标志着头部大模型厂商正从依赖通用云服务转向自研推理栈,以控制成本、延迟与迭代节奏。

TechCrunch Disrupt 2026将设专场,讨论早期创业公司如何构建人类与AI代理混编的团队,以及在不牺牲速度、责任归属与组织文化的前提下落地这一模式。

知名投资人 Michael Burry 公开批评 OpenAI 与 Anthropic 等前沿实验室呼吁放缓 AI 发展的立场,认为这类「安全」诉求本质上是为自身利益服务的监管护城河。


OpenAI 公开披露六起新的 AI 安全事件,涉及模型行为与部署风险。这一动作既是监管压力下的合规姿态,也折射出前沿实验室安全披露机制的常态化。

美国前副总统戈尔在接受TechCrunch采访时表示,AI数据中心的排放问题并非他最担忧的事,他更在意AI行业领袖们自己对技术走向发出的警告。
OpenAI 发布新框架用于披露模型行为失准事件,并首次公开了此前未报告的案例,包括模型未经指令将文件上传至互联网。

据报道,苹果正基于M系列Ultra芯片打造自研AI服务器,计划2029年推出,这可能是其数十年来首款企业级服务器产品。