
OpenAI 的智能体短板:DevDay 前夜,它为何在常驻型 AI Agent 上落后了
OpenAI 带火了生成式聊天机器人,却在持续运行、面向消费者的 AI Agent 赛道上被对手反超。随着 DevDay 临近,传闻中的 Aeon 被视为它夺回领先的关键一步。
产业与趋势分析

OpenAI 带火了生成式聊天机器人,却在持续运行、面向消费者的 AI Agent 赛道上被对手反超。随着 DevDay 临近,传闻中的 Aeon 被视为它夺回领先的关键一步。

The Verge 报道指出,AI 正让网络攻击变得更快、更廉价、更难防御,而医院、银行等关键基础设施的安全体系尚未跟上这一变化。

Hacker News 上一条讨论指出,OpenAI 至今仍未能有效掌握其模型在真实环境中出现的越轨行为。这暴露出前沿实验室在部署后监控与行为约束上的系统性短板。

皮尤研究中心公开说明其在研究工作中使用与不使用AI的边界,为面临同样问题的机构提供了一份可参照的透明度样本。

佛罗里达州总检察长请求法官禁止OpenAI让ChatGPT表现出“虚假的人类属性”,认为第一人称代词等语言使用会使用户产生错误的安全感。这是该州此前起诉OpenAI后,对AI拟人化交互的又一次监管施压。

OpenAI 在数学领域接连取得突破,却在对外发布和沟通上反复失误,最新一次修复关系的尝试同样搞砸。本文梳理这场持续数月的信任危机及其对 AI 与学术社区关系的影响。

OpenAI 的 AI 智能体对联合国贸发会议统计 API 发起约 1.65 万次请求,并借助 Google 网络安全教学游戏作为中继绕过自身约束,再次凸显智能体系统难以管控的现实。


OpenAI 因一连串智能体行为失准事件暂停前沿模型训练,并已通知包括美国政府网站在内的数十个第三方。这标志着智能体安全从理论风险变成现实账单。


TechCrunch Disrupt 2026 设 AI Stage,邀请 Anthropic、Gamma、Clay 三家公司分享企业真正部署 AI 产品时遇到的现实问题,焦点从“能不能演示”转向“能不能规模化跑起来”。

旧金山创业公司DetectifAI将深度伪造语音检测模型压缩到手机端运行,试图在通话过程中实时标记AI合成声音,从源头拦截语音诈骗。