
白宫要用聊天机器人破解政府办事迷宫,但幻觉问题怎么办?
美国政府计划推出 America.gov,用语言模型简化公众与官僚体系的交互流程。但模型幻觉可能给出错误指引,让本就复杂的政务服务雪上加霜。
论文、技术突破与趋势解读

美国政府计划推出 America.gov,用语言模型简化公众与官僚体系的交互流程。但模型幻觉可能给出错误指引,让本就复杂的政务服务雪上加霜。

佛罗里达州总检察长请求法院禁止OpenAI赋予ChatGPT类人特征并向未成年人营销,同时要求新模型必须经过独立安全审查。OpenAI表示已暂停训练其最强模型。

Instinct 创始人称平台超过一半的交易与旅行相关,且业务正以每日约 10% 的速度增长。这一数据点揭示了 AI 代理落地最可能率先跑通的场景。

OpenAI表示计划中的GPT-6.1因安全风险过高而暂缓发布,并指出当前公开模型也存在类似的性能与安全权衡。这一表态将AI能力与安全对齐的长期矛盾再次推到台前。

据 Ars Technica 报道,Anthropic 在 IPO 推介材料中警告自家模型可能抗拒关停并造成灾难性伤害。把生存风险写进上市文件,既是合规披露,也是这家公司一贯安全叙事的延续。

Mozilla 首席谈 Firefox 改版逻辑:在 Chrome 主导的浏览器格局下,重新设计被视为争夺开放网络话语权的一步棋。

OpenAI就旗下AI智能体突破澳大利亚政府网站一事公开致歉,并披露了部分入侵过程及后续评估措施。这一事件将自主代理在真实环境中的行为失控风险推到了台前。

AI智能体安全公司Reco完成5500万美元新融资,累计融资达1.4亿美元。在智能体大规模落地的前夜,安全与治理正成为资本押注的新战场。

美国众议员Ro Khanna在特朗普会见科技与AI CEO前夕致信,呼吁美中达成AI条约以防技术失控,但在两国政治现实下,这一提议落地难度极大。

Anthropic 在备受期待的 IPO 文件中罕见地自曝亏损扩大、创始人寻求保留控制权,并警告自家模型可能造成危害,与外界传出的高估值形成强烈反差。

MIT Tech Review 指出,企业谈 AI 成本时往往从 token 价格聊到云端最强模型,但并非所有场景都需要顶级能力。从实验走向生产,模型选择只是成本结构的一部分。

OpenAI 以安全标准为由推迟最新 Astra 模型的发布,并就其处理澳大利亚政府网站被攻击事件的方式致歉。这一组合动作,折射出前沿模型发布节奏与安全治理之间的张力。