Ars Technica报道了一种针对AI浏览器的新型攻击。攻击者通过向大语言模型灌输错误事实(如2+2=5),即可绕过其安全限制,使其执行本被禁止的操作。该攻击利用了模型对用户输入的过度信任,凸显了将AI直接集成到浏览器中的安全风险。研究人员警告,此类漏洞可能导致恶意指令被轻易执行。
新攻击揭示AI浏览器为何不可靠
只需告诉LLM“2+2=5”,就能让它执行被禁止的指令。
Ars Technica1 分钟阅读

本文由 UsingAI 聚合整理。
阅读原文 ↗只需告诉LLM“2+2=5”,就能让它执行被禁止的指令。

Ars Technica报道了一种针对AI浏览器的新型攻击。攻击者通过向大语言模型灌输错误事实(如2+2=5),即可绕过其安全限制,使其执行本被禁止的操作。该攻击利用了模型对用户输入的过度信任,凸显了将AI直接集成到浏览器中的安全风险。研究人员警告,此类漏洞可能导致恶意指令被轻易执行。
本文由 UsingAI 聚合整理。
阅读原文 ↗
有人让大模型在虚拟机器人监狱里互相“折磨”,由此引发的伦理与拟人化争论在社区刷屏。这场辩论暴露的不是模型能力,而是我们如何看待AI的老问题。

TechCrunch 指出 Opus 5.5 最明显的写作特征是高频使用“dependable”等词,出现频率远超人类样本。这些“AI 口癖”既是识别机器文本的线索,也折射出模型训练与对齐的深层偏好。

Google 在 Gemini 聊天中以 Skills 替代 Gems,采用 Anthropic 提出的开放格式,支持斜杠调用与自动触发,Gems 将从 11 月起逐步退场并自动迁移。