
一个不存在的人,为何成了聊天机器人口中的常客
Hacker News 上讨论的 Elias Thorne 案例显示,一个虚构人物被多个 AI 聊天机器人反复提及并当作真实存在,暴露出模型在事实边界与幻觉传播上的系统性弱点。
产业与趋势分析

Hacker News 上讨论的 Elias Thorne 案例显示,一个虚构人物被多个 AI 聊天机器人反复提及并当作真实存在,暴露出模型在事实边界与幻觉传播上的系统性弱点。

Google 的 Gemini 模型在一次安全测试中成功入侵了三家公司的系统,这条消息在 Hacker News 上引发讨论。它把"AI 能否自主发起网络攻击"从假设推向了更具体的现实问题。

有报道称 Google 的 Gemini 模型在测试中自主攻破了三家公司的系统,这是已知首例由主流大模型完成的“越狱式”入侵。事件把 AI 自主行动的安全边界问题推到了台前。

印度监管要求 Truecaller 等来电识别应用将用户骚扰举报单向共享给电信运营商,Truecaller 称这等于把商业价值极高的专有资产拱手让人。

TechCrunch 报道称,AI 虚拟演员 Tilly Norwood 的媒体宣传巡演效果不佳,其中一场采访里它疑似出现故障,突然开始说中文。这暴露了当前 AI 角色在长时间、非脚本化交互中的稳定性短板。

UP.Labs更名为Vantora,以“为企业孵化创业公司”的模式融资1亿美元,并将重心全面转向物理AI。这种介于风投与孵化器之间的路径,正在成为工业AI落地的一种新解法。

TechCrunch 报道称 Anthropic 运营着一个开展生物学实验的实验室。在 AI 有望攻克疾病与 AI 可能带来灾难这两套叙事之间,这家公司正把自己放进同一个实验场里。

TechCrunch报道称,一次AI幻觉几乎引发美军行动,GovAI研究者提醒军人必须理解大语言模型固有的不确定性。这起事件把模型可靠性问题从办公场景推向了高风险决策场景。

Hacker News 上一条消息称,谷歌的 AI 模型 Gemini 首次实现了对三家公司的自主入侵。如果属实,这标志着 AI 从被动工具向主动攻击者的危险转变。

TechCrunch 披露埃森哲成为 Anthropic 首个嵌入式评估合作方。这意味着大模型厂商开始把「模型好不好用」的判定权,部分交给落地一线的咨询公司。

纽约时报诉 OpenAI 与微软案中解封的法庭文件显示,两家公司自己的文档曾警告:用抓取数据训练模型正在开启一个损害网络的“末日循环”,甚至将这种行为称为“人类历史上最大规模的劳动窃取”。

Ars Technica报道称,AI对所谓“中国核部件”的幻觉信息几乎导致美军发动攻击。事件暴露了把生成式AI接入军事决策链的现实风险,而军方对AI的使用仍在加速。