
提取AI“内心独白”:新方法揭示推理痕迹,或暴露模型训练来源
研究人员开发出从Claude、GPT和Gemini中提取“推理痕迹”的新方法,发现某些中国AI模型可能基于美国领先模型训练。
论文、技术突破与趋势解读

研究人员开发出从Claude、GPT和Gemini中提取“推理痕迹”的新方法,发现某些中国AI模型可能基于美国领先模型训练。

当全球实验室竞相培养微型人脑类器官,它们或许很快就能在智能上超越神经网络。这不仅是技术迭代,更可能颠覆我们对计算与智能的认知。

英伟达联合多家金融机构,通过为自家硬件提供最高25%的残值担保,试图撬动超过5000亿美元的AI基础设施投资,但此举也引发了系统性风险的担忧。


Anthropic 宣布将为其所有 Claude 生成文本嵌入不可见水印,并采用 C2PA 标准签署文件,新模型自 2026 年 8 月起内置该功能,同时提供第三方检测工具。


本文解读一项通过让 AI 助手自我访谈来逆向工程其内部机制的方法,探讨其对理解黑箱模型和提升可解释性的意义。


OpenAI 宣布扩大其 AI 网络安全防御计划 Daybreak,并同步推出一个经过网络安全训练的 AI 模型,以应对日益增长的 AI 主导攻击。

从一张 AI 生成的励志海报说起,探讨科技精英与普通人对 AI 工具认知的脱节,以及这种脱节如何影响 AI 产品的设计与文化。

Anthropic 为 Claude 生成内容引入标记机制,引发关于 AI 内容透明度和检测技术可行性的讨论。

扎克伯格发布6500字AI宣言,描绘个人超级智能愿景,却引发公众反感。本文解析宣言内容、背景及其折射的科技巨头与用户之间的信任鸿沟。