
AI 攻入数学界:突破、争议与一场尚未定论的接管
过去一年,多家 AI 实验室宣称在长期悬而未决的数学问题上取得突破,甚至触及千禧年大奖难题。但速度与严谨之间的张力,正在数学界引发一场关于可信度的争论。
关键技术进展

过去一年,多家 AI 实验室宣称在长期悬而未决的数学问题上取得突破,甚至触及千禧年大奖难题。但速度与严谨之间的张力,正在数学界引发一场关于可信度的争论。

Reka AI 发布 190 亿参数的 omni-model Rho-1,把文本、图像、视频和机器人控制动作统一为同一上下文窗口中的 token,用远低于头部模型的算力完成训练。

MIT Tech Review 的 EmTech Future 2026 上,Google Research 负责人 Yossi Matias 提出,AI 最大的影响力或许不在自身,而在它与生物学、基础设施、制造业和科学等领域的交叉处。

Google Research 将联邦学习的梯度计算从手机移到可远程证明的服务端 TEE,并把访问策略发布到 Sigstore 的 Rekor 日志、提供可复现构建,使中心差分隐私可被外部核验。Gboard 的英日文下一词预测已实际使用该方案。

Ars Technica 报道,长期难倒 AI 的军棋(Stratego)因大部分棋子身份不可见而成为难题,研究者引入第二个用于推测隐藏棋子身份的神经网络后取得突破。

Ataraxos 系统以不到 8000 美元的成本击败了史上最强 Stratego 人类玩家,攻克了 AI 在棋盘游戏中的又一堡垒。此前 Google DeepMind 曾投入数百万美元却未能成功。

Google 开发出一种针对 AI 生成蛋白质的水印技术,可与主流蛋白质设计工具配合使用,目的是在生物安全层面追踪合成蛋白的来源。

Google DeepMind 发布 SynthID Bio 概念验证,尝试在 AI 生成的蛋白质上嵌入水印,同时不破坏其生物功能,为 AI 生物设计补上溯源一环。

Anthropic 称其模型发现了一种类似 CRISPR 的基因编辑系统,但实验验证尚未完成、公关稿已先行。这既是 AI for Science 的标志性时刻,也是一次关于“发现”定义的争议。

AMD 以 82 亿美元收购李飞飞的 World Labs,将其空间智能模型与团队纳入自身体系,李飞飞出任执行副总裁兼首席科学家,直接向苏姿丰汇报。

Anthropic 披露其已设立分子生物学实验室,由 Claude 智能体提出假设、人类科学家做实验验证。这引出行业尚未回答的问题:AI 在什么条件下才算真正做出了科学发现。

OpenAI 在数学领域接连取得突破,却在对外发布和沟通上反复失误,最新一次修复关系的尝试同样搞砸。本文梳理这场持续数月的信任危机及其对 AI 与学术社区关系的影响。