OpenAI 的 GPT-5.6 Sol Ultra 在不到一小时内给出了 Cycle Double Cover 猜想的证明,该猜想已悬而未决50年。这一事件不仅展示了 AI 在数学推理上的惊人能力,也引发了关于 AI 创新本质的深刻讨论。
发生了什么
根据 The Decoder 报道,OpenAI 的 GPT-5.6 Sol Ultra 模型通过并行运行64个子代理,在不到一小时内完成了对 Cycle Double Cover 猜想的证明。该猜想是图论中的一个经典问题,自1970年代提出以来,一直未被完全证明。数学家 Thomas Bloom 在审阅后表示,该证明“出人意料地初等”,但批评其缺乏对已知前人工作的引用。
为什么重要
Cycle Double Cover 猜想是图论中关于每个无桥图都可以被一组圈覆盖两次的猜想。其证明难度极高,此前仅有部分进展。GPT-5.6 Sol Ultra 的成功证明,标志着 AI 在数学研究领域迈出了重要一步。传统上,数学证明依赖人类直觉和创造力,而 AI 通过大规模搜索和模式匹配,能够发现人类未曾想到的路径。然而,Bloom 的批评也点出了关键问题:AI 是否只是重新组合已有知识,而非真正创造新知识?这触及了 AI 在科学发现中的核心争议。
影响与看点
对数学界而言,这一突破可能加速其他长期未解问题的解决,但同时也带来对证明质量和原创性的新标准。对 AI 行业而言,GPT-5.6 Sol Ultra 的多代理并行架构展示了处理复杂推理任务的潜力,可能推动类似方法在科学计算、代码验证等领域的应用。开发者应关注模型对已有工作的引用能力——这是当前 AI 系统的薄弱环节。值得独立判断的是:AI 的“创新”目前仍高度依赖训练数据中的隐含知识,真正的原创性突破可能还需要人类与 AI 的协作。


