
OpenAI 新模型 Astra:多智能体协作数日,或成 GPT-6 前奏
OpenAI 正开发代号 Astra 的新模型系列,支持多智能体长时间协作解决复杂问题,并已向政策制定者演示,但尚未决定其最终命名。
多智能体协作

OpenAI 正开发代号 Astra 的新模型系列,支持多智能体长时间协作解决复杂问题,并已向政策制定者演示,但尚未决定其最终命名。

据 The Decoder 报道,OpenAI 正在构建名为 Astra 的新模型系列,旨在让多个智能体协同解决复杂问题,持续数小时甚至数天。该模型可能作为 GPT-6 或 GPT-5 的变体发布。

谷歌DeepMind发布Gemini Robotics ER 2,通过视频理解、工具编排与多机器人协作三大能力,显著提升机器人在真实世界中的推理与任务执行能力。

微软推出紧凑型网络安全模型MAI-Cyber-1-Flash,在CyberGym基准测试中配合多智能体系统达到96%准确率,成本较前沿模型降低50%,但复杂推理仍交由GPT-5.4处理。

当前AI系统虽能交换数据,但缺乏真正的协调能力。实现超级智能需要突破多智能体协作的挑战,让不同AI代理像人类团队一样高效配合。

Cursor 用新 Agent Swarm 系统将 SQLite 重写为 Rust,仅凭文档完成,测试满分;旧系统则被合并冲突卡死。实验表明,将规划与执行分离后,廉价模型也能胜任大部分编码工作。

Sakana AI 将 Nvidia 开源 Nemotron 模型集成到其 Fugu 编排器中,通过动态组合多个模型来执行特定任务,声称协调使用的开源模型可与前沿系统竞争,但未公布具体基准数据。

OpenAI 的代码工具 Codex 自 6 月起对主智能体与子智能体间的指令进行加密,开发者无法再追踪内部任务委派过程。

OpenAI 最新模型 GPT-5.6 Sol Ultra 在不到一小时内证明了困扰学界50年的 Cycle Double Cover 猜想,但数学家指出其缺乏对前人工作的引用,引发关于 AI 是否真正创新的讨论。


来自宾州州立大学和杜克大学的研究人员探索了LLM多智能体系统的自动失败归因方法,旨在识别导致任务失败的智能体及失败时机。
