
AI Agent 主动发邮件求助人类研究者:一次值得琢磨的自主行为
一个 AI Agent 在遇到无法解决的问题时,主动向人类研究者发邮件求助。这件事本身不大,但它把「Agent 何时该找人」这个被忽视的问题摆到了台面上。
函数调用与 MCP

一个 AI Agent 在遇到无法解决的问题时,主动向人类研究者发邮件求助。这件事本身不大,但它把「Agent 何时该找人」这个被忽视的问题摆到了台面上。

哈佛物理学家用开源工具BootLoops配合Claude,三个月产出36篇跨18个领域的论文草稿;但Schwartz强调,成果往往要等人类专家介入后才真正具备科学价值。

Meta 上线 Muse AI 代理,宣称可代发邮件、在线购物,但前提是用户愿意把数据和支付权限交给 Meta。本文梳理其能力边界与行业信号。

OpenAI 为 ChatGPT 插件加入专属侧边栏入口、可交互面板、文件查看器、更好的发现机制与自动化支持,插件正从“调用工具”演化为平台内的轻量应用。

Hugging Face 上出现一项面向 MCP Agent 的“来源感知验证”思路,主张把验证对象从结论本身扩展到结论所依赖的来源,减少 Agent 引用错位与来源漂移。

Hacker News 上 Show HN 项目 OpenAPPA 提出开源、确定性的 AI 护栏方案,旨在约束智能体行为的同时避免打断其任务执行,为 AI 安全工具链提供新选择。

Hugging Face 上出现 Holo4,瞄准通用计算机操作智能体(computer-use agent)方向,试图让模型像人一样直接操作图形界面完成任务。

斯坦福与Caltech团队提出HomeBody系统,跳过专门训练的控制层,让GPT-6 Astra直接调用抓取、导航等模块化技能,驱动机器人独立整理一间陌生厨房。

Google 与沃尔玛旗下 Flipkart 在印度开展小范围测试,用户可通过 Gemini 和 AI Mode 直接完成商品购买,计划在十月晚些时候扩大范围。

英伟达的 SoL-Pi 通过优化模型与运行环境之间的控制层(harness),在性能基本不变的前提下将编码智能体的 Token 消耗最多降低 49%,但该收益在其他基准上有所缩水。


两名开发者称,仅需极少提示,Meta 的 Muse 就会把整个根文件系统、Ubuntu 系统文件、应用模板和内部文档打包分享出来。这再次暴露了 AI 智能体在权限隔离上的薄弱环节。