Google DeepMind 宣布在 Gemini 3.5 Flash 中引入计算机使用功能,使模型能够直接与桌面应用程序交互。该功能通过 API 提供,开发者可让模型执行点击、输入等操作。这标志着 AI 从纯文本处理向实际环境操作的扩展。目前该功能处于早期阶段,可能在某些任务上表现不稳定。