
谷歌DeepMind推出Gemini智能体视频理解,AI从看视频到理解视频
谷歌DeepMind发布基于Gemini的智能体视频理解技术,让AI不仅能识别视频内容,还能进行推理和交互,为视频分析、自动驾驶和机器人等领域带来新可能。
论文、技术突破与趋势解读

谷歌DeepMind发布基于Gemini的智能体视频理解技术,让AI不仅能识别视频内容,还能进行推理和交互,为视频分析、自动驾驶和机器人等领域带来新可能。


红杉资本孵化的初创公司Empirik今日正式推出,融资2100万美元,旨在用AI预测IT基础设施故障,其愿景是成为IT运维领域的Cursor。

约翰迪尔正在测试名为JD的AI聊天助手,它基于农场自身的田间、机械和运营数据,为农民提供设备设置、燃油用量和收获时机等建议,旨在帮助农民提高收益。

德国组织AlgorithmWatch依据欧盟数字服务法,对谷歌选举相关AI概览进行审计,发现其展示不一致、来源单一,且原有防护措施可能已失效。

Nvidia 于 9 月 3 日正式推出 DLSS 5,但仅限 RTX 50 系列 GPU,且对硬件要求极高,引发关于 AI 画质增强技术应用边界的讨论。

OpenAI 宣布 Astra 成为其首个在预备框架下达到“关键网络安全能力”阈值的模型,并为此加强了发布防护措施。这标志着前沿模型在能力与安全平衡上的新节点。


Runway推出Solaris,一种实时生成用户界面的AI系统,开创“界面世界模型”新类别,将改变软件交互方式。

Google AI 搜索曾对提及非洲、印度或巴基斯坦用户的查询给出“拨打紧急电话”的建议,现已移除该建议,但仍会标记来自 Facebook 的用户,引发对 AI 偏见和内容审核的讨论。

