
Gemini 3.8 Live 与 Extended Thinking:实时多模态开始“想得更久”
Google DeepMind 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking,把实时交互能力与可延展的推理深度结合,指向语音与视频场景下的新一代助手形态。
新模型与版本更新

Google DeepMind 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking,把实时交互能力与可延展的推理深度结合,指向语音与视频场景下的新一代助手形态。

Salesforce 基于英伟达开源权重 Nemotron 打造推理模型 Koa,专攻销售、营销与客服任务。它代表了一条与通用大模型不同的路线:用开源底座加行业数据,直接切入企业工作流。

Google Research 推出 3.3 亿参数的时序预测模型 TimesFM-3,可结合促销、天气等已知未来事件,一次性生成全部未来时间点,减少累积误差并降低算力开销。

Arena.ai 对数万条基准回答的对比显示,Claude Fable 5.1 的措辞比前代更就事论事,但篇幅也更长。语言承载的信息密度下降,成为这次迭代最值得注意的变化。

DeepSeek 推出 5520 亿参数多模态模型 V4.1-Flash,KV 缓存内存降至前代的四分之一,每 token 仅激活 160 亿参数,并在 DeepSWE 编码基准上小幅超越 Opus 5 与 GPT-5.6 Sol,以 MIT 协议开源,瞄准更低成本的 AI Agent。

DeepSeek 推出 v4.1 Flash 版本,在 Hacker News 上引发讨论。轻量级模型正成为大模型厂商争夺开发者入口的关键产品形态。

DeepSeek 以 v4.1-Exp 为名放出实验性版本,在 Hacker News 上引发小范围讨论。本文梳理这一命名的信号意义,以及它对开源模型迭代节奏和开发者选型的影响。

IBM 推出 Granite 系列时序基础模型 PatchTST-FM-r2,在多项基准上达到先进水平,并采用商用友好许可,为时序预测的落地应用提供了新选项。

OpenAI推出GPT-6 Astra,定位为最强大的商业模型,强化推理、计算机使用及写作与设计判断能力,标志着AI从通用对话向工作场景深度渗透。


阿里发布 Qwen-Drive 1.0,一个集环境感知、交通问答与路径规划于一体的多模态模型。其关键发现是,纯文本-图像模型并不天然理解三维空间,空间感知需要专门训练。

谷歌研究院和DeepMind发布WeatherNext 3,该模型跳过传统物理模拟,直接从实时卫星数据学习,提供5公里分辨率的小时级预报,有望改善非洲、拉美等地区的预报精度。