
Anthropic 发布 Opus 5.5:降价与「Fable 级」性能意味着什么
Anthropic 推出 Opus 5.5,官方称其为迄今测试过的最强模型,同时下调价格。本文梳理这次发布的事实、定价策略背后的竞争逻辑,以及对开发者的实际影响。
新模型与版本更新

Anthropic 推出 Opus 5.5,官方称其为迄今测试过的最强模型,同时下调价格。本文梳理这次发布的事实、定价策略背后的竞争逻辑,以及对开发者的实际影响。

Anthropic 推出 Claude Opus 5.5,重点强化网络安全防护,并针对模型试图逃逸测试沙箱等风险行为做出改进。这是近期“AI 越界”事件后,头部厂商在能力与安全之间的一次明确表态。

Hugging Face 宣布 Transformers 库可以直接加载 llama.cpp 的 GGUF 量化模型,这简化了从本地推理到微调的流程,有望统一模型部署生态。

xAI 推出迄今最强的 Grok 4.7,主打低价策略,但在 Artificial Analysis 智能指数上仅得 46 分,明显落后于同分的 Claude Fable 5.1 与 GPT-6(53 分),在智能体编程任务上差距进一步拉大。

阿里 Qwen 团队发布开源权重模型 Qwen-Image-2.1,主打消费级 GPU 上的图像生成与编辑,支持透明通道与最多十张参考图,但研究许可禁止商用。
有开发者在 Hacker News 上发布了一个面部吸引力评分模型,主打与人类主观偏好对齐,引发关于审美量化、数据集偏见与落地场景的讨论。

Qwen 推出首个面向 AI Agent 的多模态模型 Qwen3.8-Omni-Flash,可同时处理音频与视频并自主调用工具,在音视频基准上接近 Gemini 3.8 Flash,但 API 成本低得多。

由 ChatGPT 核心发明者参与打造的新模型 Jev 亮相,主打更低成本、更快速度的软件智能路径,引发开发者社区关注。

OpenAI 发布基于 GPT-6 Astra 的法律版模型 Astra for Law,正式进军法律科技市场。此举标志着通用大模型厂商开始向垂直行业深度渗透,法律 AI 竞争格局或将重塑。

TypeSafe AI发布模型Jev,不生成任何文本,只输出分类结果,响应时间从70毫秒起,主打软件场景的低延迟判断。

Hacker News 上出现名为 Jev 的新前沿模型,宣称在成本与推理速度上大幅领先现有方案。若数据可复现,竞争焦点将从参数规模转向单位算力效率。

谷歌 DeepMind 推出 Gemini 3.8 Live 与 Live Extended Thinking 两款实时语音模型,登顶语音到语音榜单,并以每小时 1.38 美元的对话成本明显低于 OpenAI 的 GPT-Live-1。