当 AI 编码助手从尝鲜走向日常,账单开始变成工程问题。LegalOn 的做法提供了一个可复用的样本:不是换工具,而是换用法。

发生了什么

据 OpenAI 披露的案例,法律 AI 公司 LegalOn 将每日 Codex 成本估算削减了约 65%,同时保持开发速度不变。其核心手段有两条:一是把 Astra、Sol、Luna 等不同模型与具体任务做匹配,而不是所有请求都走同一个最贵的模型;二是对预算做策略性管理,控制整体消耗节奏。

需要说明的是,公开信息只给出了成本降幅和大致方法,没有披露具体单价、调用量或内部基准数据,因此这里的重点是方法本身,而非某个可复制的精确数字。

为什么重要

编码智能体的成本结构,和传统 SaaS 很不一样。它的支出随使用强度线性甚至超线性增长——写得越多、上下文越长、重试越多,账单越高。早期团队通常只关心「能不能用」,一旦进入规模化阶段,成本就会直接挤压毛利,尤其是像 LegalOn 这样面向法律行业的垂直产品,客户对准确性和合规性要求高,重试和验证环节本身就贵。

模型路由(model routing)并不是新概念,但在编码场景里落地一直有摩擦:代码任务对上下文连贯性敏感,频繁切换模型容易带来风格不一致和调试成本。LegalOn 的案例说明,只要任务切分足够清晰——比如把高难度的架构推理留给强模型,把格式化、简单补全、测试样板生成交给更轻的模型——路由的收益可以覆盖切换成本。

另一个信号是「预算管理」被摆上台面。这说明团队已经把 AI 支出当作需要主动治理的运营指标,而不是月底看一眼的意外。

影响与看点

对开发者团队而言,最直接的启示是:模型选型不该是全局一次性决策,而应是按任务分层的持续调优。可以先从调用日志入手,识别哪些请求属于低复杂度高频场景,再考虑下沉到更便宜的模型。

对行业来说,这类案例会推动「成本效率」成为编码智能体竞争的新维度。此前厂商比拼的是补全准确率和上下文长度,接下来谁能帮客户把单位产出的成本压下来,谁就更容易进入企业的采购清单。

值得关注的点有三个:一是路由策略在长链路任务中是否稳定,二是成本下降是否以更高的验证负担为代价,三是这类优化能否沉淀为平台侧的原生能力,而不是每家客户自己造轮子。

一个独立判断:在编码智能体领域,成本优化正在从「省钱技巧」变成「工程能力」,而后者更难被对手在短期内复制。