AI 写代码越来越快,但软件并没有因此变多。Ars Technica 报道的一项研究给出了一个反直觉的结论:编码效率的提升,被人类审查这个瓶颈“吸收”了。

发生了什么

研究关注的是 AI 编程代理(coding agents)在实际开发流程中的表现。结论可以概括为一句话:代理确实生成了更多代码,但最终交付的软件并没有等比例增加。原因不在于模型写得不好,而在于下游环节——人类需要阅读、理解、验证并决定是否合并这些代码——没有同步提速。多出来的代码量,最终转化成了审查队列里的积压。

为什么重要

过去两年,衡量 AI 编程能力的指标几乎都集中在“生成侧”:补全准确率、基准测试通过率、单次任务完成度。这些指标隐含了一个假设——写代码是软件开发的主要成本。但真实工程流程里,写只是其中一环,后面还有审查、测试、集成、部署和长期维护。

当生成侧的成本被大幅压低,原本被掩盖的环节就会浮出水面成为新瓶颈。这不是 AI 失效,而是约束条件发生了转移。类似的现象在制造业、翻译、设计等领域都出现过:某个环节自动化之后,整体吞吐量受限于最慢的那一环,而不是最快的。

这也解释了为什么不少团队引入 AI 编程工具后,主观感受是“写得更快了”,但版本发布节奏、需求交付量并没有明显变化。

影响与看点

对开发者而言,短期内的实际变化可能不是“少写代码”,而是“多读代码”。审查 AI 生成的代码需要不同的技能:判断它是否理解了上下文、是否引入了隐性假设、是否在边界条件下失效。这类判断比从头写更依赖经验,也更难被工具替代。

对工具厂商来说,这是一个明确的产品信号。只优化生成速度的边际收益正在递减,真正有空间的方向是审查侧:变更摘要、影响面分析、自动化验证、把大块 diff 拆成可独立判断的小单元。谁能压缩“人理解代码”的时间,谁才真正提升了端到端效率。

对团队管理者,值得警惕的是把 AI 产出直接等同于产能。如果审查能力没有同步扩容,盲目提高生成量只会制造更多未消化的变更,反而增加风险。

一个独立判断:AI 编程的下一阶段竞争,大概率不在“写得多好”,而在“让人审得多快”。生成侧的领先优势正在被拉平,审查与验证环节才是尚未被认真解决的瓶颈。