2026年,多家工程效能分析机构基于 DORA 指标体系的研究显示,AI 生成代码在提升产出的同时带来了明显的审查瓶颈:PR 审查中位时长同比上升441%(2025年该数字为91%),单开发者合并 PR 数同比上升98%,完成任务数上升21%,未经任何人工审查即合并的 PR 占比也明显上升。需要注意,这类数字来自供应商研究,应与 DORA 官方报告对照阅读。本文从软件工程实践视角解读。
数据说了什么
把几个指标放在一起看,图景比较清晰:人均产出与合并量都在上升,但代码审查环节的耗时增长得更快。这意味着新增的代码并没有被同等速度地验证与吸收,审查成为新的瓶颈。对以代码质量与交付节奏为目标的团队,这是一个需要正视的结构性变化,而不是个别团队的偶发现象。
为什么会出现审查瓶颈
有分析把原因归纳为三类成本:审查 AI 生成代码带来的“验证税”,即理解与核对生成代码所需的额外时间;采用新工具初期的“学费成本”,表现为短期的效率下降;以及变更失败率上升带来的“不稳定税”。三者叠加,可能使净收益低于单纯的产出增长给人的直觉。
DORA 官方视角的对照
DORA 官方在相关研究中指出,在具备适当保障措施的前提下,生成式 AI 的采用也可能加快代码审查并改善报告的质量,形成正向循环。这与“审查变慢”的观察并不必然矛盾:差异很可能来自流程与保障措施的成熟度。因此,评估 AI 对软件工程实践的影响,不能只看单一指标,而要结合团队自身的流程与质量基线。
对软件工程实践的启示
对正在扩大 AI 辅助编码范围的团队,建议同步投入三件事:把自动化测试与单元测试覆盖作为准入门槛,让机器先过滤明显问题;为代码审查设定明确的检查清单与规模上限,避免单次审查过载;以及持续跟踪变更失败率等质量指标,用数据判断 AI 带来的净影响。工具提速只是第一步,验证能力必须同步跟上。
小结
行业研究显示 AI 生成代码让 PR 审查中位时长同比上升441%,凸显代码质量治理与测试能力的瓶颈,是2026年软件工程实践领域值得深入讨论的议题。