Cursor 产出鸿沟:p90 与中位数差距为何拉大
Cursor 习惯报告用每周新增代码行对比 p90 与 p50:顶尖陡升、中位数走平。差距在拉大,但行数不等于交付价值,别误读成「装了 Cursor 就赢」。

Cursor 放出的 Developer Habits Report Spring 2026 里,有一张很刺眼的折线图,标题直接写着 The output gap is widening:按「每周每位开发者新增代码行」看,p90(大约前 10%)在往上冲,p50(中位数)几乎趴着不动。很多人转发时只剩一句「AI 让人差距更大」。这篇把它拆开,讲图在说什么、别怎么误读,以及你日常用 Cursor 时能改什么。
图在量什么
- 纵轴:
Lines added/dev/wk,每位开发者每周新增的行数,刻度到约 10K。 - 横轴:大约从
1 Jan '25拉到 2026 年的春夏。 - 粉线:
p90 lines/dev/wk,分布里偏高的那一截。 - 蓝线:
p50 lines/dev/wk,中位数。
视觉上,粉线从 2025 初大约两千多行/周的量级,一路抬到接近年末的更高位,进入 2026 后又明显加速,末端逼近图示上沿;蓝线整段贴着底部,几乎看不到同量级的抬升。图旁还标了一句 flat Gini but incr. inequality,意思接近「某种离散度指标看起来没那么炸,但绝对产出差在变大」。
怎么读「产出差距在拉大」
官方文案强调的是绝对量上的拉开:不是「大家一起涨,只是顶尖涨得更快」那种温和分叉,而是中位数几乎不涨、高分位陡升。对团队管理者,这比「平均写码行数」更有信息量,平均会被少数高产的人拉歪。
对个人更实用的翻译只有一句:同一时期、同一类 AI 工具环境下,工作方式不同的人,可观测产出已经差出一个数量级的感觉。你是靠近蓝线还是粉线,不取决于「有没有装 Cursor」,而取决于会不会把编辑器当成一个可以复利的生产系统。
四条常见误读
- 新增行不等于交付价值。行数是粗代理,生成器废话、无意义重构、重复样板都能刷行数。把这张图当成「质量排行榜」会翻车。
- p90 不是「神仙天赋」的同义词。它更像「已经把 Agent、多文件改动、验收节奏跑顺的人」的聚合结果。
- p50 走平不等于所有普通人都没用 AI。更常见的是偶尔补全几行、聊天问问概念,没有改掉任务切分和审 diff 的习惯,曲线当然抬不起来。
- Gini「看起来平」不能拿来自我安慰。图注已经提醒:这类比例指标钝了,绝对鸿沟仍在扩大。看团队健康度时,别只盯一个系数。
想靠近粉线:可验收的习惯清单
下面每条都能在一周内自测,不用等下一份报告:
- 一次只交一个可合并目标。「把登录校验补齐并附测试」优于「优化用户模块」。目标越大,Agent 越容易空转,行数上去、风险也上去。
- 先写验收标准再开 Agent。两三条 Rules 或验收句:改哪些路径、禁止动哪些文件、怎样算完成,这相当于一个便宜的 Planner。
- 人审 diff,不审感觉。每天固定抽查:有没有无关目录被改、有没有删测试、有没有复制粘贴型重复。粉线人群不是「更敢全盘接受」,而是更快否掉坏补丁。
- 按任务换模型,别按焦虑换模型。单文件排错和多文件重构不该用同一档;模型账单陡增时先查空转,再决定升配。可对照站内 模型怎么选、模型组合成本怎么读。
- 把重复劳动交给编排,把判断留给自己。Rules、Skills、MCP 解决的是「同一类活少敲十遍」,不是替你对业务负责。工作流可看 Agent / Rules / Skills / MCP。
怎么确认自己有没有在「拉开」
别拿全网 p90 比行数,用自己仓库做四周对照更实在:吞吐看合并 PR 数、关闭 issue 数(比裸行数稳);返工看因 AI 补丁导致的 revert 和热修有没有上升;额度效率看同等 Usage 下是不是完成了更多可验收目标;上下文卫生看 Agent 是不是还在无关目录里闲逛。要是 PR 变多、返工也变多,你只是在刷粉线的假动作;要是返工稳定、可合并单元变短变快,才是真的在往上靠。
别只盯行数
这张图最有用的读法不是焦虑,而是对照:中位数习惯是否还停在「偶尔补全」,顶尖习惯是否已经变成「小步目标、强验收、敢否掉坏补丁」。行数只是聚光灯,真正拉开差距的是工作系统。下一份报告出来前,先把自己的四周指标记下来,比再转发一张图有用。