Cursor Kimi K3 已上线:性能与价格解析

Cursor 官方确认接入 Kimi K3,经 Fireworks、Together、Baseten 三家美国推理商提供,支持零数据保留,CursorBench 评分 60.8%。

Cursor Kimi K3 已上线:性能与价格解析

Cursor 现在支持 Kimi K3 了吗?

支持,且是官方直接确认的,不是社区传闻。Cursor 官方账号发布公告:Kimi K3 已经上线 Cursor,评分接近前沿模型水平[1][3]。这和几天前论坛里"官方说正在看,还没定"是两个不同阶段:那时候 Kimi K3 刚发布,Cursor 只是表态在评估;现在已经能选、能用。

Kimi K3 由 Moonshot AI 发布,2.8 万亿参数的混合专家模型,单次激活约 1040 亿参数,支持 100 万 token 上下文,原生支持多模态输入[3][4]。完整权重已经开源,是目前发布过的最大开源模型[4]。

Kimi K3 在 CursorBench 上评分多少?

CursorBench 3.2 给出的分数是:Max 档 60.8%,均价 2.70 美元/任务;High 档 59.7%,均价 1.89 美元/任务;Low 档 50.5%,均价 0.99 美元/任务[1]。作为参照,Cursor 自家 Composer 2.5 是 56.1%、均价 0.44 美元;GLM 5.2 Max 是 55.0%;Sonnet 5 Max 是 61.5%、均价 6.45 美元。

放在这张表里看,Kimi K3 的位置很清楚:跑分比 Composer 2.5、GLM 5.2 都高,但没有贵出同一个量级。High 档均价不到 2 美元,比自己的 Max 档省 30% 左右,分数只掉了 1.1 个百分点,性价比曲线上 High 档是更划算的点。

单独看编程类跑分,Kimi K3 更突出:Frontend Code Arena 排名第一,比上一代 K2.6 跳了 17 位;Terminal-Bench 2.1 拿到 88.3%;SWE-Marathon 42.0,是对比模型里最高的[4]。它在 CursorBench(专测 Cursor 里的真实编程任务)上的表现,比它在通用智能榜单上的排名(第四,落后 Fable 5、GPT-5.6 Sol、Opus 4.8)好看得多,因为它是一个编程能力被专门强化过的模型,通用推理不是它的主战场。

为什么要用 Fireworks、Together、Baseten 这三家?

因为 Kimi K3 是 Moonshot AI(中国公司)发布的模型,Cursor 没有直接接入官方 API,而是通过三家美国的推理服务商提供:Fireworks、Together AI、Baseten[1][2]。官方公告里特别点出"US-based inference",说明这不是随便找的供应商,是为了让请求经过美国的合规链路,而不是直连中国大陆的接口。

这三家公司的角色是给 Kimi K3 的开源权重提供推理算力,不涉及 Moonshot 自己的服务器。对企业用户、有数据出境合规要求的团队来说,这一条比跑分数字更重要,它决定了你的代码提示词实际经过谁的服务器。

Zero Data Retention 具体保护了什么?

官方公告确认 Kimi K3 支持零数据保留(ZDR)[1]。按 Cursor 的隐私说明,开启 Privacy Mode 后,Cursor 会和所有模型供应商(包括这次的 Fireworks、Together、Baseten)签零数据保留协议:你的提示词和代码不会被存储或用来训练,唯一的例外是触发了滥用检测的对话会按供应商各自的留存政策处理[2]。

如果不开 Privacy Mode,情况会不一样:这几家推理商可能临时访问并存储模型的输入输出用于提升推理性能,用完即删[2]。要不要保留数据、保留多久,取决于 Privacy Mode 开没开,不是模型本身自带的开关。

怎么在 Cursor 里选用 Kimi K3?

跟切换任何其他模型一样:打开 Cursor 的模型选择器(Settings → Models 或对话框里的模型下拉菜单),找到 Kimi K3 选中即可。团队版账号如果模型列表里没看到,通常需要管理员先在后台开启该模型的可见性,这是 Cursor 对新上线模型的常规做法,不是 Kimi K3 独有的限制。

具体的开关入口截图和团队后台设置路径,官方公告没有逐步展开,实际操作以 Cursor 客户端当时的界面为准。

Kimi K3 值不值得切换?

看你要什么。追跑分上限、不太在乎单价,Max 档能拿到接近 Sonnet 5 Max 的水平;日常写代码、图便宜量大,High 档性价比比 Max 更好,也比 GLM 5.2、Kimi 自家上一代 K2.7 Code 高出一截。真正在乎的是极限低成本,Composer 2.5 依然是这批模型里单价最低的选择,Kimi K3 不是来替代它的。

Kimi K3 的额外价值在开源权重:2.8 万亿参数、100 万 token 上下文,以后想自建推理、脱离 Cursor 的计费方式跑同一个模型也是可行路径。这是 Composer 2.5、GLM 5.2 都不具备的选项,短期内用不用得上不重要,但确实是它和其他上榜模型相比多出来的一条路。

常见问题

Kimi K3 和 Kimi K2.7 Code 是同一个模型吗?

不是。Kimi K2.7 Code 是 Moonshot 之前的编程专用模型,在 CursorBench 3.2 上只有 49.7%;Kimi K3 是新一代 2.8 万亿参数模型,CursorBench 评分在 50.5%-60.8% 之间,明显是两个不同世代的产品。

用 Kimi K3 需要另外申请 Moonshot 的账号或 API Key 吗?

不需要。Cursor 通过 Fireworks、Together、Baseten 三家美国推理商接入,直接在 Cursor 里选模型就能用,不用单独去 Moonshot 或这三家服务商开账号。

不开 Privacy Mode,用 Kimi K3 安全吗?

不开 Privacy Mode 时,推理商可能临时存储你的输入输出用于优化推理性能,用完会删除,但存在这个临时访问的窗口。如果代码涉及敏感信息,建议直接开启 Privacy Mode,享受零数据保留协议。

参考资料

  1. Cursor · CursorBench
  2. Cursor · Data Use & Privacy Overview
  3. Kimi K3 Tech Blog: Open Frontier Intelligence
  4. Kimi K3: Open Weights, Specs, Pricing and Benchmarks