Cursor 里 Grok 4.7 和 4.6 差在哪

标准档单价仍是输入 2 美元、输出 6 美元。4.7 多了 500k 长上下文加价,CursorBench 从 40.4% 到 46.3%,Terminal-Bench 从 20.3% 到 38.0%。

Cursor 里 Grok 4.7 和 4.6 差在哪

Cursor 论坛 2026 年 9 月 21 日的发布帖把 Grok 4.7 和 4.6 放在一起讲:同样的价格和速度提供,4.6 继续留在列表里。cursor grok 4.7 和 4.6 区别 不在「4.6 被下架」,而在底座、努力档拉开的程度,以及 4.7 多出来的长上下文账单。

作者CodePass 技术编辑

单价相同,长上下文不是同一张账单

Models and Pricing 的 Cursor Models 表里,Grok 4.7 与 Grok 4.6 的标准行都是输入每百万 token 2 美元、缓存读取 0.5 美元、输出 6 美元。Fast 行都是输入 4、缓存读取 1、输出 12。两边都在同一个 Cursor Models 池里扣额度。

4.6 那一行的备注只写了 Cursor 与 SpaceXAI 联合训练。4.7 多了长上下文:输入超过 256k token 时,标准请求按这些单价的 2 倍计,上限 500k;Fast 且输入超过 256k 时,按标准单价的 3 倍计。模型文档写明,是否加价只看输入长度:输入不超过 256k,整次请求走标准或 Fast 单价。把 4.6 的使用习惯直接搬到 4.7 的 500k 窗口上,池子会掉得更快。公告里的跑分表没有这一行,见 价格和跑分怎么读

能力上官方点了哪几处

帮助中心写:4.7 底座比 4.6 更大,在更难、往往要许多小时的任务上做了更长的强化学习,并且更会检查自己的结果、管理更长上下文。论坛帖补充:它被训练成能理解 Grok Bot 的 harness,对话和一般知识工作(文档、演示)更强,不只是写代码。防护栈换过,拒绝和越狱抵抗在他们测过的 Grok 里最强,同时正当的安全研究拒绝率保持较低。这些是厂商表述。

跑分他们写在同一帖:CursorBench 4.0 从 4.6 的 40.4% 到 4.7 的 46.3%;Terminal-Bench 4.0 从 20.3% 到 38.0%。帖子还说 AA Briefcase、Harvey、HealthBench、EEBench 都有提升。Terminal-Bench 的跳幅比 CursorBench 大,更接近「终端里的长任务」,不等于你仓库的通过率。

努力档方面,帮助中心写 4.7 的四档比 4.6 分得更开,点名模型的默认是 high。Start 计划上 4.7 被固定在 medium、非 Fast。因此 Start 用户看到的不是论坛帖里那档 xHigh 跑分。4.6 在 Start 上同样是固定 medium,两边都不是最大努力档。

什么时候留在 4.6

4.6 没有从选择器里消失。下面几种情况留在 4.6 更说得通:

  • 任务短,4.6 已经一次过,不需要为多想一会儿付时间。
  • 你依赖 4.6 上已经摸清的失败方式,换 4.7 会打乱对照。
  • 上下文经常顶到 256k 以上,而你还没接受 2 倍或 3 倍输入单价。

帮助中心建议把 4.7 用在 4.6 上停滞、步骤多、仓库大的会话;日常求快求省仍用 Composer,Composer 没有被弃用。和更早的 4.6 与 4.5 相比,这次官方明确写了「同价同速」,差别主要在长任务和长上下文计费。

参考资料