Grok 4.7 进 Cursor 后价格和跑分怎么读
SpaceXAI 2026-09-21 发布 Grok 4.7:输入仍 2 美元/百万 token,CursorBench 4.0 为 46.3%。对照 4.6 与换模型前要核的三项。

2026 年 9 月 21 日 SpaceXAI 发布 Grok 4.7,并写明当天可在 Cursor 与 Grok Build 里选用。官方把 grok 4.7 价格和跑分放在同一张表里:输入仍是每百万 token 2 美元、输出 6 美元,与 Grok 4.6 标价相同;CursorBench 4.0 从 4.6 的 40.4% 升到 46.3%。换模型前先对这三项,比看「两倍速度、半价」的标题句有用。
标价没涨,快档是另一条价
公告正文写 Grok 4.7「按与 Grok 4.6 相同的价格和速度提供」,表格里的标准档也确实是输入 $2、输出 $6。同页另有一句:还有一个更快的变体,输出速度约两倍,价格也是两倍。Cursor 里如果看到两个 4.7 入口,先确认选的是标准档还是快档,否则账单会按快档走,而你以为自己还在 4.6 的单价上。
| 模型(官方表) | 输入 $/百万 | 输出 $/百万 | CursorBench 4.0 |
|---|---|---|---|
| Grok 4.7 xHigh | 2 | 6 | 46.3% |
| Grok 4.6 High | 2 | 6 | 40.4% |
| GPT-5.6 Sol Max | 4 | 20 | 41.7% |
| Fable 5.1 Max | 10 | 50 | 51.8% |
Fable 5.1 在这张 CursorBench 上仍更高(51.8%),但输出单价是 4.7 的八倍多。4.7 的卖点是同价换更高分,不是榜首。怎么读厂商榜,见 Grok 4.6 跑分怎么看。
编程相关的几项分差
同一张表里,和写代码更近的还有 Terminal-Bench 4.0:4.7 为 38.0%,4.6 为 20.3%,GPT-5.6 Sol Max 为 37.3%,Fable 5.1 Max 为 57.9%。终端长任务上 4.7 相对 4.6 跳了一大截,但仍低于表内的 Fable。DeepSWE v1.1 上 4.7 标了 71.0% 且脚注为 high effort,4.6 是 65.2%。脚注意味着这一格和旁边「默认档」不一定同口径,不要把 71% 直接写成全面超过 Sol 的 72.7%。
电气工程 EEBench 上 4.7 是 64.0%,4.6 是 53.0%。这是官方知识工作向的分,不能当成你仓库里的通过率。
安全栏官方怎么写
4.7 换了一套新的防护栈。官方称在 HackerBench v0.3 上,有风险的双用途提示放行比例为 3.3%,同时较少拦截正当的安全研究。生物安全方面点名 LatchBio 基准 62.4%。这些是厂商自测口径。对编程团队的可执行含义是:模型更愿意做防御向的代码审查,不代表你可以把它接到生产密钥上做渗透。红队能力官方写的是「部分网络安全合作伙伴邀请制」,公开 API 用户不要假设自己打开了那一档。
在 Cursor 里换之前核对三件事
- 设置里的模型名是 4.7 标准档还是快档。快档价格翻倍,见上文。
- 用量计费仍按 token,不是按「和 4.6 一样快」这句话。单价对照见 Grok 4.6 定价,4.7 标准档数字与之相同,快档要另算。
- CursorBench 测的是较长编程任务的公开集,不是你仓库的测试。用一两张你们自己的工单试跑,再决定要不要把默认模型从 4.6 拨过去。
API、第三方 harness 和云路由同一天开放。若路由层缓存了旧模型 ID,列表里暂时看不到 4.7,先查路由配置,而不是先怀疑 Cursor 账号。