GPT-6.1 Sol 在 AA 指数上接近 Astra
Artificial Analysis 在 2026 年 9 月 29 日称,GPT-6.1 Sol 智能指数比 GPT-6 Sol 高 4 分,只比 GPT-6 Astra 低 1 分。标价仍是输入 2 美元、输出 10 美元,缓存读取折扣从 90% 提到 95%。数字来自测评站,不是 OpenAI 发布稿。

Artificial Analysis 在 2026 年 9 月 29 日发文,标题是 GPT-6.1 Sol 在 7 天后接上 GPT-6 Sol 的位置。gpt-6.1 sol 跑分 在他们的 Intelligence Index v4.3.2 里比 GPT-6 Sol 高 4 分,比 GPT-5.6 Sol 高 5 分,落在 GPT-6 Astra 下面 1 分。文章同时写标价与 GPT-6 Sol 相同,输入每百万 token 2 美元、输出 10 美元,缓存读取折扣从 90% 升到 95%。这些句子出自测评站,不是 OpenAI 的发布说明。本文没有在 platform.openai.com 上另找一张名为 GPT-6.1 Sol 的模型卡。
指数涨了哪些,花费怎么比
同一篇文章给出的分项:AA-Briefcase v1.1 高 4 分,GDPval-AA v2.1 高 5 分,Terminal-Bench 4.0 高 12 分,Humanity's Last Exam 高 5 分,GDP.pdf 高 6 分。AA-Omniscience 准确率高 8 分,幻觉率从 60% 降到 54%。AA-Briefcase 大约高 80 Elo,他们写这主要来自评分量表和分析质量,展示分略降。
按他们定义的「每个智能指数任务的花费」,max 努力档 GPT-6.1 Sol 是 0.72 美元,GPT-6 Astra 是 3.26 美元,不到四分之一。相对 GPT-6 Sol 的 1.05 美元低 31%,相对 GPT-5.6 Sol 的 1.99 美元低 64%。输出 token 比 GPT-6 Sol 在各努力档多大约 10% 到 30%。花费下降来自单价里的缓存折扣和任务得分,不是输出变短。
Coding Agent Index 上,max 比 GPT-6 Sol 高 3 分,仍比 Astra 低 2 分。他们观察到 xhigh 比 max 高 3 分,并且 xhigh 比 Astra 高 1 分,任务花费不到 Astra 的 15%。xhigh 高于 max 是这一次测量的结果,不要当成「努力档越高分一定越高」。
和已有 Astra 文章怎么对照
Astra 的产品说明见 GPT-6 Astra 发布了什么,口径是发布页。本文的 1 分之差、0.72 美元和 95% 缓存折扣只属于 Artificial Analysis 2026 年 9 月 29 日这一测。两套数字不要加在同一张账单假设里。缓存折扣从 90% 到 95% 若还没出现在你的发票费率上,按发票走,不要按测评站的「因此综合价略低」直接改预算。
「7 天后替换」在原文里是测评站的标题,不是 OpenAI 宣布下线 GPT-6 Sol 的 API。文章没有给出新的模型 ID 字符串,也没有写旧 ID 从哪一天起返回错误。在官方文档列出 GPT-6.1 Sol 之前,把流量从 GPT-6 Sol 迁走只是阅读这篇跑分之后的决定,不是兼容性通知。xhigh 在 Coding Agent Index 上高于 max 的 3 分,同样只说明这一次测量,换仓库、换努力档之外的采样参数,名次可以再变。