Meta Muse Spark 1.3 发布:省 token 能追上 Claude Code 吗

Meta 于 2026 年 9 月 2 日发布 Muse Spark 1.3,号称比上一代少 20% 工具调用、少 25% token。本文对比定价、能力和 Muse Code 的产品形态。

Meta Muse Spark 1.3 发布:省 token 能追上 Claude Code 吗

Meta 在 2026 年 9 月 2 日发布了 Muse Spark 1.3,定位是长周期 Agent 编程模型。和前代 Muse Spark 1.2 比,Meta 自己测出的数字是减少约 20% 的工具调用次数和约 25% 的 token 消耗。

作者CodePass 技术编辑

省在哪里

Muse Spark 1.3 的效率提升来自两方面:减少不必要的往返(fewer unnecessary turns)和降低回复冗余度(less verbosity)。简单说,模型学会了在不需要调工具时不调,在回答时不说废话。

这对 Agent 场景有实际意义。编程 Agent 的成本大头不在单次推理,而在一个任务里来回调用工具的次数。每多一次工具调用就多一轮 API 请求。减少 20% 的调用次数,在按量付费场景下直接省钱。

另一个改进是自我纠错能力。Meta 称 Muse Spark 1.3 更善于在计划出偏时主动修正,以及在遇到无法处理的问题时直接说"我做不了"。这种认错能力在长任务里很关键。一个不认错的模型会在死胡同里反复重试,白烧 token。

定价

Muse Spark 1.3 的 API 定价没变:输入 1.25 美元/百万 token,输出 4.25 美元/百万 token。还有一个贡献者层(contributor tier)价格更低:输入 0.10 美元,输出 0.20 美元。

和 Claude 系列比,Fable 5.1 输入 10 美元、输出 50 美元。Muse Spark 的标准价格比 Fable 便宜 8 倍。当然模型能力也有差距,但对预算敏感的团队来说,这个价差足以成为选择依据。

产品形态:Muse Code

Muse Spark 1.3 是模型,Muse Code 是它的客户端。Muse Code 是一个终端 Agent,功能类似 Claude Code:在命令行里接受自然语言指令,自动编辑文件、运行命令、管理 Git 操作。

Muse Code 的特色是本地事件日志。每个操作都以 append-only 的方式写入本地日志文件,会话崩溃后可以从日志恢复。另外 Muse Code 支持自动子 Agent 分派,遇到可并行的子任务时自动拆分给子 Agent 执行。

目前的限制是 Muse Code 只有终端界面,没有 IDE 插件或 Web 版。模型权重是闭源的,不能自部署。max 推理模式(对应最强能力)仍在有限预览中,普通用户能用的是标准模式。

独立评测怎么说

Artificial Analysis 的 Coding Agent Index 里,Muse Spark 1.3 在 Muse Code harness 中的得分和 Claude Opus 5、GPT-6 Astra 在各自 harness 中的得分接近。排在最前面的是 Claude Fable 5.1 在 Claude Code 里拿到的 70 分。

需要注意的是,不同 harness 之间的分数不能直接横向对比。Agent 框架本身对最终表现有很大影响,同一个模型在不同框架里跑分差异可以到 10 个百分点。

参考资料