在 Claude Code 里接 Kimi K3 一次前端实测账单
转述 Philipp Dubach 经 OpenRouter 跑 Kimi K3:手感、前端还原、$7.18 对比 Opus/Fable 估价,以及是否能替旗舰。

Philipp D. Dubach 更新了 I Tried Kimi K3 Inside Claude Code:保留 Claude Code 工作流,经 OpenRouter 把请求打到 Moonshot 的 Kimi K3。他观察到的趋势是:够用、更便宜、harness 可换模,三者一起在压缩闭源溢价。
怎么接
作者路径:Claude Code 配置指向 OpenRouter,模型选 Moonshot Kimi K3。界面与工具习惯基本不动,变的是背后权重。站内另有 Cursor 侧 Kimi 话题;本文只谈 Claude Code 路由实测。
手感与前端
起初觉得慢(尽管公开测速未必更差),大约一小时后忘记后端是谁。前端还原测试复用带资产的详细 prompt:分区对比图显示结构接近参考稿。作者提醒:这是单次、强约束实验,prompt 一糊可能塌。
账单对比(同一次流量回放)
导出:115 请求,约 1364 万 prompt token(其中约 1295 万 cache hit),82307 output,合计 $7.18。把同一 token 结构套 Anthropic 标价,约合 Opus 4.8 $11.96、Fable 5 $23.92。亦即该次相对 Opus 约便宜四成、相对 Fable 约七成。作者仍不会用 K3 换掉最难任务上的 Opus:停手时机、歧义处理、少做多余主动仍是闭源强项;Moonshot 自己也列了过度主动等限制。
怎么用在团队策略
例行重构、前端铺量、可接受小瑕疵的活可分流便宜开源;架构拍板留 Opus/Fable。价值正上移到路由器、上下文与校验环。权重开放不等于桌上能跑:K3 量级需要数据中心级加速器。先把 harness 与评测固定,再谈换模。