Codex Replay 从 Claude Code 导入任务后怎么对比结果

OpenAI Codex 桌面版 build 8881 曝光 Codex Replay:成功从 Claude Code 导入会话的用户,可重跑同一任务与 Codex 结果对比。本文写 eligibility 条件、与通用 import 的区别及选型建议。

Codex Replay 从 Claude Code 导入任务后怎么对比结果

2026 年 9 月 14 日,RuntimeWire 在 OpenAI Codex 桌面客户端 production build 8881(npm 包 26.908.40834)里发现一项针对 Claude Code 用户的实验功能:Codex Replay。界面文案是「Replay a task you imported from another agent and compare the results.」公开 import 文档支持从 Claude Code、Claude Cowork、Cursor 拉设置与历史会话,但 Replay 的 eligibility 逻辑只认 provider 标记为 claude-code 且成功导入的 session,且要求桌面 onboarding 完成 7 天内、未 dismiss 公告、并命中 enabled experiment。

作者CodePass 技术编辑

Codex Replay 和通用 Import 差在哪

OpenAI 已有跨 Agent 迁移能力:Codex 桌面可 import 指令、settings、projects;CLI 可从 Claude Code / Cursor 导入最多 50 条、近 30 天内的 chat。这是「把上下文搬过来继续干」。

Replay 是第二步:对已成功导入的 Claude Code 任务,在 Codex 里再跑一遍,方便 A/B 看 harness、模型与工具链差异。RuntimeWire 指出:import 系统支持多来源,但 build 8881 的 Replay 邀请仅面向 Claude Code 成功导入路径,代码未证明 Cursor 导入会话能走同一 Replay 插件。

对开发者含义:OpenAI 在 9 月语境下(Cursor 11 月 OpenAI 断供、Agents API 公测 同一周)明显把 Codex 与 Claude Code 当作 head-to-head 竞品,而不只是 neutral infra。

若你看到 Replay 提示,怎么用好

  1. 先在 Claude Code 完成一条可复现任务(最好有清晰 issue 描述与验收标准),再按官方文档做 desktop import。

  2. Replay 前固定变量:同一 repo commit、同一模型 tier(若可配)、同一测试命令。否则对比的是「两次不同环境」,不是 Agent 能力。

  3. 记录 wall time、token、diff 行数、测试是否绿。HN 上 GPT-6 Astra 常见抱怨是 scope creep 与超长运行,Replay 正好用来量「多出来的工作是否值」。

  4. 若你主力在 Cursor 里跑 Claude,Replay 不替代 Cursor Tab/Cloud Agent;它是 Codex 桌面/CLI 生态的拉新实验。断供窗口见 迁移清单

隐私与合规

Import 会拉近期会话与项目 metadata。企业账号应确认 Anthropic / OpenAI 两侧 DPA 是否允许把 Claude Code 会话复制到 OpenAI 客户端做对比。受监管行业可先看 Coder Agent Relay 自托管 Claude Code 一类方案,Replay 实验未必进采购白名单。

OpenAI 未正式回应时怎么读这条新闻

RuntimeWire 称发稿前 OpenAI 未回复置评请求。功能在 production build 里以 experiment flag 存在,可能随时扩面、改名或下线。把它当「产品方向信号」:Codex 要抢 Claude Code 终端用户,而不是等 Cursor 断供后被动接盘。

参考资料