⚡ 智能体 · 生态博弈

Codex 与 Claude Code 负责人公开对弈:一场封号风波背后的 Harness 之争

7 月,OpenAI Codex 负责人 Tibo 公开教用户将 GPT-5.6 Sol 接入 Claude Code,并承诺"如果被封,我欠大家一次 reset"。一个月后,开发者 Alex 的 Anthropic 账号真的被封了——一场关于模型与 Harness 的公开对决就此展开,双方负责人隔空交锋,剧情三连反转。

综合公开信息整理 2026-08-12 全文约 4 分钟读完
#OpenAI Codex #Claude Code #Agent Harness #Coding Agent #生态博弈
⚡ 公开对弈 Codex × Claude Code 负责人正面交锋
7.12 Tibo 首次公开跨框架方案
1 个月 从承诺到封号,再到额度重置

⚡ 30 秒速览

  • 事件核心:OpenAI Codex 负责人 Tibo 公开教开发者将 GPT-5.6 Sol 接入 Claude Code 运行环境,一个月后尝试者账号被封。
  • 反转剧情:Claude Code 负责人 Boris 下场后先挖人、后解封;Tibo 拒绝邀请并重置了所有 Codex 用户的额度。
  • 关键表态:Anthropic 明确表示不会因在 harness 中使用其他模型而封号;OpenAI 则强调"harness 的选择权应该属于用户"。
  • 深层信号:模型和 Agent 产品正在解耦,Coding Agent 的竞争从"模型之争"转向"Harness 之争"——系统工程能力正在成为新的壁垒。
  • Sam Altman 的反应:"lol, one of my favorite things about OpenAI is Tibo."

01事件回溯 从一句承诺到一场公开对弈

整个故事始于 7 月 12 日的一个观察。开发者 Theo 在 X 上发现:同一个 GPT-5.6 Sol 模型,放到 Claude Code 的运行环境中,部分任务表现甚至优于 Codex。模型没变,变的是外面的 Agent harness。

一个诚实的注脚:这不是"破解",而是保留官方 CLI 不变,仅通过本地代理转发模型请求。

7 月 12 日

开发者 Theo 提出观察:GPT-5.6 Sol 在 Claude Code 中表现更好。Tibo 开始追问配置方式。

7 月 13 日

Tibo 公开实现方法,称"五分钟就能配好",并留下承诺:"如果这个办法被封,我欠大家一次 reset。"

8 月

开发者 Alex 按教程配置后,Anthropic 账号被暂停,原因只有一句"suspicious signals"。他在 X 上公开此事。

Boris 回应

Claude Code 负责人 Boris Cherny 亲自下场,先公开挖人("要不要来 Anthropic?"),随后解释封号几乎确定是另一套 classifier 被触发,账户已恢复。

Tibo 反击

Tibo 拒绝工作邀请,强调"harness 的选择权很重要",并兑现承诺——重置所有 Codex 和 ChatGPT Work 付费用户的额度

注:以上时间线根据公开 X 帖子与 GitHub 记录整理。Alex 的项目仓库中保留了完整的配置快照与封号记录。

02模型 vs Harness Coding Agent 的竞争逻辑正在重构

过去人们谈 Coding Agent,很容易把"Claude Code"和"Claude"、把"Codex"和"GPT"看成同一个东西。但这次事件撕开了一个口子:模型和 Agent 产品,正在被开发者当成两层独立的系统来比较。

传统认知:模型 = 产品

一个模型绑定一个官方客户端,模型强则产品强。竞争核心是参数规模与基准分数。

新现实:模型 ≠ Harness

模型负责推理与代码理解;Harness 负责上下文管理、工具调用、任务编排与执行循环。两者可以独立选型、自由组合。

OpenAI 在介绍 GPT-5.6 技术架构时,专门将 Agentic Harness 单独拿出来讨论——它是一层 Rust 编排系统,连接模型、工具和用户环境。Anthropic 也为 Claude Code 定义了完整的 LLM Gateway Protocol。双方都承认:Harness 的工程质量,直接影响 Agent 的最终效率。

模型层推理 · 代码生成 · 理解
Harness 层上下文管理 · 工具调用 · 任务编排
用户层开发环境 · 权限 · 交互界面
解耦自由组合 · 按需选型

注:以上三层架构为行业通用划分,非特定公司官方定义。GPT-5.6 技术报告中明确将 Agentic Harness 列为独立组件。

03一场表演,三个主角 剧情反转背后的立场

🎯 Tibo · OpenAI Codex 负责人 "Harness 应该自由"

  • 公开教用户将 GPT-5.6 Sol 接入 Claude Code,并留下"如果被封,我欠大家一次 reset"的承诺。
  • 在 Alex 被封后隔空质疑,随后拒绝 Boris 的挖人邀请,理由是"太喜欢现在的团队"。
  • 兑现承诺:重置所有 Codex 和 ChatGPT Work 付费用户的额度,并预告"周一再来一次"。
核心立场:用户有权自由选择模型与 Harness 的组合——扩大模型分发范围,削弱客户端锁定。

🛡️ Boris · Anthropic Claude Code 负责人 "不会因模型选择封号"

  • 第一时间澄清:Anthropic 不会因为用户在 harness 中使用其他模型而封禁账户。
  • 判断封号"几乎可以肯定"是另一套账户 classifier 被触发,并推动账户恢复。
  • 明确表示 Claude Code 搭配其他模型是支持的,可通过 LiteLLM 等代理方式实现。
核心立场:Claude Code 足够好,好到用户即使不用 Claude 模型也愿意用它——Harness 本身成为独立入口。

🧑‍💻 Alex · 被封的开发者 账号已恢复

  • 按照 Tibo 公开的方法配置了 Claude Code + GPT-5.6 Sol,未修改官方 CLI。
  • 账户被暂停后提出申诉,并在 X 上公开此事,同时谨慎表示"不确定代理配置是否为直接原因"。
  • 账户已恢复,Boris 确认团队正在采取措施避免类似事件再次发生。
结果:被封 → 解封 → 推动行业明确规则,成为这次"Harness 解耦"运动的意外催化剂。
"lol, one of my favorite things about OpenAI is Tibo." —— Sam Altman,在 X 上对整场风波的回应

04为什么"模型和 Harness 正在解耦"是今年最重要的信号

如果只看表面,这只是 Tibo 和 Boris 在 X 上的一次公开玩梗。但真正值得关注的,是Boris 那句"不会因为使用其他模型而封号"以及Tibo 所强调的"Freedom of harness"——这意味着 Coding Agent 的竞争逻辑正在发生根本性变化。

一个正在出现的市场:用户不再接受"一个模型必须绑定一个官方客户端"的组合,而是开始自己选择"模型 + Harness"。

这也是为什么 Theo 最初那句"同一个 GPT-5.6 Sol,在 Claude Code 里面可能表现更好"如此敏感。它实际上把 Coding Agent 的竞争从"谁家的模型更强",进一步推向了另一个问题:谁更擅长把模型的能力真正释放出来?

模型能力Harness 编排工具调用任务完成率

对于 OpenAI 来说,让 GPT-5.6 Sol 可以运行在 Claude Code 里,某种程度上削弱了客户端的锁定价值,却扩大了模型本身的分发范围。对于 Anthropic 来说,如果 Claude Code 足够好,好到用户即使不用 Claude 模型也希望继续使用,那么 Claude Code 本身就可能成为独立于底层模型之外的一层入口。

这是一场"双向解锁"的博弈,而赢家将是那个让用户愿意主动选择的一方。

编辑核心判断

Agent 时代,Harness 的工程能力正在成为比模型参数更稀缺的竞争壁垒。谁能把模型的能力真正释放出来,谁就掌握了下一轮 Coding Agent 生态的入口。模型可以换,但习惯和生态很难换。

现在就能体验

GPT-5.6 Sol 已通过 Codex 和 ChatGPT Work 开放使用。
Claude Code 同样支持通过 LiteLLM 等代理接入第三方模型。
Harness 的选择权,正在回到开发者手中。

chat.openai.com → Codex / ChatGPT Work