Codex 用户破 2000 万,Claude Code 在 AI 编程上的领先正在收窄
随着 Codex 的 ChatGPT 分发飞轮转起来,被追踪的 ARR 差距缩至 1.7 倍
OpenAI 的 Codex 于 8 月 21 日越过 2000 万活跃用户,而 AI 编程智能体的竞赛正进入一个两家公司都没有完全预料到的阶段:Claude Code 靠「更好用」建立起早期领先,Codex 却靠「铺得更广」在追上来。这种分化不只体现在用户数上,也体现在收入追踪数据里。金融分析公司 TickerTrends 在覆盖截至 8 月 10 日那一周的报告中估计,Claude Code 的四周收入增速已滑落至 5.2%,而 Codex 的是 20.8% —— 快了将近四倍。
在被追踪的年化收入上,Claude Code 仍然大幅领先 —— 约 151 亿美元对 Codex 的 88 亿美元,1.71 比 1 —— 但当两款产品都以这样的速度增长时,走势比某一时点的快照更重要。两个数字都不是公司披露的:TickerTrends 对 Codex 的估算方法,是把 OpenAI 企业 ARR 的 45% 划给 Codex,而 OpenAI 对这个方法论假设既未确认也未否认。
Claude Code 的增速为什么放缓了
要理解眼下发生的事,得先理解今年早些时候发生了什么。Claude Code 于 2025 年 5 月正式公开可用,并在六个月内越过 10 亿美元年化收入 —— 这是企业软件史上最快的里程碑之一。到 2026 年 2 月,Anthropic 披露的运行率为 25 亿美元;到 6 月,追踪机构把这个数字放在接近 140 亿美元的位置。这些增长几乎全部来自那些愿意为一个「能在大型代码库里穿梭、能在终端里自主运行的智能体」付高价的开发者。
根据JetBrains 2026 年开发者生态调查(基于 2026 年 5 月至 7 月对 15509 名专业开发者的调查),全球约 39% 的专业开发者在工作中使用 Claude Code,在美国这一比例升至 47%。相比之下,Codex 在同期的开发者采用率为 16%。Claude Code 增速的问题恰恰出在这份早期成功上:最愿意采用智能体编程工具的那批工程师 —— 软件公司里的资深开发者 —— 已经被转化完了。要够到下一层,要么得赢下采用速度更慢的开发者,要么得赢下相邻的用户群体。Anthropic 推出了Claude Cowork,并于 7 月 7 日扩展到移动端,以及 6 月 23 日上线的 Claude Tag(一个基于 Slack 的团队界面),两者都是冲着这两个方向去的,但至今都还没催出第二波高速增长。
7 月并入 ChatGPT 如何给 Codex 装上了分发引擎
Codex 用户数的加速,主要可以追溯到 OpenAI 在 7 月 9 日作出的一项结构性决定:把独立的 Codex 桌面应用并入统一的 ChatGPT 桌面应用,与新推出的 ChatGPT Work 智能体并列。OpenAI 的公告确认,Chat、Work 和 Codex 如今是同一个应用里的三个标签页,共享同一个额度池。每一位已经在为 ChatGPT 付费的开发者或知识工作者 —— 按 OpenAI 2026 年 2 月的披露,超过 900 万付费商业用户 —— 无需再作任何订阅决定就获得了 Codex 的使用权。
用户数的轨迹说明了这个效果:OpenAI 6 月 2 日官方披露的是 500 万周活跃用户,随后 7 月 14 日达到 800 万,7 月 21 日 1000 万,8 月 13 日 1500 万,以及8 月 21 日的 2000 万。从 1500 万到 2000 万这一段,大约八天里净增了 500 万活跃用户。但这个头条数字需要仔细读。OpenAI 工程负责人 Tibo Sottiaux 在 X 上逐个发布了这些里程碑,却没有定义这些计数里的「活跃」指的是什么 —— 日活、周活,还是更长的窗口。6 月 2 日那个 500 万,是该公司最后一个官方定义了窗口的指标。正如 Gradually.ai 在其 Codex 统计分析中所指出的,这个 2000 万因此不能被读成是在此前那个周活数字上翻了四倍。
此外,OpenAI 在 6 月披露,知识工作者 —— 用 Codex 做报告和数据分析的分析师、产品经理和财务团队 —— 当时已占用户的 20%,且增速是开发者的三倍以上。如今 ChatGPT Work 与之共享同一个产品界面,2000 万里非开发者的那一部分很可能比 6 月那个基线更大。2000 万这个用户数是真实的;但相对于 Claude Code 那个开发者密度很高的基本盘,它在竞争意义上究竟衡量了什么,就模糊得多。
延伸阅读:Anthropic 冲刺史上最大 IPO,Claude 年化收入突破 650 亿美元
两套为不同任务而造的架构
Claude Code 和 Codex 在结构上并不是同一类工具。Claude Code 是终端原生的:它跑在开发者的本地环境里,读写文件、执行测试、提交代码,走的是一个开发者可以随时监督的同步循环。Claude Opus 5 自 7 月 24 日起成为它的默认模型,带有 100 万 token 的上下文窗口,以及 Anthropic 的 Agent Teams 功能,用于协调多个并行的 Claude 实例共同处理一份任务清单。
Codex 则在隔离的云端容器里运行代码,任务因此可以异步执行 —— 开发者把一个问题丢给 Codex,回来时它已经做完了。这套云架构最多支持八个沙箱同时并行,适合团队在不占用本地机器的情况下处理 issue 积压或测试套件。自 7 月 9 日起,默认引擎是 GPT-5.6 Sol,同样带 100 万 token 的上下文窗口。
评测结果反映的是这些差异,而不是一个干脆的质量裁决。Claude Opus 5 以 97% 领跑独立评测机构 vals.ai 的 SWE-bench Verified 榜单,但这个评测在前沿区间已经饱和 —— 头部一簇之间只差寥寥几个百分点。OpenAI 没有把 GPT-5.6 提交到 SWE-bench Verified,所以在这项评测上不存在直接对比。在 Terminal-Bench 2.1 上,独立的 vals.ai 测试给 GPT-5.6 Sol 的分数是 85.8%,Opus 5 是 84.6% —— 统计意义上打平。在衡量「每解决一个问题的成本」的 DeepSWE 上,Codex 是 8.39 美元,Claude Code 是 11.84 美元 —— 对于描述清晰的任务,Codex 有约 30% 的成本优势。而根据Morph LLM 8 月的对比,在盲评代码审查中,Claude Code 的输出有 67% 的场次被评为更干净,Codex 是 25% —— 说明质量与成本朝相反方向权衡。实践者中正在形成的共识是把两者当作互补:复杂、上下文密集的仓库工作交给 Claude Code;并行的、对成本敏感的任务委派交给 Codex。
企业侧的纵深才是更持久的优势
TickerTrends 会把企业账户采用情况与 ARR 估算分开追踪,它在其企业采用分析中报告,Claude Code 的企业账户数是 Codex 的三倍以上,且每周新增账户的速度也更快。Anthropic 称,到 2026 年 4 月,年支出在 100 万美元以上的客户已超过 1000 家,是两个月前的两倍。Anthropic 估算总 ARR 中约 80% 来自 API 消耗和企业合同 —— Claude Code 更像是一个规模化驱动 API 采用的产品演示,而不是主要的收入载体本身。据彭博报道并经 CNBC 证实,Anthropic 的年化收入运行率在 2026 年 7 月底达到 650 亿美元,而 TickerTrends 在 8 月把 OpenAI 的这一数字放在约 440 亿美元。两家公司都已秘密递交 S-1,Anthropic 瞄准 10 月在纳斯达克上市,这意味着这些估算很快就要面对正式披露的检验。还有一个尚未理清的分析细节:Anthropic 通过 AWS 和 Google Cloud 按总额法确认收入,而 OpenAI 通过微软按净额法确认 —— 这是一项符合 GAAP 的差异,却让两家公司公开报出的 ARR 数字难以直接比较。
延伸阅读:Anthropic 下一代模型现身 API,而 Fable 5 停在企业支出的 11%
模型发布仍是决定性变量
用户数和增速,是那些真正塑造竞争结局的决定的滞后指标,而那些决定是:模型能力的里程碑。Anthropic 的 Claude Opus 5 于 7 月 24 日发布,在 ARC-AGI-3 上得分 30.2% —— 约为已公布的次优模型 7.8% 的三倍,而这项评测正是为检验模型在真正新颖的问题上的推理能力而设计的。在更难也更贴近现实的软件工程评测 SWE-bench Pro 上,Opus 5 达到 79.2%,在同一价位上比前代提升了 10 个百分点。在 Anthropic 自家的智能体编程评测 Frontier-Bench 上,Opus 5 领先全场(包括 Fable 5 和 GPT-5.6 Sol),得分 43.3%,Fable 5 为 33.7%,Sol 为 34.4%。另外,正如 GPTS24 今天所报道的,Anthropic 的 API 中近日浮现了新的、尚未公布的模型标识符,暗示又一轮发布周期已经启动 —— 尽管 Anthropic 没有确认任何模型、规格或时间表。
2000 万用户的里程碑和 20.8% 的月增速,讲的是一个关于平台杠杆的真实故事 —— OpenAI 7 月那步结构性动作,给了 Codex 一项 Anthropic 的「开发者优先」定位难以复制的分发优势。但 Anthropic 在企业侧的纵深和模型质量上的优势同样真实,而且它们以用户数无法完全捕捉的方式体现在收入数据里。下一个模型周期要决定的是:Codex 能否把更宽但更浅的用户触达,转化成撑起 Anthropic 收入结构的那种百万美元级企业关系;又或者反过来,Anthropic 能否把 Claude Code 的工程纵深延伸到 Codex 增长最快的那个非开发者知识工作品类。两条路通向同一个市场,而任何一家的下一款前沿模型,都会让这场竞赛重新洗牌。