Pro Max 卖的是优先级,不是更多算力
Codex 仓库的代码字符串证实,这档 500 美元订阅的唯一卖点是快

9 月 24 日,埋在 ChatGPT 未发布前端代码里的一些字符串 —— 随后在OpenAI 公开的 Codex 仓库里得到印证 —— 显示这家公司正在准备一档名为 ChatGPT Pro Max 的订阅,月费 500 美元。代码里写明的、它与现有 200 美元 Pro 套餐唯一的区别,是能用上代码中标注为「Fastest Work and Codex」的东西。OpenAI 没有任何官方公告,也没给发布日期,但证据是实的 —— 9 月 25 日合入 OpenAI 公开 Codex 仓库的 PR #47971 坐实了这些字符串。这次泄露出现在 9 月 29 日 OpenAI DevDay 的五天前。
这次泄露没说的,和它说了的一样重要。Pro Max 没有承诺更多用量额度、更多模型,或者低档位用不到的能力。它的卖点是速度 —— 确切地说,是多步智能体任务执行的速度。对于一整个工作日都在连续跑 ChatGPT Work 或 Codex 的那类用户来说,这个区别重新定义了一份 AI 订阅到底在卖什么。
为什么推理速度会在智能体负载上层层放大
ChatGPT Work 是 OpenAI 那个长时运行的智能体模式,面向的是以小时而不是以一轮对话来计量的任务。Codex 是 OpenAI 的编程智能体,能在一个项目上连续工作数小时甚至数天。两者共用一个与常规聊天流量分开的专用算力池。智能体系统每走一步都要发起自己的模型调用:读文件、写代码、跑测试、解读输出、重试。一次复杂的 Codex 会话可能产生数百次这样的调用。
在十四倍于标准推理速度的情况下 —— 也就是 OpenAI 8 月用基于 Cerebras 的 Ultrafast 模式演示过的吞吐量 —— 一次本来要几小时的会话,只需其中一小部分时间就能跑完。对于按项目向客户计费的开发者,或者赶竞争档期的研究团队,把一次 Codex 任务的周转时间砍掉一半,值得多付这笔钱。这正是 Pro Max 看起来要卖的东西:不是更多算力,而是让你的任务排到队伍前面。
Cerebras:「最快」背后的基础设施
OpenAI 与 Cerebras 的关系可以追溯到 2026 年初 —— 后者的晶圆级处理器拥有所有 AI 加速器中最大的片上内存。2 月,OpenAI 把 GPT-5.3-Codex-Spark 部署在了 Cerebras 硬件上,作为面向 Pro 用户的研究预览,这是它在该基础设施上的第一个生产模型,输出速度超过每秒 1000 个 token,约为它所替代的那一版 Codex 的十五倍。
8 月,OpenAI 在一次受限的 API 预览中放出了 GPT-5.6 Sol Ultrafast,每秒 750 个 token —— 十四倍于标准处理速度。Cerebras 自己的基准测试发现,在知识工作类任务上端到端提速 5.6 倍,且没有可测量的质量损失。OpenAI 和 Cerebras 都没有确认 Pro Max 与 Cerebras 有关;TestingCatalog 把这一点描述为「说得通」。从结构上推断则相当直接:OpenAI 迄今建成的唯一一个以速度为优先的商业档位跑在 Cerebras 硬件上,而 Pro Max 是一个以速度为优先的产品。
这档订阅为什么会出现:Astra 把 200 美元套餐的经济账吃穿了
Pro Max 的直接起因是 9 月 3 日发布的 GPT-6 Astra。Astra 带来了直接操作计算机和自主浏览的能力 —— 这类能力消耗的推理资源远高于常规文本生成,因为自主完成任务要求模型在一次会话里执行几十甚至上百个操作。
发布一周后的 9 月 10 日,OpenAI 核心产品负责人 Thibault Sottiaux 宣布暂停新的 200 美元 Pro 订阅,并把这一档称作 OpenAI 系统「压力最大」的来源。截至 9 月 25 日,这次暂停仍然有效,也没有给出恢复时间表。经济上的问题是结构性的:200 美元这个统一价是在 Astra 的算力需求还不为人知时定的。那些一跑就是几小时 Codex 会话的重度 Pro 用户,每一美元换走的服务器时间,远超这个套餐按平均用户假设的量。Pro Max 的定价更接近持续性智能体算力的真实成本,把这笔补贴消掉了。
延伸阅读:OpenAI 的 GPT-6 Astra 发布,以及它前所未有的算力需求
行业分岔:用价格,还是用身份
OpenAI 分配稀缺前沿算力的办法是涨价,但这并不是一家大型 AI 实验室唯一能走的路。9 月 22 日发布 Claude Opus 5.5 的 Anthropic,会把涉及攻击性网络安全的请求自动路由给 Claude Opus 4.8、把被标记的生物学相关请求路由给 Claude Opus 5,完整的 Opus 5.5 能力只留给通过了其生命科学或网络安全验证计划的用户。该模型还内置了防蒸馏措施 —— 试图通过输出套取其能力的行为,会被导向能力更受限的模型。
月费 100 或 200 美元的 Claude Max 并没有引入以速度为优先的定价。Anthropic 管理前沿能力访问靠的是身份和用途门槛,而不是按价格排队。OpenAI 让任何肯付 500 美元月费的人都能拿到前沿速度,Anthropic 则不论你付多少钱都限制某些能力。两种策略背后,是对「前沿 AI 的风险在哪里、以及该由谁来承担管理它的成本」这两个问题的不同假设。
通缩的大宗品,通胀的前沿
Pro Max 的字符串出现在 ChatGPT 代码里的同一周,OpenAI 在市场的另一端降了价。9 月 22 日 —— 比 Anthropic 宣布 Opus 5.5 早了九十分钟 —— OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,API 成本相比上一代 GPT-5.6 腰斩。GPT-6 Sol 现在是每百万输入 token 2 美元、每百万输出 10 美元。GPT-6 Luna 降到每百万输入 0.10 美元、每百万输出 0.50 美元,低于市面上所有前沿级 API。OpenAI 把降价归因于缓存和推理效率的改善,并确认新价格没有有效期限制。
这两个同时发生的动作,揭示出一种有意为之的市场结构:大宗化的 AI —— 常规编程、摘要、分类 —— 正在向接近零的边际成本收敛;而能自主执行数小时的前沿 AI 则朝相反方向走。这种双速格局在科技市场上不算前所未有,但分岔的速度 —— OpenAI 在同一周把两极都推了一把 —— 说明这是一个结构性决定,而不是临时的价格调整。
DevDay 之前还没解决的问题
这些代码字符串确认了一个名字、一个价格和一句描述。它们没有确认用量上限会高于 200 美元 Pro 套餐已经提供的水平 —— TestingCatalog 明确指出,更高的额度「也可能包含在这个套餐里,不过目前还没被证实」。它们也没确认发布日期、模型标识或档位架构。OpenAI 的公开定价页至今仍列着六个套餐,里面没有 Pro Max。
这类泄露有一个很对口的先例。Tibor Blaho 在 2024 年 12 月发现了 200 美元 Pro 套餐的代码字符串,OpenAI 几小时内就公开宣布了它。9 月 29 日的 DevDay 是最早的合理官宣窗口,尽管并不保证一定会发。从已有证据能确定的是:OpenAI 第一次把一个消费级订阅档位写进了代码,而它的主要区别不在于你能拿到模型的多少,而在于你的工作跑得多快。这家公司需要在 DevDay 上、或者迟早需要解释清楚:500 美元这个价位,是对 Astra 发布所造成的算力紧缺的一次临时应对,还是前沿 AI 将来在最想要它的人之间如何分配的一种长期架构。