2026年9月24日,一个定价数字在 AI 圈炸开了锅。科技追踪账号 TestingCatalog 爆料称,OpenAI 正在筹备一个名为 Pro Max 的 ChatGPT 订阅套餐,月费直指 500 美元。同一天,OpenAI 官方定价页面上,Free、Go、Plus、Pro、Business、Enterprise 六档排列整齐,第四档 Pro 的 200 美元已经比 Plus 贵了 10 倍,现在又一档要把这个天花板再向上捅 2.5 倍。
但真正耐人寻味的,不是 500 美元这个数字本身,而是它背后三重相互矛盾的信号:两周前,OpenAI 刚因算力告急暂停了 200 美元 Pro 套餐的新用户注册;与此同时,一个 5000 亿美元规模的超算基建项目 Stargate 正在全速铺开;距离即将到来的重磅发布日,9月29日 DevDay 2026,只剩下不到五天。一家因为算力紧缺而被迫收缩高端供应的公司,为什么要在同一个关口推出一款更贵、理论上更吃算力的套餐?
Pro Max 到底在卖什么
根据 TestingCatalog 的报道,Pro Max 与现有 Pro 套餐的核心区别集中体现在三个关键词上:Fastest Work、Codex 和 Cerebras。
Fastest Work 指向的是 ChatGPT Work 将以最快的推理速度运行。Codex 则是 OpenAI 2025 年推出的 AI 编程智能体,已直接杀入 Claude Code 和 GitHub Copilot 主导的开发者战场。而 Cerebras,这家以餐盘大小晶圆级芯片闻名的公司,已与 OpenAI 签署了超过 100 亿美元的算力供应协议,计划到 2028 年交付 750 兆瓦的推理算力。这个订单直接支撑了 Cerebras 2025 年 5.1 亿美元营收和高达 246 亿美元的订单积压。
但这三个词组合在一起,暴露了 Pro Max 的真实定位:它既不是 Plus 的用量翻倍,也不是 Pro 的狂飙模式。如果传闻属实,这是 OpenAI 第一次尝试按性能等级而非用量上限来分层定价。
回顾 OpenAI 的订阅定价演变史,逻辑一直是清晰的。20 美元的 Plus 给基础用量,100 美元的 Pro 给 5 倍 Codex 额度(2026年4月9日推出),200 美元的 Pro 20X 给 20 倍用量。每一档的区别是你用多少,而非你用多快。
Pro Max 打破了这条规律。如果最快的 Work 和 Codex 不是指更多额度,而是指优先分配算力资源、跑在更快的推理芯片上,那么 Pro Max 本质上是在说:钱不止能买量,还能买速度。这是一个全新的定价维度,把性能本身商品化。
把这条线索放在一个更紧凑的时间框架内看,矛盾感更加明显。9月3日,OpenAI 发布 GPT-6 Astra,Greg Brockman 称之为 AGI 时代。Astra 在 OSWorld 2.0 基准上拿到 72.6%,单任务耗时从 Sol 的 75 分钟降至 40 分钟,是第一代真正意义上的 Computer Use 模型。9月10日,OpenAI 产品负责人 Tibo Sottiaux 在 X 上发帖,称 Astra 上线后需求前所未有,200 美元 Pro 20X 用户的无限用量模式对推理集群造成了极大压力。同一天 OpenAI 官方确认,暂停 Pro 20X 的新增订阅和升级。9月24日,Pro Max 500 美元套餐传闻曝光。9月29日,OpenAI DevDay 2026 将在旧金山 Fort Mason 举行。
这条时间线的冲突感很强烈。一边因为算力紧缺而收缩供应,一边却计划推出更高价、理论上更吃算力的产品。中间的 DevDay,或许正是解开这个矛盾的关键。
算力的松紧带
要理解 Pro Max 的意图,先要看清 OpenAI 此刻面临的算力处境。2026年9月,OpenAI 正处于一个微妙的算力换挡期。其主力推理基础设施仍高度依赖微软 Azure 和自建的 NVIDIA GPU 集群。Stargate 项目,这个由 OpenAI、软银、甲骨文联合发起、计划投入 5000 亿美元的 AI 基建工程,要到 2026 年下半年才开始陆续交付新产能。加上 OpenAI 与 NVIDIA 签署的 10GW 系统订单、与 AMD 达成的 6GW 协议、与 Broadcom 合作部署的 10GW 定制芯片,大批产能仍在路上。
换句话说,OpenAI 此刻的算力供应处于旧的不够用、新的还没到的尴尬窗口。Astra 的爆发把这个窗口的裂缝撕得更大了。这是一款被 OpenAI 内部评为网络安全 Critical 等级的模型,其 Computer Use 特性需要模型长时间持续操控浏览器、编辑代码、运行终端,而非单次回答。这种长时任务场景对推理算力的消耗不是线性增长,而是指数级扩张,一个 Agent 会话可能持续数小时,消耗数十万 tokens。
CIO 援引 OpenAI 官方说明指出,200 美元 Pro 20X 套餐的暂停,直接原因是 Astra 上线带来的需求压力超出了当前容量。这不是营销饥饿,这是一个物理约束。
从按量定价到按级定价
Pro Max 与算力紧缺看似矛盾,实则是同一问题的不同解法。OpenAI 目前的定价体系有一个根本缺陷:200 美元 Pro 20X 的无限用量模式让重度用户拿到了算力自助餐的门票。在这个模式下,用户付固定月费,消耗弹性算力,一旦某个模型爆火,成本就会失控。Astra 上线后数天内,该套餐的推理负载就突破了容量红线。
这正是 Anthropic 在 Claude Max 上面临的同一个困境。2026 年 6 月,Anthropic 遭遇了一起拟议的集体诉讼,原告指控 Claude Max 20X 计划实际交付的使用量远低于宣传的 20 倍,有用户测算实际差额仅为 6 到 8 倍。诉讼的核心争议是:当推理成本不可预测时,X 倍用量的承诺究竟是什么含义?
整个 AI 行业都在摸索同一个根本问题:把推理作为订阅服务来卖,到底应该怎么定价?
Pro Max 给出了一种新的答案:把性能分级,让愿意多付钱的人跑得更快。这当然不是算力供应的解药,它不能凭空增加一颗 GPU。但它通过价格杠杆调节需求结构,把最贵的推理资源分配给支付意愿最高的用户。用更直白的方式说,当服务器不够用时,谁出价高,谁排队靠前。
DevDay 前的战略信号
Pro Max 传闻的出现时间,几乎不可能与 DevDay 无关。9月29日的 DevDay 2026 已被 TestingCatalog 提前剧透:Managed Agents 将成为核心发布内容。这个功能将允许用户在 ChatGPT 生态内创建和部署具有持久会话、工具调用和多智能体协调能力的 AI Agent,本质上就是把 Codex 背后的那一整套 Agent 基础设施,抽象成一个开发者可直接调用的产品。
如果 DevDay 的重磅发布确实是 Agent 平台,那么 Pro Max 的定位就水落石出了:它是为 Agent 重度用户量身定制的性能加速包。Agent 场景对推理速度极度敏感。一个慢 200 毫秒的模型在单次对话中几乎没有感觉,但在一个需要执行 50 步的自动化工作流中,累计延迟就是 10 秒。对于每天用 Agent 处理数百个任务的开发者来说,更快的推理速度直接兑现为更高的产出效率。500 美元的 Pro Max,它的目标用户群,也就是 Codex 和 Work 的重度用户,恰恰是 Agent 经济的先行采用者。
Cerebras 入场的真正含义
传闻中还有一个细节值得拆解:Pro Max 可能采用 Cerebras 基础设施提供支持。如果这一细节属实,其战略含义远超一次普通的技术供应商切换。
2026 年初,路透社首先报道了 OpenAI 与 Cerebras 签署超过 100 亿美元的算力供应协议。Cerebras CEO Andrew Feldman 称之为直接竞争胜利,暗示 OpenAI 的选择意味着对某条 NVIDIA 产品线的放弃。但更关键的差异在于芯片架构。Cerebras 的晶圆级芯片 WSE-3 的推理延迟远低于传统 GPU,在处理长序列推理和大模型持续推理方面具有结构性的速度优势。如果 Pro Max 将 Cerebras 的算力作为加速层暴露给高端用户,意味着 OpenAI 不仅在基础设施层面实施去 NVIDIA 中心化的战略,还在产品层面将这种架构优势直接货币化了。
这种硬件加速即服务的模式,翻开了 AI 云服务竞争的新篇章。博弈的重点不再是谁的模型更强,而是谁的基础设施跑得更快。
AI 订阅经济的第三阶段
500 美元的 Pro Max 套餐,如果最终落地,将标志着 AI 订阅经济进入第三个阶段。
第一阶段是 2023 到 2024 年的统一费率时代,每个月 20 美元,所有人用同一个模型、同一个速度。第二阶段是 2025 到 2026 年的按量分层时代,从 20 到 200 美元,用量倍数递增但体验无差异。Pro Max 所代表的第三阶段,开始引入速度、优先级、专属硬件等维度。这是一个从你有多少到你有多快的范式转换。
这个方向的影响远不止 OpenAI 一家。一旦跑得快成为一项需要付费才能享有的服务,整个 AI 行业的定价逻辑都将被重塑。Anthropic 被迫回应的 Claude Max 诉讼已经说明,这个行业的消费者保护红线也在同步升级。xAI 的 Grok、谷歌的 Gemini,每一个竞争对手都要选择:跟进分层加速,还是维持统一速度。
对于开发者而言,这意味着一个正在逼近的现实。免费用户用慢模型,Plus 用户用标准模型,Pro 用户用更多额度,而 Pro Max 用户用最快的模型、跑在最快的芯片上。每一毫秒的延迟差,都有一个对应的价格标签。AI 行业正在经历它自己的航空业时刻:经济舱、商务舱、头等舱,以及很快就要登场的私人喷气机。
在 AI 的世界里,最快的路,正在变得最贵。






快报