2026年7月24日,如果未来有人写AI编年史,这一天值得单独占一个章节。
黄仁勋在X上发了人生第一条帖子。Anthropic发布了Opus 5,性能接近Fable 5,价格只有一半。GPT-5.6 xHigh在Cerebras芯片上跑出750 tokens/s,下周就上线。GPT-6,也在路上了。
三件事在同一天发生,不是巧合。它们共同指向一个结论:AI产业正在经历一场深度分裂,不仅仅是技术路线的分裂,更是商业模式、治理哲学和竞争逻辑的分裂。
一、黄仁勋的X首发:一场精心策划的“开源保卫战”
7月24日,NVIDIA CEO黄仁勋在X上发布了人生第一条帖子。内容不是Blackwell芯片的出货量,不是季度财报的亮眼数字,而是一封致美国国会的公开信。他用的是刚注册不久的个人账号,第一条消息就震动了整个科技圈。
这封信由25家科技公司联署,包括NVIDIA、Microsoft、Meta、Palantir、IBM、CrowdStrike、Dell、Replit等。微软CEO萨提亚·纳德拉也在X上同步转发了这封信。信的核心诉求:保护开源权重(open-weight)AI模型,不要因为担心中国AI的追赶就对开放模型搞一刀切限制。
“AI将改变每一个行业,赋能每一家公司,被每一个国家建设。”黄仁勋在帖子里写道。这封信本身措辞克制,没有点名中国,也没有点名任何具体公司,而是强调“开源权重模型使先进AI更易获取、更可适应、更广泛可用”。
但所有人都知道,这封信的直接导火索是什么:一周前,中国AI公司Moonshot发布了Kimi K3开源权重模型,性能直逼OpenAI和Anthropic的顶级闭源产品。华盛顿的反应是迅速而激烈的,美国商务部官员公开表示要考虑限制中国开源AI模型在美国的流通。NVIDIA和Microsoft选择在这个时间点出手,意图再明显不过。
不过,真正值得关注的,不是这封信说了什么,而是谁没签字。
OpenAI没签。Anthropic没签。Google没签。Amazon没签。
这四家公司拥有全球最强的闭源AI模型。它们的缺席,把AI行业最深的裂痕暴露在了阳光下。
二、Opus 5:Anthropic的“价格屠刀”
同一天,Anthropic发布了Claude Opus 5。
这不是一个“更强”的模型,它是一个“更聪明”的模型。Anthropic在官方博客中表示,Opus 5在编码和知识工作任务评估中超越了Fable 5,那个两个月前被行业称为“地表最强”的模型。但在“高风险、双重用途能力”(如网络安全、生物研究)方面,它被刻意控制在Fable 5之下,以降低监管风险。
价格才是真正的炸弹。Opus 5的定价与Opus 4.8完全一致:每百万输入token 5美元,每百万输出token 25美元。但性能已接近Fable 5,后者作为Anthropic最贵的旗舰模型,定价远高于此。Anthropic坦承,Opus 5“以一半的价格提供了接近Fable 5前沿智能的性能”。
它还有一个让企业客户眼前一亮的功能:“努力旋钮”(effort dial)。用户可以在低、中、高三档之间调节模型完成任务的“努力程度”,从而精确控制token消耗。Fortune在报道中明确提到,这一功能的推出背景是“企业对昂贵AI账单的担忧日益加剧”。
这已经是Anthropic在不到两个月内发布的第四款模型,此前Mythos 5、Fable 5、Sonnet 5已经在6月密集登场。但Opus 5的定位最微妙:它不是旗舰,但它是“每个人都用得起的旗舰”。
三、GPT-5.6 xHigh和GPT-6:OpenAI的双线作战
同一天,OpenAI一方也有动静。
GPT-5.6 Sol的xHigh版本正在Cerebras芯片上运行,推理速度达到750 tokens/s。作为对比,GPT-5.5 XHigh的常规推理速度仅70到100 tokens/s。这意味着,Cerebras将推理吞吐量提升了7倍以上。Sam Altman此前承诺7月上线,KOL圈的消息是“下周就到”。
与此同时,GPT-6的脚步声越来越近。这个代号“Spud”的模型,早在2026年3月24日就在得克萨斯州Abilene的Stargate数据中心完成了预训练。Altman当时说“几周内”发布。现在四个多月过去了,行业对OpenAI的发布节奏开始产生质疑。但几乎所有信号都指向一个方向:GPT-6已经不远了。
OpenAI现在面临一个微妙的局面:GPT-5.6 Sol在Artificial Analysis Intelligence Index上拿到59分,仅比Anthropic Fable 5的60分低1分,在编码任务中耗时少61%、成本低一半。但“比Fable弱一点”的叙事,已经持续了一个多月。GPT-6是扭转这个局面的唯一机会。
四、分裂:三条战线同时开打
战线一:开源 vs 闭源
7月24日的联名信,把AI产业最深的裂痕摆上了台面。
一方是NVIDIA、Microsoft、Meta,它们依赖开源生态来扩大AI的“总盘子”。开源模型越多,需要的芯片越多,云服务越多。NVIDIA卖铲子,Microsoft卖云服务,Meta需要Llama维持生态影响力。开源是它们的商业引擎,也是它们对抗OpenAI和Anthropic闭源垄断的战略武器。
另一方是OpenAI和Anthropic,它们靠闭源模型的稀缺性构建护城河。如果最强的模型人人可以免费下载、自行部署,那API收入从何而来?安全风险谁来承担?OpenAI和Anthropic在联名信上的沉默,本身就是一种表态。
这封信的潜台词很清楚:NVIDIA和Microsoft在告诉华盛顿,别让中国AI吓到你们去搞封闭。开放的生态才是美国保持领先的方式。
战线二:性能竞赛正变成价格战
Opus 5是Anthropic对市场信号的一次精准回应。
Fable 5很强,但贵,且token消耗惊人。企业客户抱怨AI账单失控已经不是新闻,Fortune报道Opus 5时明确写道,该模型“推出背景是客户对AI开支的广泛担忧”。Opus 5的“努力旋钮”和半价定位,本质上是在说:我们听到了,我们调整了。
当AI能力开始趋同,Fable 5在Artificial Analysis Intelligence Index上60分,GPT-5.6 Sol 59分,Kimi K3 57分,Opus 4.8 56分,竞争的主战场正在从“谁更强”转向“谁更划算”。这不是一个短期的促销策略,而是AI商业化的结构性转变。
战线三:算力基础设施正在被重新定义
Cerebras在GPT-5.6 Sol上跑出750 tokens/s,这是一个信号。
传统GPU架构在推理场景中的效率瓶颈正在被打破。Cerebras的晶圆级芯片(Wafer-Scale Engine)在推理吞吐量上展现出代际优势。Cerebras正在为OpenAI的GPT-5.6 Sol提供推理服务,如果这条路径走向规模化,这意味着NVIDIA在AI芯片领域的垄断地位将出现一个真正的裂缝。
更有意思的是,Cerebras和AMD刚刚宣布合作,AMD的Helios AI系统将安装到Cerebras数据中心。算力供给侧的联盟正在重组。
五、这意味着什么
2026年7月24日,AI世界没有发生单一的重磅事件。它同时发生了三件事,每一件都在推动一个更大的趋势:AI产业正在从“发现时代”进入“效率时代”。
开源与闭源的决裂,不会在今天分出胜负。但价格战的硝烟,已经弥漫到每一个角落。当GPT-6最终落地,当Opus 5的“努力旋钮”成为行业标配,当Cerebras的推理速度改写游戏规则,那一年的7月24日,会被视为这一切的起点。
AI产业不再比谁跑得更快,而是比谁跑得更远。而跑得更远的方式,从来不是烧更多钱,而是让每一分钱都烧出响动。






快报