8月20日,一个代号Ox Alpha的AI模型悄悄出现在OpenRouter的模型列表里。没有发布会,没有创始人站台,没有任何公开的代码仓库。OpenRouter在描述中写了一句耐人寻味的话:由第三方提供商开发运营,在预览期间选择匿名。
不到48小时,这个“隐身模型”让整个AI圈的推理引擎全速运转起来。猜,到底是谁做的?
一个免费的空降兵,把开发者社区分成了几个阵营
Ox Alpha的规格并不低:100万token上下文窗口,支持文本、图像和视频输入,定位为“面向编码、持续Agent工作与生产负载的推理模型”。OpenRouter给它挂了一个“隐身模型”(stealth model)的标签,这是过去半年内该平台上出现的第五个匿名模型。此前的先例包括被广泛认为属于GPT-5系列的Horizon Alpha,以及后来被OpenRouter官方确认为Grok 4 Fast早期测试版的Sonoma系列。历史经验告诉人们,“隐身”往往只是一顶假胡子,只不过帽子下面的人每次都不一样。
但Ox Alpha的不同之处在于:它是免费的。OpenRouter声称其运营方可以提供每天高达100万亿token的吞吐能力。按市价折算,这是一笔天文数字般的算力储备。Stripe CEO Patrick Collison在X上亲自测试并评价:“It's very impressive。”考虑到Stripe在8月19日刚刚宣布以超过70亿美元收购OpenRouter,Collison的表态无疑给这个匿名模型增加了额外的分量。一个即将接管OpenRouter的人告诉全世界,这个匿名模型“令人印象深刻”。
随后,猜谜游戏开始了。开发者冲进门,分析师翻出指纹工具箱,整个社区在48小时内分裂成了几个互不信任的阵营。
指向中国:指纹证据最密集,但有个关键缺口
独立研究员Ben Davis在8月21日发布了一份详尽的技术指纹分析报告,声称有99%的把握相信Ox Alpha属于智谱AI(Z.ai)的GLM-5.x系列。证据来自多个维度:视频编码器行为(每秒147个token,与GLM 5V Turbo完全一致)、tokenizer对准精度、音频拒绝模式,乃至表情符号使用频率。四个独立的信号指向了同一个实验室。
智谱在8月14日发布了GLM-5.3,基于7430亿参数的MoE基座模型,定位同样是“面向编码与网络防御”,并将免费权重发布安排在安全审查之后。与Ox Alpha的描述高度吻合。Kingy.ai的分析师给出了一个措辞谨慎的评估:“高度确信Ox Alpha属于GLM-5.x家族,但对‘GLM-5.3 Flash’这个确切名称的信心较低。”
但有一个关键缺口。官方发布的GLM-5.3是一个纯文本模型,而Ox Alpha明确支持图像和视频输入。智谱是否在不到一周内推出了一款未经公布的“Flash版”多模态变体?AI分析师Andrew Curran在周五的X帖子中捕捉到了社区情绪的微妙转变:“最初的猜测都聚焦在智谱的GLM模型上,但今早人们似乎对什么都不那么确定了。”
微软MAI:另一个影子嫌疑
Wccftech的报道在最初指向GLM之后,随后更新了一个新猜测:Ox Alpha可能是微软MAI的未发布版本。微软的MAI项目始终笼罩在神秘之中,但市场传闻其定位同样是“面向编码和生产负载的高性能推理模型”。如果Ox Alpha出自微软之手,那么“匿名发布”的逻辑就清晰了:微软可以借此在不暴露品牌的情况下测试模型在真实场景中的表现,同时避免因正式发布带来的舆论压力和定价承诺。
而Stripe刚刚收购了OpenRouter。微软与OpenRouter之间是否存在某种未公开的合作关系?这是一个值得追问的方向,尽管目前没有任何公开证据支撑这一点。但值得注意的是,Azure是OpenRouter最大的算力提供商之一,这种基础设施层面的深度绑定,使得“通过OpenRouter测试匿名模型”对微软来说几乎没有额外的技术成本。
编码赛道,大模型战争的“新凡尔登”
Ox Alpha的性能数据被社区反复争论。Ben Davis最初在10个任务的DeepSWE子集上测得约80%的Pass@1,超过Claude Fable(65%)和GPT-5.6 Sol(52%)。但这个数字很快被证伪。研究者Henry Zhang在完整的113任务DeepSWE基准上重新测试后公布:实际得分为58.4%,与Claude Opus 4.8(59%)处于同一水平。Ben Davis本人随后也更新了结果,修正为约63%。
这场数据争论本身揭示了一个更结构性的信号:Ox Alpha的定位完全聚焦编码和Agent工作。这不是巧合。从GitHub Copilot到Cursor再到Devin,AI编码工具的争夺已经白热化。任何一个有野心的大模型实验室,都必须在这个赛道上拿出过硬的产品。匿名发布既能通过社区的真实编码测试来验证模型能力,又能避免在正式发布前暴露弱点。
独立分析估算Ox Alpha约为7440亿参数MoE架构,其中约400亿参数被激活(active)。40B激活参数对应每天100万亿token的吞吐量承诺,在技术和经济层面都是可解释的。这暗示了它的架构路线:不是单纯拼参数数量,而是在推理效率上做了深入优化。
“隐身模式”正在成为AI行业的标准化策略
Ox Alpha是OpenRouter上半年内第五个隐身模型。这个模式已经成熟到可以被称为“策略”了:匿名发布,社区猜测,病毒式传播,收集真实用户反馈,择机揭晓身份。它精准地利用了人的猜谜心理,把一次普通的产品发布变成了全网话题。从品牌营销角度来看,这比任何盛大的发布会都更高效。而且成本更低,不仅省去了发布会的预算,还免费获得了一个社区规模的QA团队。
过去六个月的记录证明了这一点。Pony Alpha最终被确认是智谱的GLM-5。Hunter Alpha是小米的MiMo V2 Pro。Elephant Alpha来自蚂蚁集团。Owl Alpha是美团的LongCat-2.0。Sonoma系列被OpenRouter官方标记为Grok 4 Fast的早期测试版。每一次“隐身”最终都被揭晓,但每一次揭晓之前,模型已经完成了数万亿token的真实流量测试。
但Ox Alpha把这个模式推到了一个新高度:每天100万亿token的免费推理,远超此前任何隐身模型的开局规模。这不再只是一个“市场测试”,而是一场精心策划的算力投放。
猜谜背后:三个比答案更重要的信号
无论Ox Alpha的最终身份是什么,这个事件本身已经揭示了三个更深层的产业趋势。
算力的“匿名化供给”正在成为可能。 每天100万亿token的免费推理能力,意味着某个组织拥有极强的算力冗余,并且愿意用它来打一场“市场测试战”。这种策略在传统AI行业并不常见。大模型发布通常伴随着盛大的发布仪式和PR攻势,像Ox Alpha这样“扔出来就跑”的做法,更像是互联网早期beta版文化的回归。只不过这一次,beta测试的对象是全球最顶级的开发者。
编码赛道是整个AI产业的风向标。 Ox Alpha、GLM-5.3、Grok Code Fast、Cursor的迅速崛起,共同指向一个事实:AI编码工具正在成为大模型商业化的第一变现通道。谁在这个赛道上失去位置,谁就可能在下一个Agent时代的入口被淘汰。
“身份可否认”正在成为AI巨头的战略资产。 发布的模型可以被否认,测试的数据可以不认账,社区的反馈可以白嫖。这种“可否认的发布”(deniable release)模式,让传统意义上的“产品发布”定义正在被改写。它模糊了测试与商用的边界,也模糊了竞争与合作之间的那条线。
答案也许不重要了
那么,Ox Alpha到底是谁?
如果它来自智谱,这意味着中国AI的出海策略正从“产品输出”升级为“能力渗透”。在此之前,中国大模型的出海主要通过API接口(如DeepSeek)、开源模型(如Qwen)或项目合作。匿名隐身模式提供了一个全新的、更微妙的路径:不暴露来源,让能力自己说话。在美国对华AI出口管制持续收紧的背景下,这是一种聪明的风险对冲。
如果它来自微软,则意味着科技巨头之间的“影子战争”已经从后台走向前台。通过一个看似独立的中立平台发布自己的模型,收集竞争情报,测试市场反应,而不需要承担品牌风险。在AI军备竞赛中,信息本身就是武器,而匿名模型是最完美的情报收集器。
还有一种可能:它不属于任何已知玩家。也许是一个从未被公众关注过的实验室,在用这种方式宣告入场。AI行业的格局远未固化,新的黑马随时可能从暗处杀出。
无论Ox Alpha的创作者最终是谁,这个事件留下的追问比答案本身更刺眼:当最强大的模型选择隐身出现,AI行业所谓的透明竞争,还剩下多少真实?
猜谜终会结束。但隐身发布作为武器,不会消失。






快报