你很难想象一个 AI 检测模型能“听”出市场格局。但 Pangram 确实做到了。
2026年8月,AI 文本检测公司 Pangram Labs 发布了一项引人注目的研究。他们利用自家旗舰模型 Pangram 3.3.2 的内部表征能力,对过去两年间用户提交到其平台的海量匿名文本进行分类预测。不是判断“是人写的还是AI写的”,而是判断“是哪个AI写的”。
结果是一张独特的 AI 大模型市场份额演变图。它没有调查问卷,不依赖财报数据,也不靠爬虫统计流量。它只是“听”文本的声音,然后告诉你:谁在用,谁在退,谁在悄然崛起。
这张图呈现了三个清晰的趋势。
OpenAI 的消费者堡垒
在 Pangram 的整个数据历史中,OpenAI 的模型从未在任何一个月的提交份额中低于50%。从2024年 Pangram 上线至今,GPT 系列和 ChatGPT 的生成文本始终占据着平台提交量的一半以上。这与传统认知高度吻合,ChatGPT 仍然是消费者端最大的 AI 提供商。
根据 Similarweb 的数据,ChatGPT 的全球网页流量份额从2025年1月的87%下降至2026年1月的64%,但绝对流量仍在增长,从38亿次月访问量增长到57亿次。ChatGPT 在2026年3月已拥有超过9亿周活跃用户和超过5000万付费订阅用户,这是任何竞争对手短期内无法企及的量级。
Anthropic 在悄悄追赶
更值得关注的变化发生在第二名的争夺中。Pangram 数据显示,2024年 Anthropic 的 Claude 系列在其平台上的提交份额仅为4.3%。到2026年7月,这一数字已跃升至14.9%,两年间翻了三倍多。
Claude 在技术和科学社区中的口碑正在化为实实在在的使用量增长。在 OpenRouter 平台上,Anthropic 的份额曾一度达到29.1%,尽管后来受到中国开源模型的冲击回落至13.3%。在企业端,根据 Menlo Ventures 2025年12月发布的报告,Anthropic 的份额已升至企业LLM支出的40%,超过 OpenAI 的27%和 Google 的21%。在编程这一关键赛道上,Anthropic 以估计54%的份额遥遥领先于 OpenAI 的21%。
Ramp 平台的数据同样印证了这一趋势。美国企业用户中,为 Anthropic 付费的比例从2025年4月的7.94%飙升至2026年3月的30.6%,同期 OpenAI 为35.2%。两者的差距从近30个百分点缩小到不足5个百分点。
Gemini 的崩塌
最剧烈的变化来自 Google。Pangram 数据中,2024年 Gemini 系列模型的提交份额约为12%,尚能与 Anthropic 一较高下。但到2026年7月,这个数字已经暴跌至1.9%。
从12%到1.9%,这不是份额的“被蚕食”,而是近乎“被抛弃”。
原因可能不止一个。Google 的消费者 AI 产品线过于分散。Gemini 聊天机器人、Google Workspace 中的 AI 功能、Pixel 手机中的 AI 助手、Google 搜索中的 AI Overviews,用户可能在使用 Google 的 AI 能力,但并不知道自己“正在使用 Gemini”。这在品牌认知上是个致命问题。在纯粹的大语言模型能力上,Gemini 在消费者端的差异化优势越来越模糊。当 ChatGPT 在每次更新中不断强化免费层的功能,Claude 在编程和长文本处理上建立口碑,DeepSeek 等中国开源模型在性价比上发起冲击时,Gemini 的“中间位置”变得越来越尴尬。它不够特别,不够便宜,也不够开放。
值得注意的是,这些数据并非孤例。Pangram 将自己的数据与 OpenRouter 的平台数据进行了对比,两份数据的采样机制完全不同。Pangram 的数据来自用户主动提交检测的文本,偏向消费者端;OpenRouter 的数据来自开发者的 API 调用,偏向技术用户。但在这两份数据中,Google 的衰退趋势是一致的。正如 Pangram 创始工程师 Elyas Masrour 在文章中所写:“尽管采样机制截然不同,但 Google 流量下降的趋势在两个数据集中都清晰可见。”
两份数据,同一个信号
Pangram 的方法论独特之处在于其“非介入性”。传统市场调研依赖问卷、财报或流量统计,每一条都有各自的偏差。Pangram 的方法则不同。它不询问用户“你用什么模型”,也不统计 API 调用量,而是对用户提交的文本进行“逆向溯源”。
原理来自 Pangram 此前发布的研究“Seeing in Pangram Space”。研究发现,Pangram 3.3.2 模型在其内部表征空间中,能够通过线性探针区分不同模型家族生成的文本。单条文本的 top-1 准确率为91%。在聚合统计下,这种区分能力足以揭示长期趋势。
当然,Pangram 的数据也有自己的偏差。用户主动提交给 AI 检测工具的文本,天然倾向于那些“让人怀疑是AI写的”内容,而非所有 AI 生成文本的均匀采样。但正是这种偏差,反而让数据有了独特的解读价值。它反映的是“被怀疑的 AI 文本”的分布,也就是消费者端最活跃的 AI 使用场景。
消费者端与企业端的分裂
当几乎所有其他数据源都在讲述“OpenAI 份额在下降”的故事时,ChatGPT 的网页流量份额从87%降至64%,企业市场份额从50%降至约27%,Pangram 的数据却显示 OpenAI 在消费者端从未跌破50%。
这揭示了一个关键事实。消费者端和企业端正在走向分裂。
在企业市场,Anthropic 凭借 Claude Code 在编程领域的绝对优势和更强的安全合规能力,已经实现了对 OpenAI 的超越。但在消费者端,ChatGPT 的品牌认知度、先发优势和易用性构成了一道难以逾越的护城河。93%的财富500强公司使用 OpenAI 产品(截至2025年底),但更重要的是,ChatGPT 已经成为“AI”这个词本身在消费者心智中的等价物。9亿周活跃用户、5000万付费用户,这些数字说明 OpenAI 的消费者基本盘远未动摇。
Anthropic 从4.3%到14.9%的增长,背后是一个关于“口碑裂变”的故事。Claude 在技术社区中的高认可度,尤其是 Claude Code 在编程领域的统治力,正在向更广泛的消费者用户群体渗透。这种增长模式不是靠铺天盖地的广告投放,而是靠技术精英圈层的口碑传播,逐渐渗透到更广泛的用户群体中。Anthropic 的消费者端份额从4.3%到14.9%用了两年,企业端从12%到40%也只用了两年。两条曲线在同步爬升,但消费者的转化速度略慢于企业。这符合“技术精英→企业用户→大众消费者”的扩散规律。
而 Google 的处境则最为尴尬。在消费者端,Gemini 的 Pangram 份额跌至1.9%。在企业端,尽管 Google 的份额从2023年的7%增长到2025年的21%,但这主要得益于其庞大的云基础设施和现有客户关系,而非 Gemini 本身的品牌号召力。Google 拥有最好的 AI 基础设施之一,但在消费者 AI 品牌战中,它正在输给每一个对手。
AI 市场的格局正在被重新定义
把 Pangram 的数据与 Menlo Ventures、Similarweb、Ramp 等多源数据放在一起,一个更完整的画面浮现出来。
消费者端,OpenAI 依然是一座难以攻克的堡垒,但 Anthropic 正在从边缘渗透。企业端,格局已经彻底改写,Anthropic 在编程和合规场景中建立起了坚实的领导地位。而 Google,无论是在消费者端还是企业端,都面临着身份认同危机。它的 AI 能力无处不在,但品牌认知度却始终无法转化为市场份额。
Pangram 的方法论为行业提供了一个全新的观测维度。它不是要取代传统数据源,而是提供了一个独立的、非介入性的验证视角。当两份采样机制截然不同的数据都指向同一个趋势时,这个趋势的可靠性就大大增加了。随着 Pangram 模型对生成模型分类精度的持续提升,这项技术未来可能成为一个重要的行业晴雨表。
当 AI 检测模型能够精确区分不同模型、不同版本甚至不同微调方式生成的文本时,我们能获得的产业洞察将远超今天。
把 AI 检测模型变成市场情报工具,Pangram 无意中打造了一面镜子。这面镜子照出的不只是谁在写,更是谁在赢。






快报