昨日深夜,DeepSeek V4 Pro正式版正式上线,主要通过API开放。根据官网API文档显示,“deepseek-v4-pro模型版本已更新为DeepSeek-V4-Pro-0813”。
同一天内,阿里Qwen3.8-Max(Qwen3.8-2.4T-A95B )宣布正式开源,马斯克旗下SpaceXAI推出了Grok 4.6,模型之争的节奏正变得越来越快,战场也从单一的参数比拼,转向了性能、成本、商业化与应用生态的综合较量。
![]()
DeepSeek V4 Pro是一款基于混合专家(MoE)模型,其总参数量高达1.6万亿,而在实际推理中,每个token仅需激活490亿参数,在保证强大性能的同时优化了计算效率。
该模型拥有100万token的上下文窗口,并支持最大38.4万token的输出长度,能够处理超长文本任务。在交互模式上,V4 Pro提供“思考模式”与“非思考模式”两种选项,其中思考模式为默认设置,便于应对复杂推理场景。
此外,V4 Pro延续了全面的生态兼容性,全面支持JSON结构化输出、Tool Calls、Responses API和Anthropic API等高级功能,旨在更好地服务于Agent和Coding场景。
对于开发者而言,本次更新无需修改现有模型名称,只需继续调用deepseek-v4-pro,即可自动使用最新版本,实现无缝升级。
在DeepSeek开展的相关测评中,相比预览版能力大幅提升,多项测试成绩接近甚至超越美国顶级模型Claude Fable 5,与Opus 4.8相比也毫不逊色。例如在Terminal Bench 2.1测试中得分87.9,远超预览版的72.1。
在外界关心的价格方面,此前DeepSeek就已预告“计划近期整体上调DeepSeek API服务价格,预计涨幅较大”。
目前V4 Pro定价是V4 Flash版本价格的3倍,具体为:输入(缓存未命中)3元/百万tokens,输出6元/百万tokens,缓存命中的输入则非常便宜,仅需0.025元/百万tokens。
值得一提的是,DeepSeek的权重依然是MIT许可证,正式版权重可能随后跟上。
(作者 | 杨丽,编辑 | 杨林)







快报
根据《网络安全法》实名制要求,请绑定手机号后发表评论