DeepSeek V4 Pro深夜上线:性能比肩国际顶流 定价策略与生态布局同步升级
人工智能领域的竞争愈发激烈,各大科技公司纷纷推出新模型以抢占市场先机。近日,DeepSeek正式上线了其V4 Pro正式版,该版本主要通过API对外开放。据官网API文档显示,此次更新的模型版本已命名为“DeepSeek-V4-Pro-0813”。
在同一天,阿里宣布开源其Qwen3.8-Max(Qwen3.8-2.4T-A95B)模型,而马斯克旗下的SpaceXAI也推出了Grok 4.6。这一系列动作表明,模型之间的竞争已不再局限于参数规模,而是扩展到了性能、成本、商业化以及应用生态等多个维度。
DeepSeek V4 Pro基于混合专家(MoE)架构,总参数量达到惊人的1.6万亿。然而,在实际推理过程中,每个token仅需激活490亿参数,这一设计在保证模型强大性能的同时,显著优化了计算效率。
该模型具备100万token的上下文窗口,并支持最长38.4万token的输出,使其能够轻松应对超长文本任务。在交互模式上,V4 Pro提供了“思考模式”和“非思考模式”两种选择,其中思考模式为默认设置,以更好地应对复杂推理场景。
为了更好地服务于Agent和Coding场景,V4 Pro延续了全面的生态兼容性,支持JSON结构化输出、Tool Calls、Responses API和Anthropic API等高级功能。对于开发者而言,此次更新无需修改现有模型名称,只需继续调用deepseek-v4-pro即可自动升级至最新版本。
在性能方面,DeepSeek开展的相关测评显示,V4 Pro相比预览版有了显著提升,多项测试成绩接近甚至超越了美国顶级模型Claude Fable 5,与Opus 4.8相比也毫不逊色。例如,在Terminal Bench 2.1测试中,V4 Pro得分87.9,远高于预览版的72.1。
价格方面,DeepSeek此前已预告计划上调API服务价格,且涨幅可能较大。目前,V4 Pro的定价是V4 Flash版本的三倍,具体为:输入(缓存未命中)3元/百万tokens,输出6元/百万tokens,而缓存命中的输入价格则低至0.025元/百万tokens。
值得一提的是,DeepSeek的权重依然采用MIT许可证,正式版权重有望随后跟进。这一举措为开发者提供了更大的灵活性和便利性。
