DeepSeek V4 Pro正式版低调上线:性能直追Fable 5,与Grok 4.6同台竞技
人工智能领域近期迎来重要动态,DeepSeek与SpaceXAI旗下Grok两大模型几乎同步更新,引发行业高度关注。DeepSeek V4 Pro正式版通过API低调上线,而SpaceXAI则高调发布Grok 4.6,两款主打高性价比的模型同时向行业第一梯队发起冲击,标志着AI大模型竞争进入新阶段。
DeepSeek官网显示,其API文档已完成更新,模型版本从V4-Pro预览版切换为DeepSeek-V4-Pro-0813。新版本支持1M上下文、最高384K输出,并兼容JSON Output、Tool Calls等五种功能。尽管官方尚未发布正式更新日志,但"首次调用API"页面已开放新模型调用示例,显示其已具备实际服务能力。值得注意的是,此次更新未伴随价格调整,当前输入输出价格仍维持在每百万Token 3元和6元的水平。
性能提升成为此次更新的核心亮点。据科技媒体引用的评测对比表显示,DeepSeek-V4-Pro-0813在多项智能体测试中表现接近Anthropic的Claude Fable 5,部分指标甚至实现超越。与传统大模型侧重知识问答不同,此次测试重点考察代码编写、多步骤任务执行等实际工作能力。这印证了DeepSeek自4月发布V4预览版以来,持续在智能体方向的技术积累——该版本当时已在Agentic Coding评测中达到开源模型领先水平。
价格策略暗藏玄机。虽然当前版本维持原价,但DeepSeek官网已明确预告"不久的将来将大幅上调API服务价格"。这种"先升级后涨价"的策略,既为开发者提供了性能提升的过渡期,也反映出算力成本与商业化压力。此前该模型已将价格永久下调至首发价的四分之一,此次更新后能否维持性价比优势将成为市场观察重点。
SpaceXAI选择的发布时机颇具策略性。Grok 4.6在DeepSeek更新前数小时亮相,其性能表现同样亮眼:在面向真实世界专业知识工作的评估中取得1753 Elo评分,超越GPT-5.6 Sol Max和Claude Fable 5。更引人注目的是其定价策略——每百万输入Token 2美元、输出6美元,仅为其他前沿模型的一半。这种"性能追赶+价格腰斩"的组合拳,直接冲击现有市场格局。
智能体能力成为竞争新焦点。DeepSeek V4系列从预览版开始就强调工具调用和代码工程能力,7月发布的V4 Flash正式版更在多项智能体基准测试中超越预览版。此次V4 Pro正式版进一步缩小与顶级闭源模型的差距,显示其战略重心已从"通用大模型"转向"智能体基础模型"。Grok 4.6同样将复杂编程和知识工作作为核心卖点,并在开发者入口提供直接服务,印证了行业对AI应用落地的共同判断。
这场"撞车式"更新折射出AI竞争的深层转变。当模型性能逐渐趋近,价格优势与开发者生态成为新的决胜因素。OpenAI、Anthropic等传统头部厂商面临的压力,不仅来自评测分数,更在于市场对"性价比"的重新评估——当性能差距缩小至可接受范围,开发者为何要为更贵的模型支付数倍成本?这种竞争逻辑的转变,或将重塑整个AI大模型市场的格局。
