AI大模型激战正酣!DeepSeek V4 Pro与Grok 4.6同日发布,性价比与性能双比拼
AI大模型领域迎来新一轮激烈竞争,DeepSeek V4 Pro与Grok 4.6同日发布,两款模型在性能与成本上均展现出对行业标杆Claude Fable 5的追赶态势。这场技术迭代浪潮距离Fable 5的发布仅过去两个月,再次印证了人工智能领域的快速发展节奏。
DeepSeek V4 Pro的定价策略延续了品牌一贯的性价比路线,但不同场景下的成本差异引发关注。其缓存命中费用为每百万token 0.025元,未命中输入输出费用分别达3元和6元。与同品牌Flash版本相比,未命中场景成本高出近三倍,但与Fable 5每百万输入输出10美元和50美元的定价相比,V4 Pro的换算价格仅为0.43美元和0.87美元,缓存命中输入成本差距更达276倍。不过品牌方已透露近期将启动价格调整机制。
在性能测试中,V4 Pro展现出不俗实力。Terminal Bench 2.1终端环境测试得分87.9,与Kimi K3的88.3、Fable 5的88.0形成三足鼎立;跨行业专业工作测试Agents’ Last Exam取得25.7分,与Opus 4.8持平;内部高难度编码测试DSBench-Hard得67.2分,虽落后Opus 4.8的71.7分,但考虑到测试集未完全公开,该数据仅作参考。该模型当前主要短板在于缺乏多模态支持,且处理速度有待提升。
Grok 4.6的升级则聚焦于后训练优化,通过强化监督微调(SFT)与强化学习(RL)技术,显著提升了长程代理能力、多步推理及交互视觉任务处理水平。尽管上下文窗口仍维持在500k规模,但实际开发测试显示其运行速度优势明显——某开发者实测中,Grok 4.6完成三个任务时,DeepSeek V4 Pro仅处理完首个任务。在GDPval-AA v2、³-Banking等专业评估中,该模型表现超越Claude Opus 5等竞品。
定价方面,Grok 4.6保持每百万输入2美元、输出6美元的原有标准,虽不及DeepSeek的极致性价比,但仍比Opus 5、GPT-5.6 Sol等版本更具价格优势,甚至低于Sonnet 5的定价体系。马斯克在社交平台放言,预计3至4周后发布的Grok 4.7将实现全面超越,这一表态为市场竞争增添新的变数。
行业观察者指出,当前AI大模型已进入性能快速迭代与成本持续优化的双重轨道。两个月前还令业界惊叹的Fable 5,如今已面临多个追赶者的直接挑战。这种技术跃迁速度对开发者而言既是机遇也是考验——如何在频繁更新的技术生态中保持竞争力,将成为新的课题。
