Grok 4.6正式登场:强化复杂任务处理能力,多项测试达前沿水平
人工智能领域迎来新进展,Grok 4.6 正式亮相。这款新模型在延续前代版本优势的基础上,针对长时间运行的智能体任务以及复杂交互与视觉工作进行了深度优化,展现出更强大的处理能力。
在任务处理方面,Grok 4.6 具备持续处理复杂任务的能力,这些任务往往包含大量步骤。无论是资料研究、信息分析,还是处理大型代码库,甚至将产品构想转化为完整的应用或工作成果,它都能应对自如。例如,在面对陌生的研究领域时,它可以深入研究相关资料,规划出合理的应用结构,实现核心交互功能,并根据多轮反馈不断完善结果,将宽泛的产品构想转化为可运行的初版。
基准测试成绩是衡量模型性能的重要指标。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上,Grok 4.6 表现出色,与 GPT - 5.6 Sol 取得了相同的成绩,在多项智能体编程和知识工作测试中达到了前沿水平,这充分证明了其在智能领域的强大竞争力。
在实际项目测试中,Grok 4.6 重点接受了长流程、多步骤任务的考验。结果显示,它在更长的任务流程中表现出更多自主测试和验证行为,会在继续执行任务前检查已经完成的工作,确保任务的准确性和完整性。在视觉和交互式项目方面,与 Grok 4.5 相比,其初版成果也有显著提升。面对明确的产品构想,它可以一次性建立应用的基本结构和视觉语言,大大提高了开发效率。
安全始终是人工智能发展的重要考量。Grok 4.6 根据扩展后的模型能力对安全防护机制进行了调整。此次安全评估规模为历来最大,覆盖了部署前能力测试、安全防护校准以及部署后和第三方测试等多个环节。安全体系面向漏洞修补、工程设计和 AI 研究等合法使用场景,在提高实用性的同时有效控制了安全风险。
在应用推广方面,Grok 4.6 已在 Cursor 和 Grok Build 上线。为了回馈用户,首周这两项服务将向用户提供两倍的内含使用额度。它还通过 API 开放,并登陆了 OpenRouter、Vercel 和 Cloudflare 等合作平台。在价格方面,每 100 万个输入 Token 收费 2 美元(现汇率约合 13.5 元人民币),每 100 万个输出 Token 收费 6 美元(现汇率约合 40.6 元人民币),速度更快的版本价格为普通版本的两倍。
