SpaceXAI 发布了 Grok 4.6,价格与 Grok 4.5 相同。

SpaceXAI 推出了 Grok 4.6,其在人工智能分析指数 (AII) 上的得分与 GPT-5.6 Sol 持平,均为 61 分,同时保持了与 Grok 4.5 相同的定价,即每百万个输入代币 2 美元,以及 6 美元……
@SpaceXAI Grok 发布了其最新的前沿语言模型 Grok 4.6,定价与前代 Grok 4.5 相同。该版本于周三正式上线,用户可立即通过 Cursor、Grok Build 和 API 使用该模型。OpenRouter、Vercel 和 Cloudflare 等第三方基础设施提供商也已开始支持该模型。
价格和供货情况
标准版的定价为每百万输入代币 2 美元,每百万输出代币 6 美元,高速版的价格是标准版的两倍。这与 Grok 4.5 的定价结构相同,这意味着开发者可以升级到新版本而无需承担任何额外费用。Grok 4.6 也已集成到 Cursor 和 Grok Build 中,并在发布的第一周提供双倍的使用配额。
基准指标:全面提升,但仍存在一些差距
Grok 4.6 在 Grok 4.5 的基础上进行了扩展,特别注重长时间运行的代理以及更具雄心的交互式和可视化工作,能够处理跨越多个步骤的复杂任务,无论是研究某个主题、分析信息,还是跨代码库工作。
根据 @SpaceXAI根据其自身的基准测试数据,该模型在所有十项评估中均优于 Grok 4.5。Grok 4.6 在多个智能体编码和知识工作基准测试中达到了前沿智能水平,在人工智能分析智能指数(AAI)上与 GPT-5.6 Sol 持平,该指数是九项基准测试的综合得分。这两个模型在该指数上的得分均为 61 分。作为参考,GPT-5.6 Sol(最高分)此前在该指数上的得分为 61 分,而 Grok 4.5(高分)的得分为 56 分。
xAI表示,该模型进行了更长时间的补充训练,重新生成了监督式微调轨迹,并在编码、Web开发、CAD和内核优化等领域进行了智能体强化学习。该公司还报告称,在执行更长时间的任务时,模型进行了更多的自我测试和验证。
然而,情况并非完全乐观。在人工智能分析智能指数(AII)中,Grok 4.6 的得分为 61 分,与 GPT-5.6 Sol 的最高推理水平持平,但比 Fable 5 Max 低 1 分。在 DeepSWE 和 Terminal-Bench 这两项要求更高的智能体编码评估测试中,该模型的表现也逊于 GPT-5.6 和 Fable 5。以上结果由公司发布,独立的第三方验证仍在进行中。
发布会仍在继续 @SpaceXAI2026 年将推出快速模型,更大的 2.1 万亿参数 Grok 4.7 计划在几周后推出。
来源:
SpaceXAI:推出 Grok 4.6(官方公告)
人工智能分析:GPT-5.6 Sol 与 Grok 4.5 智能指数对比
9to5Mac:SpaceXAI 发布 Grok 4.6


