#AI
Grok 4.6 跑分反超 GPT-5.6 Sol
SpaceXAI 发布 Grok 4.6,在 GDPVal-AA v2 上以 1753 分反超 GPT-5.6 Sol(1728 分)和 Fable 5 Max(1741 分),并在 AA-Briefcase、Harvey LAB 两项夺第一。综合智力指数 61 分,与 GPT-5.6 Sol 持平,仅比 Fable 5 Max 低 1 分。
定价策略是内核武器:输入 $2 / 百万 token,输出 $6 / 百万 token,显着低于 GPT-5.6 Sol Max 和 Claude Opus 5。但小字条款注明,单次请求上下文超 20 万 token 时定价翻倍至 $4 / $12,且整条请求按高价结算,翻倍后仍具价格优势。
💡 为什么值得看低价加长程 agent 强项,SpaceXAI 第一套组合拳落地,直接压 API 采购成本。
查证
来源档案
量子位
xAI 官方发布 Grok-4.6 及 Grok Bot,本报道为二手集成,非一手公告。
消息称可对应官方一手源,benchmark 与定价有博客支撑;但「反超」「重回一梯队」为媒体判断,需回 xAI 官方核对。
延伸阅读
建议直接上 x.ai/news/grok-4-6 看完整 10 项基准原表与定价细则,媒体复盘只挑了关键项