#AI
xAI 发布 Grok 4.7:便宜,但跑分落后
xAI 发布 Grok 4.7,官方称其为最强编码与知识工作模型,价格仍为每百万输入 $2、输出 $6。
第三方 Artificial Analysis 智能指数中它仅 46 分,Claude Fable 5.1 与 GPT-6 均为 53 分;而 xAI 官方表格的编码数字为 38.0%。
xAI 另称其在 DeepSWE v1.1 等测试上压过 Grok 4.6,选型时应自行核对榜单。
💡 为什么值得看定价低,但 agentic 编码落后,选型需权衡便宜与够用。
官方自测口径
- **价格**:Grok 4.7 与 4.6 同为 $2 / $6;GPT-5.6 Sol 为 $4 / $20。
- **CursorBench**:Grok 4.7 为 46.3%,Grok 4.6 为 40.4%,Fable 5.1 为 51.8%。
- **Terminal-Bench**:官方口径 Grok 4.7 为 38.0%,Grok 4.6 为 20.3%。
- **专业任务**:Harvey Legal Agent Benchmark 19.6%,高于 Grok 4.6 的 15.8%。
- **安全**:LatchBio 生物安全基准 62.4%;HackerBench 仅放行 3.3%。
上表为 xAI 官方口径,与第三方不一致。
查证
来源与可信度
孤证
· Grok 4.7 在 Artificial Analysis 智能指数得 46 分,Claude Fable 5.1 与 GPT-6 各为 53 分。
[2]
延伸阅读
Artificial Analysis 指数与 Terminal-Bench 的第三方数字和 xAI 官方表格并不一致,想看清差的来源值得对读两处。
官方把 CursorBench 4.0 的性价比当作主打卖点,附完整价格对照表,适合做选型时横向比价。