探所 Curio 再探再报 了解探所 →
#AI

Anthropic 发布 Claude Sonnet 5

6 月 30 日,Anthropic 正式发布 **Claude Sonnet 5**,将其定位为“最具自主代理能力的 Sonnet 模型”。模型能制定计划、使用浏览器和终端,并以几个月前还需要更大、更昂贵模型才能达到的水平自主运行。多家独立报道证实,性能已逼近 **Opus 4.8**,但价格大幅降低。基准测试显示,Sonnet 5 在 SWE-Bench Pro 上取得 63.2%,较前代 4.6 的 58.1% 明显提升,仍低于 Opus 的 69.2%;但在终端工程 Terminal-Bench 2.1 中从 67.0% 跃至 80.4%,已反超 Opus;知识工作 Elo 评分从 1395 升至 1618,接近旗舰。安全评估方面,不良行为率下降,网络安全能力远低于 Opus 模型。即日起,Sonnet 5 成为 Free/Pro 默认模型,Claude Code 和 API 同步可用。即日至 8 月 31 日促销价为每百万 token 输入 2 美元、输出 10 美元;9 月 1 日起恢复标准价 3/15 美元。值得注意的是,新版本采用了新分词器,相同输入文本产生的 token 数比 4.6 多约 30%,实际推理成本比表面价格高约 30%。

💡 为什么值得看中价位模型首次获得接近旗舰的自主代理能力,首月优惠定价,将直接降低 AI 编程和智能体开发者的成本。

查证

来源与可信度

· Claude 官方与博客一致宣称 Sonnet 5 为“最自主代理的 Sonnet”,确认度高。 [1]
· 第二条推文确认向所有 Claude 用户和 API 推出,表明已全面可用。 [2]
孤证 · OpenRouter 上架迹象(slug 20260630)来自同一来源,早于官方推出,属于先行信号。 [3]

延伸阅读

官方公告 · x.com 约 10 分钟
Anthropic 博客提供完整基准测试与安全评估表格
发布细节 · x.com 约 2 分钟
确认全平台可用,包括 Free/Pro 默认
API 入口 · x.com 约 5 分钟
OpenRouter 上架信息,可试用 API 定价和调用
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store