#AI
Muse Spark 1.3 编程跑分反超 GPT-5.6
Meta 的 Muse Spark 1.3 在 DeepSWE v1.1 编程跑分上拿到 **75.4 分**,反超 GPT-5.6 Sol 与 Claude Opus 5。这是 Meta 闭源旗舰 Muse Spark 系列的一次评测信号,显示其在编码能力上的进步。
但同一评测中,它在**三项智能体测试**上全线排在对手后面。评测方的判断是,Meta 把资源押在了编码这条最容易被开发者尽快感知的赛道上,而非 agent 综合能力。
💡 为什么值得看编码赛道胜出,但智能体落后,影响 AI 格局。
查证
来源档案
Cocoloop
中文科技聚合站点的标签页,转载自有评测/媒体稿,非一手官方发布
单一媒体来源,未显示官方确认或独立第三方基准对照;具体分数与排名需以 DeepSWE 官方榜单或 Meta 公告为准
延伸阅读
编程单点反超、智能体全面落后的对比,值得看 Meta 在 agent 能力上的取舍与短板。