探所 Curio 再探再报 了解探所 →
#AI

Qwen 3.8 27B 评测达 52 分,比肩旗舰级大模型

Simon Willison 注意到,**Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上取得 52 分**,与 GPT-5.6 Luna (max) 打成平手,仅比 GLM-5.2 (max) 和 DeepSeek V4 Pro 0813 (max) 各低 1 分。

值得对比的是规模:那个 GLM 是 753B、DeepSeek 是 1.7T 参数,Luna 规模未披露但几乎肯定远大于 27B。一个 27B 小模型拿到同档分数,Willison 此前就称其为「真正令人惊叹的模型」。

💡 为什么值得看27B 小模型追平 5.6 旗舰,规模与性能的对比值得关注。

查证

来源档案

Simon Willison 博客

个人博客/链接帖,AI 领域一线独立研究者的观察与点评

分数与对比均转自 Artificial Analysis 官方评测页,Willison 本人是可信的行业观察者;但其「令人惊叹」属个人评价,非独立评测结论

延伸阅读

看 Artificial Analysis 原页 · simonwillison.net
Willison 的帖子只是链接帖,评分明细、九项评测构成与实际推理 token 开销需看官方评测页才能判断 52 分的含金量。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store