#AI
Qwen 3.8 27B 评测达 52 分,比肩旗舰级大模型
Simon Willison 注意到,**Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上取得 52 分**,与 GPT-5.6 Luna (max) 打成平手,仅比 GLM-5.2 (max) 和 DeepSeek V4 Pro 0813 (max) 各低 1 分。
值得对比的是规模:那个 GLM 是 753B、DeepSeek 是 1.7T 参数,Luna 规模未披露但几乎肯定远大于 27B。一个 27B 小模型拿到同档分数,Willison 此前就称其为「真正令人惊叹的模型」。
💡 为什么值得看27B 小模型追平 5.6 旗舰,规模与性能的对比值得关注。
查证
来源档案
Simon Willison 博客
个人博客/链接帖,AI 领域一线独立研究者的观察与点评
分数与对比均转自 Artificial Analysis 官方评测页,Willison 本人是可信的行业观察者;但其「令人惊叹」属个人评价,非独立评测结论
延伸阅读
Willison 的帖子只是链接帖,评分明细、九项评测构成与实际推理 token 开销需看官方评测页才能判断 52 分的含金量。