探所 Curio 再探再报 了解探所 →
#AI

消费级显卡可跑 Qwen3.8-27B,多项榜单反超 Claude

阿里 Qwen 开源新模型 **Qwen3.8-27B**,270 亿总参数,原生多模态、262K 原生上下文、最高扩展至 100 万 Token。官方榜单显示,它在 **SWE-bench Pro 上以 8.

3 分反超 Claude Opus 4.6 Max**,软件工程评测 QwenSWEBench 领先幅度拉到 15.2 分,长任务 Agent 的 CoWorkBench 也以 70.7 对 68.2 略胜。

💡 为什么值得看27B 参数在软件工程与 Agent 榜单反超 Opus 4.6 Max,24GB 显卡量化后能本地整卡跑。Qwen 以开源方式持续推出具竞争力的小尺寸模型。

查证

来源档案

量子位

中文 AI 科技媒体,报道基于官方 benchmark 数据与社区实测案例转述

榜单数字来自官方发布,可采信;但「反超 Claude」属单一来源的对照叙事,官方未回应对标口径,宜作待跟看待

延伸阅读

官方 benchmark 口径 · qbitai.com 3 分钟
文章列出的 SWE-bench Pro / QwenSWEBench / CoWorkBench 对比数字,可核对评测基准与 Claude 版本是否同口径
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store