探所 Curio 再探再报 了解探所 →
#AI

阿里开源 Qwen3.8-27B,家用显卡可跑

阿里 Qwen 团队正式开源 **Qwen3.8-27B**,以 Apache 2.0 协议开放权重,免费商用。官方定调明确:27B 是全球社区呼声最高的尺寸,这次的目标是把部署便捷、快且实用的模型送到「家用显卡」上。

这是一个**原生多模态稠密模型**,同时接受文本、图片和视频输入,实际参数约 27.78B。上下文窗口原生 262K,经 YaRN 技术可外推至 1M tokens。相比上一代 Qwen3.6-27B,编程与 Agent 能力提升显着:Terminal-Bench 2.1 从 63.4 涨到 73.0,DeepSWE 1.1 从 13.3 跃升至 42.2,OSWorld-Verified 从 63.9 到 84.3。官方称整体表现已超越 Qwen3.7-Plus。

💡 为什么值得看27B 稠密多模态模型以 Apache 2.0 商用免费开放,编程与 Agent 指标大幅超上一代,本地部署门槛再降。

本地部署要点

  • **模型规格**:27B 稠密架构,64 层,支持图像与视频输入,原生 262K 上下文,YaRN 外推至 1M。
  • **部署框架**:兼容 Hugging Face Transformers、vLLM、SGLang、TokenSpeed,官方推荐后三者用于生产环境。
  • **量化版本**:FP8 量化权重已放出,块大小 128,性能与原始模型几乎一致。
  • **推理控制**:reasoning_effort 支持 xhigh / medium / low 三档,preserve_thinking 默认开启以保留历史推理上下文。

注意:所有发布分数均来自 Qwen 自评,部分基准为内部或修正版;1M 上下文依赖 YaRN 外推而非原生窗口,短提示下静态 YaRN 可能影响效果。

查证

来源与可信度

· 阿里 Qwen 团队于 2026 年 8 月 14 日正式开源 Qwen3.8-27B 模型权重,Apache 2.0 协议,免费商用。 [1][2]
· Qwen3.8-27B 是原生多模态稠密模型,实际参数约 27.78B,支持 262K 原生上下文,经 YaRN 可外推至 1M tokens。 [1][2]
孤证 · 官方模型卡显示,相比 Qwen3.6-27B,Qwen3.8-27B 在 Terminal-Bench 2.1 从 63.4 升至 73.0,DeepSWE 1.1 从 13.3 升至 42.2,OSWorld-Verified 从 63.9 升至 84.3,SWE-MM 从 25.7 升至 38.6。 [2]
· Qwen3.8-27B 在编程和办公场景性能大幅提升,官方称整体表现超越 Qwen3.7-Plus,并添加 reasoning_effort 功能按任务难度控制推理深度。 [1][2]

延伸阅读

仔细读模型卡附录的评测方法说明,关注 SWE-bench P · huggingface.co
官方分数与可比性是最容易被过度解读的部分,看原始说明才能判断「超越 Qwen3.7-Plus」的实际含金量。
对比 Qwen3.8-27B 与上一代在编程、Agent、视 · qbitai.com
官方权威转载提供了同一模型家族的代际对比,适合评估这次升级是否值得本地部署投入。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store