#AI
阿里开源 Qwen3.8-27B,家用显卡可跑
阿里 Qwen 团队正式开源 **Qwen3.8-27B**,以 Apache 2.0 协议开放权重,免费商用。官方定调明确:27B 是全球社区呼声最高的尺寸,这次的目标是把部署便捷、快且实用的模型送到「家用显卡」上。
这是一个**原生多模态稠密模型**,同时接受文本、图片和视频输入,实际参数约 27.78B。上下文窗口原生 262K,经 YaRN 技术可外推至 1M tokens。相比上一代 Qwen3.6-27B,编程与 Agent 能力提升显着:Terminal-Bench 2.1 从 63.4 涨到 73.0,DeepSWE 1.1 从 13.3 跃升至 42.2,OSWorld-Verified 从 63.9 到 84.3。官方称整体表现已超越 Qwen3.7-Plus。
💡 为什么值得看27B 稠密多模态模型以 Apache 2.0 商用免费开放,编程与 Agent 指标大幅超上一代,本地部署门槛再降。
本地部署要点
- **模型规格**:27B 稠密架构,64 层,支持图像与视频输入,原生 262K 上下文,YaRN 外推至 1M。
- **部署框架**:兼容 Hugging Face Transformers、vLLM、SGLang、TokenSpeed,官方推荐后三者用于生产环境。
- **量化版本**:FP8 量化权重已放出,块大小 128,性能与原始模型几乎一致。
- **推理控制**:reasoning_effort 支持 xhigh / medium / low 三档,preserve_thinking 默认开启以保留历史推理上下文。
注意:所有发布分数均来自 Qwen 自评,部分基准为内部或修正版;1M 上下文依赖 YaRN 外推而非原生窗口,短提示下静态 YaRN 可能影响效果。
查证
来源与可信度
孤证
· 官方模型卡显示,相比 Qwen3.6-27B,Qwen3.8-27B 在 Terminal-Bench 2.1 从 63.4 升至 73.0,DeepSWE 1.1 从 13.3 升至 42.2,OSWorld-Verified 从 63.9 升至 84.3,SWE-MM 从 25.7 升至 38.6。
[2]
延伸阅读
官方分数与可比性是最容易被过度解读的部分,看原始说明才能判断「超越 Qwen3.7-Plus」的实际含金量。
官方权威转载提供了同一模型家族的代际对比,适合评估这次升级是否值得本地部署投入。