探所 Curio 再探再报 了解探所 →
#AI

高通联手阶跃,把 300 亿 MoE 塞进手机端侧

夏威夷时间 9 月 22 日,高通在 2026 骁龙峰会上宣布,携手阶跃、无量火及江波龙,基于第六代骁龙 8 超级至尊版移动平台对阶跃 StepEdge-Omni 30B-MoE 模型做端侧适配与推理优化,并现场演示了相关智能体助手。

该模型 300 亿参数、走混合专家架构,只按任务激活部分专家模块。合作三方从推理引擎、异构调度到存储方案一起优化,**运行内存需求较行业常规方案降低超过 50%**。高通表示方案**不调用云端**,邮件理解、进程规划、日历同步、航班酒店推荐、进程分享与邮件草拟都在本地跑;测试数据显示预填充吞吐超过每秒 330 Token、解码吞吐超过每秒 28 Token。真机上市后的功耗与实际体验,还得看终端厂商。

💡 为什么值得看高通在骁龙峰会演示阶跃 30B 模型的端侧智能体助手,内存需求比常规方案降一半以上。

查证

来源档案

IT 之家

中文科技媒体对高通骁龙峰会现场的转述报道,含厂商口径与测试数字。

单源转述官方发布,数据来自高通一方,未见高通官方博文或阶跃侧独立确认;模型跑在实机上的功耗与成本未提及。

延伸阅读

读峰会现场原文 · ithome.com
看三方合作分工与演示细节,数字均为高通方口径,原文是唯一来源。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中