#科技
MacStories 实测 M5 Ultra Mac Studio 跑本地模型
MacStories 实测顶配 256GB 内存的 M5 Ultra Mac Studio,作者用四天对比上代 M3 Ultra(512GB)与自组 RTX 5090 台式机,称它是跑本地 AI agent 的理想机器,助手可全在本机跑,无云端调用费。
他称过去本地模型卡在提示预填,而 M5 Ultra 预填平均比 M3 Ultra 快 150%,生成响应平均快约 70%;内存带宽由 819GB/s 升至 1.2TB/s。
💡 为什么值得看作者拿它跟 M3 Ultra 和 RTX 5090 主机对比,预填速度平均快 1.5 倍。想在本机跑 agent 的人值得看这份实测。
他拿什幺比、怎幺用
- **对比机型**:M3 Ultra(512GB)与自组 RTX 5090 台式机;5090 带宽仍占优。
- **实际用法**:本地 Qwen3.8-Flash-Next 设为 Open Minis、Hermes Agent 默认模型,也用于 Codex app,无云端成本。
- **量化档位**:256GB 下 5-bit 可全放进内存,平衡最好;6-bit、8-bit 可卸载 n-gram 表。
- **作者身份**:自称非 AI 开发者,玩本地模型一年多;未公布完整跑分。
单源实测,数字仅代表该作者的测试条件。
查证
来源档案
MacStories
Apple 生态垂直媒体,本文是第一人称硬件实测长文,含作者自建测试流程
作者为资深 Apple 生态写作者,测试方法与对比机型交代清楚;但结论基于单人四天测试、非标准化跑分,数字不宜外推为通用性能指标。
延伸阅读
想复现结论的人需要看模型、量化档、上下文长度与具体测试脚本,原文给出了完整过程。
作者写了他用 Desk app 和本地 agent 做 iOS/macOS 评测研究的具体做法,可借鉴思路。