探所 Curio 再探再报 了解探所 →
#科技

MacStories 实测 M5 Ultra Mac Studio 跑本地模型

MacStories 实测顶配 256GB 内存的 M5 Ultra Mac Studio,作者用四天对比上代 M3 Ultra(512GB)与自组 RTX 5090 台式机,称它是跑本地 AI agent 的理想机器,助手可全在本机跑,无云端调用费。

他称过去本地模型卡在提示预填,而 M5 Ultra 预填平均比 M3 Ultra 快 150%,生成响应平均快约 70%;内存带宽由 819GB/s 升至 1.2TB/s。

💡 为什么值得看作者拿它跟 M3 Ultra 和 RTX 5090 主机对比,预填速度平均快 1.5 倍。想在本机跑 agent 的人值得看这份实测。

他拿什幺比、怎幺用

  • **对比机型**:M3 Ultra(512GB)与自组 RTX 5090 台式机;5090 带宽仍占优。
  • **实际用法**:本地 Qwen3.8-Flash-Next 设为 Open Minis、Hermes Agent 默认模型,也用于 Codex app,无云端成本。
  • **量化档位**:256GB 下 5-bit 可全放进内存,平衡最好;6-bit、8-bit 可卸载 n-gram 表。
  • **作者身份**:自称非 AI 开发者,玩本地模型一年多;未公布完整跑分。

单源实测,数字仅代表该作者的测试条件。

查证

来源档案

MacStories

Apple 生态垂直媒体,本文是第一人称硬件实测长文,含作者自建测试流程

作者为资深 Apple 生态写作者,测试方法与对比机型交代清楚;但结论基于单人四天测试、非标准化跑分,数字不宜外推为通用性能指标。

延伸阅读

测试条件与跑分细节 · macstories.net 15 分钟
想复现结论的人需要看模型、量化档、上下文长度与具体测试脚本,原文给出了完整过程。
本地 agent 工作流 · macstories.net 10 分钟
作者写了他用 Desk app 和本地 agent 做 iOS/macOS 评测研究的具体做法,可借鉴思路。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中