#AI
英伟达 Rubin 每瓦吞吐飙升 30 倍
英伟达发布首组 Vera Rubin NVL72 的 Agentic 推理实测数据:在 DeepSeek V4 Pro 模型上,**每兆瓦吞吐量最高达 GB300 NVL72 的 30 倍**,每百万 token 成本相应降低至最高 35 倍。
对比基准另有 Kimi K3、MiniMax M3、GLM5.3、Qwen3.5 等模型,Blackwell 平台相对 Hopper 已做到每兆瓦 15 倍吞吐。
💡 为什么值得看官方首组 Agentic 推理实测:Vera Rubin NVL72 相对 GB300 每兆瓦吞吐高 30 倍、token 成本低 35 倍,面向电力受限的 AI 工厂。
查证
来源档案
NVIDIA Blog
英伟达官方博客,发布自家硬件的实测性能标准与营销口径。
官方一手来源,数据可信但属自测营销口径;关键数字尚待 SemiAnalysis 评审,且为早期结果,建议按官方自报看待而非独立验证结论。
延伸阅读
想了解「每兆瓦吞吐」如何从真实 agentic 会话轨迹测得,以及为什幺传统 chat 基准不再适用,可直接读原文的测量方法一节。
原文披露整套平台含 Vera CPU、Groq 3 LPU、NVLink 6 等七类自研组件,是理解 Rubin 如何在 AI 工厂做极端 codesign 的入口。