探所 Curio 再探再报 了解探所 →
#AI

美光研发近 GPU NAND 支撑大模型

美光正在研究一种「近 GPU NAND」,把高耐久性闪存直接放到 GPU 封装或 PCB 上,插在 HBM 显存与远端 SSD 之间。消息源自 DigiTimes 报道,目前处于探索阶段,美光官方尚未确认。

思路是用更低存储密度换取 I/O 速度、带宽和耐久性,让 GPU 不经主机就能直接访问数百 GB 的本地闪存池。对推理这种读密集型负载,若模型权重或 KV 缓存能落在这层闪存上,同样的模型有望跑在更少的 GPU 上,摆脱显存容量对 LLM 规模的限制。

💡 为什么值得看近 GPU NAND 层可降本解显存瓶颈,惠及大模型推理。

查证

来源档案

IT 之家(转述 DigiTimes)

中文科技媒体的英文源转述稿,原始来源是 DigiTimes 的供应链报道

线索档单源:DigiTimes 属供应链媒体,常能提前拿到厂商路线信息,但美光官方未确认;具体技术参数与时间表均未落地,仅供了解思路,不宜作定论

延伸阅读

存储梯级补位逻辑 · ithome.com 3 分钟
原文对 HBM 与 SSD 之间的带宽/延迟鸿沟有展开,解释了近 GPU NAND 为什幺是「梯级」上的一环,适合想理解动机的读者
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store