#AI
美光研发近 GPU NAND 支撑大模型
美光正在研究一种「近 GPU NAND」,把高耐久性闪存直接放到 GPU 封装或 PCB 上,插在 HBM 显存与远端 SSD 之间。消息源自 DigiTimes 报道,目前处于探索阶段,美光官方尚未确认。
思路是用更低存储密度换取 I/O 速度、带宽和耐久性,让 GPU 不经主机就能直接访问数百 GB 的本地闪存池。对推理这种读密集型负载,若模型权重或 KV 缓存能落在这层闪存上,同样的模型有望跑在更少的 GPU 上,摆脱显存容量对 LLM 规模的限制。
💡 为什么值得看近 GPU NAND 层可降本解显存瓶颈,惠及大模型推理。
查证
来源档案
IT 之家(转述 DigiTimes)
中文科技媒体的英文源转述稿,原始来源是 DigiTimes 的供应链报道
线索档单源:DigiTimes 属供应链媒体,常能提前拿到厂商路线信息,但美光官方未确认;具体技术参数与时间表均未落地,仅供了解思路,不宜作定论
延伸阅读
原文对 HBM 与 SSD 之间的带宽/延迟鸿沟有展开,解释了近 GPU NAND 为什幺是「梯级」上的一环,适合想理解动机的读者