#AI
Meta 自研 RDMA 协议 MetaRoCE 扛住 10% 丢包
Meta 在 8 月 24 日公开了自研 RDMA 传输协议 **MetaRoCE** 的设计,用于替代标准 RoCE。完整协议规范、参考实现 libsoftmetaroce 与生产合规测试集,将在 **10 月的 OCP 全球峰会**上一并放出。
设计上 MetaRoCE 把拥塞与重传的判断从交换机挪回**网卡**:原生接受乱序交付与丢包、故意把包喷洒到多条路径、不设重排序缓冲,因此**不需要 PFC**——这与标准 RoCE 依赖按序交付和 PFC 的前提直接对立。实测跑在一个 64 节点 AMD GPU 集群(Pensando 网卡)上,1% 丢包保住约 86% 吞吐,10% 丢包依然能跑,吞吐持续高于 RoCEv2。
💡 为什么值得看网卡替代交换机处理拥塞,10 月发布 OCP 规范,算力设施需早布局。
查证
来源档案
CocoLoop
中文 AI 行业媒体,本文基于 Meta 工程博客一手源所做的编译与解读
一手事实(协议名称、发布时间、测试数字)可追溯到 Meta 工程博客,可信度较高;但作为单源编译稿,解读性内容(如对国内智算中心的建议)为编者观点
延伸阅读
86% 吞吐、10% 丢包、64 节点与 4000 条并发连接等测试口径,本文表示均按 Meta 公开实测描述核对,想引用数据的读者可对照 Meta 工程博客原始博客验证。
目前只有 AMD Pensando 是已验证的网卡实现,其他厂商在做——这决定 MetaRoCE 能否落到主流网卡固件,而非停留在 Meta 内部方案。