FEATUREDAI HOT 精选· aihot-apiZH18:02 · 08·24
Meta 开源 MetaRoCE:一套为百万 GPU 级以太网从头设计的 RDMA 传输协议
Meta 通过 OCP 开源了一套全新的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和合规测试套件。它抛弃了传统 RoCE 要求交换机保序、不丢包的假设,把乱序到达、多路径喷洒和拥塞控制都交给网卡处理。每个数据包自带目标地址,数据落地直接写进内存,没有重排缓冲区,也不会出现队头阻塞。Meta 已经在跨区域的数十万 GPU 集群上验证过这套...
#Meta#Open Compute Project#Open source
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
Meta 把 RDMA 协议重写了一遍,让网卡自己处理乱序和拥塞,不再要求交换机保序不丢包,已经在几十万张 GPU 的集群上跑通了。
锐评
Meta 这次开源的不是小修小补,而是把传统 RoCE 依赖交换机保序、不丢包的假设直接推翻了。新协议 MetaRoCE 让每个数据包自带目标内存地址,网卡负责处理乱序到达和多路径喷洒,数据落地直接写进内存,没有重排缓冲区,也不会出现队头阻塞。这个设计思路很干脆:把复杂性从网络设备挪到端侧,用更便宜的以太网交换机就能支撑大规模 AI 集群。
文章说已经在跨区域的数十万 GPU 集群上验证过,对 all-reduce 的尾部延迟和分布式推理的响应时间都有改善。但正文没披露具体的性能对比数字,比如延迟降低了多少百分比、吞吐提升了多少,也没说明和传统 RoCEv2 在同等规模下的量化差异。这点先别太激动,等 OCP 那边放出参考实现和合规测试套件后,第三方跑出来的数据会更有说服力。
还缺一个关键信息:这套协议对网卡硬件有什么要求,现有商用网卡能不能直接适配,还是需要新硅片。如果门槛太高,生态铺开的速度会慢很多。
HKR 分解
hook ✓knowledge ✓resonance ✓