Meta、100万GPU規模向け「MetaRoCE」公表 順不同到着と損失を前提にEthernetを再設計

Meta、100万GPU規模向け「MetaRoCE」公表 順不同到着と損失を前提にEthernetを再設計

※記事を視覚化したイメージであり、実際の事象とは異なります。

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

Metaは2026年8月24日、AIクラスタ向けRDMAトランスポート「MetaRoCE」を公表した。100万GPU規模を想定し、順不同で届くパケットや損失を前提に、Ethernet上の複数経路を活用する設計としている。

順不同到着と損失をNIC側で処理

Metaは標準的なRoCEについて、フレームが順番通りに届くことを想定し、PFCを活用してパケット損失を抑えると説明する。MetaRoCEは1つの接続で複数経路を使い、パケット単位で通信を分散する。各パケットが宛先情報を持つため、到着した時点で最終的なメモリ位置へ書き込める。

Ethernetでは損失が起こり得るとの前提に立ち、PFCやpause frameを要求しない。経路ごとの256ビットSACKビットベクトルで欠落を検知し、失われたパケットだけを再送する。NICは経路ごとの往復時間、ECN状態、利用率を追跡し、混雑や障害のある経路を抑制・回避する。

64ノード環境でRoCEv2と比較

MetaはAMDと協力し、PensandoプログラマブルNICにMetaRoCEを実装した。64ノードのAMD GPUクラスタでRCCLのall-reduceとall-to-allを使い、RoCEv2と比較した。

Metaの検証では、1%のパケット損失時に約86%のスループットを維持し、10%損失時にも有用な通信帯域を提供し続けたという。100万GPUは設計上の想定規模であり、この検証環境の規模とは異なる。

ネットワーク側に求める機能はECNとECMPで、パケットトリミングやネットワーク内テレメトリーなどは必須としない。既存のRDMA Verbs APIとソフトウェアスタックも原則そのまま利用できるとしている。

Metaは10月12〜15日(現地時間)に米カリフォルニア州サンノゼで開かれる2026 OCP Global Summitで、仕様、DPDK最適化リファレンス実装、適合性フレームワークを公開する予定だ。

参考・出典

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

ニュースはAIで深化する—。日々の出来事を深掘りし、次の時代を考える視点をお届けします。

本サイトの記事や画像はAIが公的資料や報道を整理し制作したものです。
ただし誤りや不確定な情報が含まれることがありますので、参考の一助としてご覧いただき、
実際の判断は公的資料や他の報道を直接ご確認ください。
[私たちの取り組み]