用語解説 エヌブイエルナナジュウニ

NVL72とは

NVL72は、NVIDIAがラック単位で提供するAIシステムで、72基のGPUをNVLinkでつなぎ、1つの大きな計算資源として使えるようにした構成です。その仕組み、何に使えるか、利用方法、料金が公表されているか、HuaweiなどのAI計算基盤の競合を解説します。

NVL72とは

NVL72は、NVIDIAがラック単位で提供するAIコンピューティングシステムの名称です。1つのラックに72基のGPUを載せ、NVIDIA独自の高速インターコネクト「NVLink」で互いにつなぎ、1つの大きな計算資源として扱えるようにしています。

名前の「NVL」はNVLink、「72」はつながっているGPUの数を表します。実際の製品名には、Grace CPUとBlackwell GPUを組み合わせた「GB200 NVL72」のように、世代を示す語が前に付きます。最新の世代は、Vera CPUとRubin GPUを組み合わせた「Vera Rubin NVL72」です。

何ができるのか

NVL72の特徴は、GPUを1枚ずつではなく、ラック1台を1つの単位として設計している点です。従来のGPUサーバは1台あたり8基程度のGPUを積み、サーバ同士はネットワークでつなぐのが一般的でした。NVL72ではラック内の72基すべてがNVLinkで直接つながっているため、サーバをまたいだ通信で処理が遅くなりにくくなります。

この構成が効果を発揮するのは、1枚のGPUのメモリに収まらない大規模言語モデルの学習や推論です。モデルを多数のGPUに分割して載せても、GPU同士のやり取りが速いので効率が落ちにくくなります。事業会社にとっては、自社で大規模モデルを動かす、またはAIサービスを大量のユーザーに提供するための土台にあたります。

使い方:購入するか、GPUクラウドで借りるか

利用方法は大きく2つです。1つはラックごと購入して自社のデータセンターに置く方法、もう1つはGPUクラウド事業者から借りる方法です。

クラウドでの提供例として、GPUクラウドのCoreWeaveが「Vera Rubin NVL72」を利用可能にしたと、Data Center Dynamicsが報じています。初期の顧客には、AIコーディングを手がけるCognitionが名前を挙げられています。ただし、当サイトが入手できたのは見出しだけです。提供規模やCognitionが何に使うのかは確認できていません。

ラック1台で動く前提のシステムなので、自社で導入するには電力や冷却を含むデータセンター側の準備が必要になると考えられます(これは推測です)。多くの企業にとっては、まずクラウドで借りるのが現実的な選択肢になるでしょう。

料金

当サイトでは、NVL72の購入価格もクラウドの利用料金も確認できていません。CoreWeaveのVera Rubin NVL72についても、料金は公表情報から確認できませんでした。検討する場合は、各クラウド事業者やNVIDIAの販売パートナーに見積もりを依頼する必要があります。

誰が作っていて、競合は何か

NVL72はNVIDIAの製品で、CoreWeaveのようなGPUクラウド事業者を通じて提供されています。

競合の一つがHuaweiのAIアクセラレータ「Ascend」です。Huaweiは次世代のAscend 900シリーズを中国国内向けに限ると表明しました。輪番会長のEric Xu氏は「国内需要すら満たせないので国際市場への本格展開の計画はない」と述べています。最大15,488基で構成するAtlasクラスタはFP4で120 EFLOPSに達する規模です。一方で、チップ単体の性能はNvidiaに大きく劣ると報じられています。Huaweiはチップ1枚の性能差を、数を束ねることで補う方針を取っているとみられます。ただし、Ascendの供給先は中国国内に限られるため、中国以外の市場ではNVL72の直接の競合にはなりにくい状況です。

NVL72に関する記事

2 件