Blackwell(ブラックウェル)は、NVIDIA が 2024 年に発表した GPU アーキテクチャの世代名で、H100 などの Hopper 世代の後継にあたる。データセンター向けの B200/GB200 と、コンシューマー向けの GeForce RTX 50 シリーズが、どちらもこの設計を使っている。
Blackwell とは — 何が新しいのか
名前は統計学者 David Blackwell に由来する。Pascal、Volta、Ampere、Hopper と続いてきた、科学者名を世代名に使う NVIDIA の慣例どおりの命名だ。
構造面での最大の特徴は、データセンター版が 1 パッケージに 2 つの大型ダイを載せ、それらを高速リンクで結んで「1 個の GPU」としてソフトウェアに見せる点にある。B200 は 192GB の HBM3e メモリを搭載する。後に強化版の Blackwell Ultra(GB300)も投入された。
何ができるのか
主用途は大規模言語モデルの学習と推論だ。第 2 世代 Transformer Engine が FP4/FP6 といった低精度フォーマットに対応し、同じ電力でより多くのトークンを処理できる。ここが Hopper との実務上の差になる。
さらに GB200 NVL72 は、Blackwell GPU と Grace CPU を 1 ラックに詰めて NVLink で接続し、ラック全体を巨大な 1 枚の GPU のように扱う構成をとる。数千億パラメータ級のモデルを、ノードをまたぐ通信のボトルネックを抑えて動かすための設計だ。
ゲーム・クリエイティブ側は RTX 50 シリーズで、DLSS 4 のマルチフレーム生成が目玉。最上位の RTX 5090 は 32GB の GDDR7 を積み、ローカルでの画像・動画生成やモデル実験にも使われている。
使い方 — 手に入れる 3 つの経路
1 つ目はクラウド。AWS、Azure、Google Cloud や GPU 専業事業者が Blackwell インスタンスを提供しており、事業会社が検証から入るならここが現実的だ。2 つ目は DGX/HGX サーバーをサーバーベンダー経由で導入するオンプレ。3 つ目はデスクトップに RTX 50 を挿す方法。
ソフトウェアは従来どおり CUDA で、既存のコードはそのまま動く。ただし FP4 の性能を引き出すには TensorRT-LLM など対応スタックを使う必要があり、「挿せば速くなる」わけではない。
なお Blackwell クラスの AI チップは米国の対中輸出規制の対象だ。監視団体 C4ADS は、規制対象の NVIDIA 製 AI チップが中国へ流れる経路を分析した報告書を公表しており、最大 46 億ドル規模と見積もっている。調達地域によってはコンプライアンス確認が必要になる。
料金の目安
NVIDIA はデータセンター GPU の定価を公表していない。CEO の Jensen Huang は 2024 年のインタビューで 1 基あたり 3 万〜4 万ドル程度と述べたが、これは公式価格表ではなく参考値として扱うべきだ。実際の調達価格は構成と数量で変わる。
RTX 5090 は北米希望小売価格 1,999 ドル。クラウドは時間課金で、事業者ごとに単価が大きく異なるため、比較は各社の料金ページで確認するのが早い。
誰が作り、競合は何か
設計は NVIDIA、製造は TSMC。競合は AMD の Instinct シリーズ、Google の TPU、AWS の Trainium といった自社設計チップだが、参入障壁は演算性能そのものより CUDA エコシステムと NVLink による多数 GPU 接続にある。
次世代は Rubin アーキテクチャ。一方でゲーム向けは後回しとの観測があり、実績のあるリーカー Kopite7Kimi 氏は X で、Rubin ベースの RTX 60 シリーズは少なくとも 2028 年まで登場しない可能性があると述べている(同氏は「GR20x は 2028 年の製品だ。つまり再び延期された」と投稿)。事実として確定しているわけではないが、これが当たれば RTX 50 = Blackwell がコンシューマー向けの現行世代として異例に長く残ることになる。

