CoreWeaveは9月30日、NVIDIAの次世代AIプラットフォーム「Vera Rubin NVL72」の提供を開始した。AIソフトウェアエンジニア「Devin」を開発するCognitionが最初の顧客としてすでに本番環境で利用しており、従来のGB200 NVL72と比べて最大4.8倍のトークンスループットを確認したという。

  • NVIDIA次世代GPU「Rubin」動作開始。AIエージェントでBlackwell GB200比最大4.8倍のスループット

    NVIDIA次世代GPU「Rubin」動作開始。AIエージェントでBlackwell GB200比最大4.8倍のスループット

Vera Rubin NVL72は、72基のRubin GPUと36基のVera CPUをNVLink 6で接続したラックスケールシステム。HBM4を採用し、システム全体で1,400TB/sのメモリ帯域幅と216TB/sのNVLink帯域幅を備える。CoreWeaveではすでに複数地域へ数百基のRubin GPUを展開している。

最初の顧客となったCognitionは、Devinの学習や強化学習、推論などにCoreWeaveを利用。同社は9月初旬にVera Rubin NVL72クラスタを構築し、ラックの引き渡しから数日以内に本番ワークロードを実行した。

Cognitionによる性能検証では、ソフトウェア開発を行なうAIエージェント「SWE-2」の推論において、GB200 NVL72と同等のインタラクティビティを維持した状態で、GPUあたりの総トークンスループットが最大4.8倍に向上。強化学習ではGPUあたりの出力トークンスループットが3.8倍となった。

なお、最大4.8倍という性能はCognitionのSWE-2推論ワークロードでGB200 NVL72と比較した結果で、Rubin GPU自体がBlackwell世代に対して一律4.8倍高速であることを示すものではない。