NVIDIA公式のMLPerfベンチマーク結果ページによれば、BlackwellはMLPerf Training v6.0の全項目で最速の訓練時間を達成し、DeepSeek-V3(671B)の訓練を2.02分、Llama 3.1(405B)を7.07分で完了した。検証待ちNVIDIA MLPerf Benchmarks
Use Case
公開Evidence未整備
Constraints / Current Status
NVIDIAの公式発表(2024年3月)によれば、GB200 Superchip(Grace CPU 1個とBlackwell GPU 2個をNVLink-C2Cで接続)を72個のGPU規模でラック統合した「GB200 NVL72」構成では、大規模言語モデル推論においてH100世代と比較して最大30倍の性能向上が見込まれるとされている。この性能値はNVIDIA自身が発表したベンチマークであり、独立した第三者機関による検証ではない。検証待ちNVIDIA Blackwell Platform Arrives to Power a New Era of Computing
NVIDIA Blackwell公式のサイト(https://www.nvidia.com/en-us/data-center/gb300-nvl72/)は、NVIDIA Blackwellの主要製品・提供機能に関する一次情報である。既存のP-01-002(blackwell-ev-c1n19-p-01-002)はGB200 NVL72構成(標準Blackwell GPU 72基・HBM3E 13.4TB・NVLink 130TB/s)を扱っている。本候補は仕様の異なる別個のGB300 NVL72/Blackwell Ultraバリアント(メモリ20TB・FP4性能1,080 PFLOPS・Grace CPU 36基/コア2,592)を扱っており、これは同じBlackwell世代内でこれまで説明されていなかったさらなる強化版である。具体的には「72 NVIDIA Blackwell Ultra GPUs and 36 Arm-based NVIDIA Grace CPUs [...] 1.5x more dense FP4 Tensor Core FLOPS and 2x higher attention performance [versus regular Blackwell] [...] up to a 50x overall increase in AI factory output performance [versus Hopper-based platforms].」といった記載がある。ただし、これは取得時点で公開されている構成であり、各提供物の機能範囲・提供地域・提供終了の有無はこのSourceからは確認できません。 性能倍率(『50倍』『10倍』『5倍』)はNVIDIA自身によるベンダー側の主張であり、独立した第三者による検証はされていない。数値は取得時点でnvidia.comに掲載されている製品情報を反映したものであり、今後改訂される可能性がある。2026年08月25日に同Sourceを取得し、この内容を確認した。検証待ちNVIDIA Blackwell主要製品・提供機能に関する公開情報