# RTX 5080 NVIDIA Blackwell の GB203 チップを用いる GeForce RTX 5080。本論文では、Hopper の H100 PCIe と対比する Blackwell 側の実測 GPU として使われた。 評価では FP4/FP6/FP8 Tensor Core、INT32/FP32 統合実行ユニット、128 KB/SM の統合 L1/shared memory、65 MB の単一 L2、16 GB GDDR7 を対象にした。 低精度 MMA では高い ILP と少ないワープ数で高スループットを示したが、FP8 D-GEMM では H100 より低い実効スループットになり、行列サイズによって電力も最大114.4 Wまで変動した。 ## 関連 - アーキテクチャ: [[NVIDIA Blackwell]] - 比較対象: [[NVIDIA H100]] / [[NVIDIA Hopper]] - 概念: [[GPUマイクロベンチマーク]] / [[テンソルコア]] / [[メモリ階層とキャッシュ]] ## 出典 - [[@2025__arXiv__Dissecting the NVIDIA Blackwell Architecture with Microbenchmarks]]