# RTX 5080
NVIDIA Blackwell の GB203 チップを用いる GeForce RTX 5080。本論文では、Hopper の H100 PCIe と対比する Blackwell 側の実測 GPU として使われた。
評価では FP4/FP6/FP8 Tensor Core、INT32/FP32 統合実行ユニット、128 KB/SM の統合 L1/shared memory、65 MB の単一 L2、16 GB GDDR7 を対象にした。
低精度 MMA では高い ILP と少ないワープ数で高スループットを示したが、FP8 D-GEMM では H100 より低い実効スループットになり、行列サイズによって電力も最大114.4 Wまで変動した。
## 関連
- アーキテクチャ: [[NVIDIA Blackwell]]
- 比較対象: [[NVIDIA H100]] / [[NVIDIA Hopper]]
- 概念: [[GPUマイクロベンチマーク]] / [[テンソルコア]] / [[メモリ階層とキャッシュ]]
## 出典
- [[@2025__arXiv__Dissecting the NVIDIA Blackwell Architecture with Microbenchmarks]]