# RTX4090 Ada Lovelace 世代の NVIDIA GPU。本論文では24GB GDDR6X、128 SM、メモリ帯域1008 GB/sの比較対象として使われた。疎 `mma` は対応する dense 命令の最大約2倍のスループットを示した。 ## 関連 - [[NVIDIA]] - [[@2024__arXiv__Benchmarking and Dissecting the Nvidia Hopper GPU Architecture]]