# TensorRT
NVIDIA の推論最適化フレームワーク。本論文では Transformer 推論のケーススタディに使われ、精度設定(best、normal、FP16、FP8)ごとの電力消費を測定する実行基盤となった。
本論文の測定では、Blackwell の電力は FP32 の58.82 Wから FP8 の45.14 Wへ低下したが、TensorRT の Best 設定では61.03 Wとなった。
この結果は、フレームワークが選ぶ高性能経路と低電力経路が必ずしも一致しない可能性を示すが、論文は推論スループットや出力品質までは評価していない。
## 関連
- 開発元: [[NVIDIA]]
- 関連製品: [[TensorRT-LLM]]
- 概念: [[LLM推論]] / [[量子化]]
## 出典
- [[@2025__arXiv__Dissecting the NVIDIA Blackwell Architecture with Microbenchmarks]]