# AWS Trainium Amazon Web Services(AWS)が提供する AI トレーニング向けアクセラレータ。Trainium 1(EC2 インスタンス trn1.32xlarge)と Trainium 2(trn2.48xlarge)の2世代がある。単一コアあたりの理論ピーク性能は、Trainium 1 が PeakBW 440.2 GB/s・PeakMM 23.75 TFLOPS・PeakVec 286.8 GFLOPS、Trainium 2 が PeakBW 640.0 GB/s・PeakMM 19.75 TFLOPS・PeakVec 550.0 GFLOPS([[@2026__MLSys2026__AccelOpt - A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization]] Table 4)。1コアはテンソルエンジン・ベクタエンジン・スカラエンジン・GPSIMD エンジンが並行動作し、オンチップメモリ経由で HBM と通信する構成を持つ。 Trainium は [[Neuron Kernel Interface (NKI)]] という Python 埋め込みカーネル言語でプログラムされる。ハードウェアとプログラミングモデルの双方が比較的新しいため、GPU のような成熟した最適化レシピや性能ヒューリスティクスが確立されておらず、開発者は限られた性能直感しか持たない([[@2026__MLSys2026__AccelOpt - A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization]] §1)。 ## 関連 - [[Amazon Web Services]] — 提供元 - [[Neuron Kernel Interface (NKI)]] — Trainium 向けカーネル言語 - [[NKIBench]] — Trainium カーネルのベンチマークスイート - [[AIアクセラレータ]] — AI アクセラレータ全般の横断概念 - [[@2026__MLSys2026__AccelOpt - A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization]] — 初出ソース ## 出典 - [[@2026__MLSys2026__AccelOpt - A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization]]