# Aqua
Abhishek Vijaya Kumar ら(ASPLOS 2025)による、スケールアップ GPU ドメイン向けのネットワーク加速メモリオフロード LLM サービングシステム。メモリオーバーサブスクリプション下でピア GPU メモリを利用するが、単一指定ピア GPU へのオフロードに限定される。(Source: [[@2026__SIGCOMM__DynamoServe - A Distributed Tiered Memory System for Multi-tenant LLM Serving]])
DynamoServe 論文の OPT-30B 実験では、ノード内の集約 GPU メモリは十分だが単一ピア GPU に空きがない場合、Aqua は PCIe 経由でホスト DRAM へスピルし、DynamoServe より低スループット・高レイテンシとなる。(Source: [[@2026__SIGCOMM__DynamoServe - A Distributed Tiered Memory System for Multi-tenant LLM Serving]])
## 関連
- ソース: [[@2026__SIGCOMM__DynamoServe - A Distributed Tiered Memory System for Multi-tenant LLM Serving]]
- 比較: [[DynamoServe]] / [[FlexGen]]