# 沐曦 (MetaX) 中国のGPUベンダー。OCTS 2026 Track 4(李兆石)において、GPU中心の5階層ストレージピラミッドとKV Cacheの経済性に関する分析を発表した。 ## GPU中心の5階層ストレージピラミッド - 現行のvLLM/SGLangは3層抽象だが、L2以上はすべてCPU介在でボトルネックになると指摘。L1(GPU VRAM)/L1.5(GPU直結の拡張層)/L2(CPU DRAM)/L2.5(Fabric)/L3(NVMeプール)という5階層モデルを提示し、L1.5-Rand層は自社のMetaX Memory Expander(MXME)で読取り往復遅延0.9μsを実測したとする。(Source: [[@2026__SpeakerDeck__AIインフラの最新技術動向 2026 — 中国OCPコミュニティから読み解く6つの技術トレンド]]) ## KV Cacheの経済性 - 1TB DDR5(約2.8万ドル)対1TB NANDフラッシュ(約140ドル)という約200倍のコスト差を示し、ヒット率95%→97.5%(ミス率5%→2.5%)という一見小さな改善が、1Mトークンで5万トークンから2.5万トークンへ演算需要を半減させると分析する。「トークン課金がサブスクへ移る局面では、リクエストあたりコスト低減がそのまま純利益率」と述べた。(Source: [[@2026__SpeakerDeck__AIインフラの最新技術動向 2026 — 中国OCPコミュニティから読み解く6つの技術トレンド]]) ## 関連 - ソース: [[@2026__SpeakerDeck__AIインフラの最新技術動向 2026 — 中国OCPコミュニティから読み解く6つの技術トレンド]] - 概念: [[KVキャッシュ管理]]