# ContextPilot [[University of Edinburgh]] の研究チーム(Yinsicheng Jiang・Yeqi Huang ほか、コレスポンディング著者 Luo Mai)が開発したコンテキスト管理システム。MLSys 2026 で Oral 発表され、GitHub(EfficientContext/ContextPilot)でオープンソース公開されている。 KV キャッシュそのものではなく、その手前の「コンテキストブロック(検索文書・エージェントメモリ)」のレベルで再利用機会を捉え直す点が特徴。コンテキストインデックス・整列(alignment)・重複排除(de-duplication)・簡潔な優先順位注釈(annotation)の4要素を組み合わせ、[[SGLang]]・[[vLLM]]・llama.cpp などの推論エンジンに request ID 追跡のみで統合できるプロキシ的な位置づけを取る。[[Mem0]](エージェントメモリ)や OpenClaw(実運用エージェント)との統合評価も行っている。 比較対象として [[LMCache]](完全一致 prefix caching の代表)、[[CacheBlend]](近似 KV マッチングの代表)、RadixCache(SGLang の Longest-Prefix-Match)を挙げ、いずれに対しても精度をほぼ落とさずにプリフィルスループット・TTFT を改善したと報告する。詳細は [[@2026__MLSys2026__ContextPilot - Fast Long-Context Inference via Context Reuse]] を参照。 ## 関連 - ソース: [[@2026__MLSys2026__ContextPilot - Fast Long-Context Inference via Context Reuse]] - 比較対象ソフトウェア: [[LMCache]] / [[CacheBlend]] / [[SGLang]] / [[Mem0]] - 開発元: [[University of Edinburgh]]