# Yizhou Shan Huawei Cloud 所属の研究者。DeepServe 論文([[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]]、USENIX ATC '25)の co-corresponding author の一人として、[[Xusheng Chen]] とともに研究を統括した。DeepServe が §4.1 で言及する「完全に分離されたデータセンター(fully disaggregated data center)」という長期構想は、Yizhou Shan 自身が筆頭著者の先行研究「Towards a Fully Disaggregated and Programmable Data Center」(ACM SIGOPS Asia-Pacific Workshop on Systems 2022)に由来し、DeepServe の Gen3(disaggregated cluster、NPU Pool・DRAM Pool・CPU Pool・DPU Poolに分離)という将来ロードマップに接続する。(Source: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]] §4.1, Figure 1, References [38]) DeepServe の参考文献リストには、Yizhou Shan が共著者に含まれる先行研究として、position-independent caching を扱う「EPIC: Efficient Position-Independent Caching for Serving Large Language Models」(ICML 2025)も挙げられている(未取り込み)。 ## 関連 - 所属: [[Huawei Cloud]] - ソース: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]] - 共著者: [[Junhao Hu]] / [[Xusheng Chen]] / [[Tao Xie]] - 関連概念: [[Prefill-Decode分離]] / [[コンピュートストレージ分離]]