# Xusheng Chen Huawei Cloud 所属の研究者。DeepServe 論文([[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]]、USENIX ATC '25)の co-corresponding author の一人として、[[Yizhou Shan]] とともに研究を統括した。(Source: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]]) DeepServe の参考文献リストには、Xusheng Chen が共著者に含まれる先行研究として、KVキャッシュを扱う「MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool」(CoRR 2024)と、PD分離を扱う「Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads」(CoRR 2024。本文では TetriServe と通称され、DeepServe の PD-aware scheduling が採用する decode 長予測モデルの手法的基盤となった)が挙げられている(いずれも未取り込み)。(Source: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]] References [11][12]) ## 関連 - 所属: [[Huawei Cloud]] - ソース: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]] - 共著者: [[Junhao Hu]] / [[Yizhou Shan]] / [[Tao Xie]] - 関連概念: [[Prefill-Decode分離]] / [[LLMサービング管理]]