# Xusheng Chen
Huawei Cloud 所属の研究者。DeepServe 論文([[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]]、USENIX ATC '25)の co-corresponding author の一人として、[[Yizhou Shan]] とともに研究を統括した。(Source: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]])
DeepServe の参考文献リストには、Xusheng Chen が共著者に含まれる先行研究として、KVキャッシュを扱う「MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool」(CoRR 2024)と、PD分離を扱う「Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads」(CoRR 2024。本文では TetriServe と通称され、DeepServe の PD-aware scheduling が採用する decode 長予測モデルの手法的基盤となった)が挙げられている(いずれも未取り込み)。(Source: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]] References [11][12])
## 関連
- 所属: [[Huawei Cloud]]
- ソース: [[@2025__ATC__DeepServe - Serverless Large Language Model Serving at Scale]]
- 共著者: [[Junhao Hu]] / [[Yizhou Shan]] / [[Tao Xie]]
- 関連概念: [[Prefill-Decode分離]] / [[LLMサービング管理]]