# Huazhong University of Science and Technology 中国・武漢に所在する研究大学。[[Haoran Yan]] および Ming Wen の所属機関として、[[Microsoft]] との共同研究で GenAI クラウドサービスのインシデント実証研究([[@2026__ICSE__An Empirical Study of Production Incidents in Generative AI Cloud Services]])を実施した。 また [[Xuanhua Shi]] の所属機関(国家ビッグデータ技術システム研究センター)として、[[ByteDance]] および [[National University of Singapore]] の [[Bingsheng He]]、[[University of Copenhagen]] の [[Yongluan Zhou]] と共同でインメモリ時系列データベース [[ByteSeries]]([[@2020__SoCC__ByteSeries - An In-Memory Time Series Database for Large-Scale Monitoring Systems]], SoCC 2020)を開発した。 [[Bolong Zheng]] の研究グループ(データベース・時系列・グラフ学習)として、[[Huawei Technologies|Huawei]] および [[Hong Kong University of Science and Technology|HKUST]] の [[Xiaofang Zhou]] と連携し、分散クラウド DB 異常診断フレームワーク Siamese Discrepancy Network(SDN)を開発した([[@2025__ICDE__Anomaly Diagnosis with Siamese Discrepancy Networks in Distributed Cloud Databases]]、ICDE 2025)。SDN は Huawei Cloud GaussDB(DWS) に実展開済み。 [[Yongqiang Guo]] の所属機関として、[[SenseTime Research|SenseTime]]・[[Beijing University of Posts and Telecommunications]] と共同で耐障害 LLM 訓練システム TRANSOM([[@2023__arXiv__TRANSOM - An Efficient Fault-Tolerant System for Training LLMs]])を発表した。(Source: [[@2023__arXiv__TRANSOM - An Efficient Fault-Tolerant System for Training LLMs]]) [[Gen Dong]]・[[Yu Hua]]・[[Zhangyu Chen]]・[[Menglei Chen]] の所属機関として、[[Purdue University]] の [[Yongle Zhang]] と共同でフェイルスローハードウェア障害バグの実証分析と障害注入テストフレームワーク [[Sieve]] を発表した([[@2026__TOCS__Fail-Slow Hardware Failure Bug Analysis and Detection for Cloud Systems]], ACM TOCS 2026)。 [[Wen Cheng]]・[[Chunyan Li]]・[[Lingfang Zeng]](Wuhan National Lab for Optoelectronics所属)の所属機関として、[[DDN]]の[[Yingjin Qian]]・[[Xi Li]]、[[Johannes Gutenberg University Mainz]]の[[André Brinkmann]]と共同で[[Lustre]]向けNVMMベース永続クライアントキャッシュNVMM-LPCC([[@2021__TOS__NVMM-Oriented Hierarchical Persistent Client Caching for Lustre]], ACM ToS 2021)を発表した。 ## 関連 - ソース: [[@2026__ICSE__An Empirical Study of Production Incidents in Generative AI Cloud Services]] / [[@2020__SoCC__ByteSeries - An In-Memory Time Series Database for Large-Scale Monitoring Systems]] / [[@2025__ICDE__Anomaly Diagnosis with Siamese Discrepancy Networks in Distributed Cloud Databases]] / [[@2023__arXiv__TRANSOM - An Efficient Fault-Tolerant System for Training LLMs]] / [[@2026__TOCS__Fail-Slow Hardware Failure Bug Analysis and Detection for Cloud Systems]] / [[@2021__TOS__NVMM-Oriented Hierarchical Persistent Client Caching for Lustre]] - 所属研究者: [[Haoran Yan]] / [[Xuanhua Shi]] / [[Bolong Zheng]] / [[Lingsen Yan]] / [[Yongqiang Guo]] / [[Gen Dong]] / [[Yu Hua]] / [[Zhangyu Chen]] / [[Menglei Chen]]