## 定義 収束コンピューティング(converged computing)とは、高性能計算(HPC)とクラウドネイティブという、伝統的に別々のコミュニティ・技術スタックとして発展してきた領域が、互いの利点(HPC の性能・階層的リソース管理と、クラウドの可搬性・柔軟性・管理容易性)を統合していく技術的動向を指す用語である。[[@2023__arXiv__The Flux Operator]] はこの用語を、HPC ワークロードマネージャ [[Flux Framework]] を [[Kubernetes]] の内部で稼働させる「Flux Operator」という具体的な実装を通じて論じる。(Source: [[@2023__arXiv__The Flux Operator]] §1 Introduction) > [!note] 用語の衝突に関する注記 > 本 wiki には、CFEngine の作者 Mark Burgess が提唱した「システムの現在状態を理想状態へ繰り返し近づける」という制御理論的な意味での「収束(convergence)」を扱う [[収束型システム管理]] という別概念が既に存在する。両者は英語では同じ "convergence" 系の語を用いるが、指す対象は全く異なる——[[収束型システム管理]] は**単一システムの状態が目標へ近づく力学**を、本概念(収束コンピューティング)は**HPC とクラウドという 2 つの技術コミュニティ・スタックが歩み寄る動向**を指す。誤って同一概念として扱わないこと。 ## 横断的知見 - 本 concept は今回が最初のソースであり、横断的知見は今後のソース追加時に蓄積する。[[@2023__arXiv__The Flux Operator]] が引用する先行研究(Milroy らの "One Step Closer to Converged Computing", CANOPIE-HPC 2022、および "Towards standard Kubernetes scheduling interfaces for converged computing" 2021)は本 wiki 未収録であり、収束コンピューティングという用語自体の系譜を遡るソースとして今後の ingest 候補になる。 ## 未解決の問い - [[@2023__arXiv__The Flux Operator]] は、収束コンピューティングの実現には技術革新だけでなく「HPC とクラウド両コミュニティの文化的な歩み寄り」が必要だと述べる(用語の意味の違い、学術/産業間の発表慣習の非対称性等)。この文化的障壁は、他の HPC-クラウド収束の試み(例: Slurm の Kubernetes 統合、HPC 向けクラウドバースティングサービス)でも同様に報告されているか。 - 本概念と [[収束型システム管理]](Burgess の制御理論的収束)は、語源的には無関係だが、Kubernetes の reconciliation loop(望ましい状態への収束)が HPC ワークロードマネージャを内部に抱え込む Flux Operator の設計原理でもある点で、実装レベルでは両概念が交差する可能性がある。この交差は表面的な用語衝突にとどまるか、それとも実装上の深い関連があるか。 - Flux Operator が示す「HPC の既存ワークロードマネージャをそのまま Kubernetes へ持ち込む」アプローチと、[[Kueue]]・[[Dynamic Resource Allocation (DRA)]]・[[Kubernetes Workload・PodGroup API]] が示す「Kubernetes コア自体が HPC 的な機能(トポロジ考慮・ギャングスケジューリング・柔軟なリソース表現)を段階的に取り込む」アプローチは、収束コンピューティングの異なる 2 つの経路と言える。どちらがより持続可能な設計か、あるいは両者は並行して必要とされるか。 ## 関連 - [[@2023__arXiv__The Flux Operator]] — 本概念の初出ソース。Flux Operator を収束コンピューティングの具体例として提示。 - [[Flux Framework]] / [[Kubernetes]] / [[MPI Operator]] — Flux Operator が橋渡しする両側の技術。 - [[Kubernetesオペレータ]] — Flux Operator は Kubernetes Operator パターンの一実装例。 - [[コンテナオーケストレーション]] — Kubernetes コアが HPC 的機能を取り込む方向の関連概念([[Dynamic Resource Allocation (DRA)]]・[[Kubernetes Workload・PodGroup API]])。 - [[トポロジ考慮型スケジューリング]] — HPC 由来のグラフベース・トポロジ考慮スケジューリングが Kubernetes エコシステム([[Kueue]])へ取り込まれた別の収束の経路。 - [[収束型システム管理]] — 語は同系統だが指す対象が異なる別概念(上記の用語衝突に関する注記を参照)。 ## 出典 - [[@2023__arXiv__The Flux Operator]](Vanessa Sochat, Aldo Culquicondor, Antonio Ojea, Daniel Milroy, arXiv 2023, §1 Introduction, §5 Discussion, §6 Conclusion)