# FabricPerf
[[Songlin Huang]]・[[Chenshu Wu]]([[The University of Hong Kong]])が開発した、NICが存在しないScale-upネットワーク(NvLink・UALink等)向けのきめ細かいパケット単位ネットワーク計測ツールキット(ACM SIGCOMM 2026)。GPU通信カーネル(送受信コード)へアセンブリレベルのプローブを挿入するプロトコルレベル計測、GPU内蔵デバイスクロックによるGPTP(GPU版Precision Time Protocol)クロック同期、通信をメモリトラフィックとしてモデル化しCUPTIで物理層挙動(LLCヒット率等)を推定する三本柱を持つ。CUDA/NvLinkエコシステム向けに実装され、先行研究[[Neutrino]](同著者ら、OSDI'25)のGPUカーネルプロービング基盤を通信カーネル向けに拡張している。GitHub上でオープンソース化(github.com/open-neutrino/fabricperf)。(Source: [[@2026__SIGCOMM__FabricPerf - Measuring NIC-less Scale-Up Network through GPU Communication Kernel Profiling]])
H100 NVL8とGB200 NVL72上の実験で、GPTP同期誤差平均106.45ns・メモリモデル誤差平均3.17%・オーバーヘッド(オフライン0.6%/オンライン8.9%)を実証し、チャネル不均衡(work-stealingで46%改善)とLLCキャッシュ非効率(eviction優先度チューニングで読み取りヒット率34.86ポイント改善)という2つの新規知見をケーススタディとして提示した。
## 関連
- ソース: [[@2026__SIGCOMM__FabricPerf - Measuring NIC-less Scale-Up Network through GPU Communication Kernel Profiling]]
- 先行研究: [[Neutrino]]
- 開発者: [[Songlin Huang]] / [[Chenshu Wu]]
- 対象ハードウェア: [[NVLink]]
- 比較対象: [[NCCL]](nccl-tests)