# FabricPerf [[Songlin Huang]]・[[Chenshu Wu]]([[The University of Hong Kong]])が開発した、NICが存在しないScale-upネットワーク(NvLink・UALink等)向けのきめ細かいパケット単位ネットワーク計測ツールキット(ACM SIGCOMM 2026)。GPU通信カーネル(送受信コード)へアセンブリレベルのプローブを挿入するプロトコルレベル計測、GPU内蔵デバイスクロックによるGPTP(GPU版Precision Time Protocol)クロック同期、通信をメモリトラフィックとしてモデル化しCUPTIで物理層挙動(LLCヒット率等)を推定する三本柱を持つ。CUDA/NvLinkエコシステム向けに実装され、先行研究[[Neutrino]](同著者ら、OSDI'25)のGPUカーネルプロービング基盤を通信カーネル向けに拡張している。GitHub上でオープンソース化(github.com/open-neutrino/fabricperf)。(Source: [[@2026__SIGCOMM__FabricPerf - Measuring NIC-less Scale-Up Network through GPU Communication Kernel Profiling]]) H100 NVL8とGB200 NVL72上の実験で、GPTP同期誤差平均106.45ns・メモリモデル誤差平均3.17%・オーバーヘッド(オフライン0.6%/オンライン8.9%)を実証し、チャネル不均衡(work-stealingで46%改善)とLLCキャッシュ非効率(eviction優先度チューニングで読み取りヒット率34.86ポイント改善)という2つの新規知見をケーススタディとして提示した。 ## 関連 - ソース: [[@2026__SIGCOMM__FabricPerf - Measuring NIC-less Scale-Up Network through GPU Communication Kernel Profiling]] - 先行研究: [[Neutrino]] - 開発者: [[Songlin Huang]] / [[Chenshu Wu]] - 対象ハードウェア: [[NVLink]] - 比較対象: [[NCCL]](nccl-tests)