# 統合メモリ ## 定義 CPU と GPU が単一の物理メモリを共有し、ホストとデバイスの区別やコピーなしに同じデータへ直接ロード・ストアできるメモリモデルである。ページ移行で見かけだけ統一する方式と異なり、物理構成をプログラマの見え方に一致させる。([[@2024__ISCA__Realizing the AMD Exascale Heterogeneous Processor Vision]]) ## 未解決の問い - 同一メモリを CPU と GPU が同時に叩くとき、ソフトウェア側の同期・粒度の設計はどこまで単純化できるか。 ## 未編纂の観察 - **コード量と帯域の両面の利点**: [[AMD Instinct MI300A]] では hipMalloc と hipMemcpy が不要になり、離散 GPU で PCIe(数十 GB/s)に律速される CPU-GPU 間転送が消える。完了フラグで CPU と GPU の実行を重ねることや、BLAS・LAPACK 呼び出しの自動オフロードも可能になる。(Source: [[@2024__ISCA__Realizing the AMD Exascale Heterogeneous Processor Vision]]) ## 関連 - 概念: [[APU]] / [[High Bandwidth Memory]] / [[NUMAメモリ配置]] - エンティティ: [[AMD Instinct MI300A]] - ソース: [[@2024__ISCA__Realizing the AMD Exascale Heterogeneous Processor Vision]]