開發生態
NVIDIA DOCA GPUNetIO 統一 GPU 驅動網路架構,整合 NCCL 等底層實作並推出輕量開源版
NVIDIA Developer一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。

NVIDIA 宣布 DOCA GPUNetIO 框架已發展為統一的 GPU 啟動網路(GPU-Initiated Networking)基礎架構,旨在將 CPU 移出分散式應用的資料傳輸關鍵路徑以降低延遲。
該框架結合 GPUDirect RDMA、GDA-KI(GPUDirect Async Kernel-Initiated)與 GDRCopy 技術。在運作機制上,CPU 僅負責控制路徑,負責建立傳輸物件並匯出至 GPU 記憶體;GPU 則透過 CUDA 核心在資料路徑上直接驅動 Ethernet、RDMA、Verbs 與 DMA 操作。
過去如 NVSHMEM、NCCL、UCX/NIXL 與 Aerial 5G SDK 等通訊函式庫皆各自維護獨立的 GDA-KI 實作,現已全數整合至 GPUNetIO 基礎上,以減少重複開發並共享最佳化成果。
為滿足生態系需求,NVIDIA 採雙軌並行發布:除了包含完整功能(支援 Ethernet、DMA 等)的 DOCA SDK 版本外,另推出輕量級的開源 GPUNetIO 專案。開源版專注於 RDMA-Verbs 實作,供需要完全開源的框架使用。該開源版本具備動態偵測能力,若執行時環境存在 DOCA SDK,可透過 `dlopen` 呼叫閉源的進階功能;若無則繼續使用開源實作,且兩者在 CUDA 裝置端皆保持一致的 API 介面。
讀原始報導本期分類