ai-infra-interview-305

第 175 题:GPU集群的topology awareness调度?NVLink拓扑?

题目

GPU集群的topology awareness调度?NVLink拓扑?


完整讲解

一、Topology awareness 的意义

拓扑感知调度:在分配 GPU(或 NUMA、网卡)时,考虑硬件拓扑(如 NVLink 连接、PCIe 树、NUMA 节点),优先把同一作业的 GPU 安排在通信延迟低、带宽高的组内,从而提升 all-reduce 等通信效率、缩短训练时间。

NVLink:GPU 间高速直连;同一节点内多卡可能通过 NVLink 全连接(如 8×A100 全连)或部分连接。调度时若「尽量把同一 job 的 8 卡放在同一节点、且选 NVLink 拓扑最优的节点」,可最大化带宽。多节点:节点间通过 IB/RoCE;同一 job 的节点宜在相近拓扑(同 rack、同 leaf)以减少跨级跳数。

三、实现方式

面试要点


记忆要点

  1. 拓扑感知 = 按 NVLink/NUMA 等优化放置,减少通信延迟与带宽瓶颈。
  2. 同节点 NVLink、多节点 IB/RoCE + 同 rack 有利于通信。
  3. 设备插件暴露拓扑;调度器 Score/Volcano/Slurm 做拓扑感知。
返回模块 返回总览