L1.8 Linux cgroups、NUMA 与 IRQ 亲和
三维坐标
layer: L1(算力与编排)|level: Senior|pillar: 硬件架构L1.2 讲了 NVLink/PCIe 拓扑;L1.4 提到「GPU 挂在某 NUMA node 下」。本章把操作系统层的隔离与亲和性讲透:为什么 DataLoader 和 GPU 不在同一 NUMA 会吃掉 20%+ 吞吐、为什么网卡中断打在训练核上会让 GPU 利用率「虚高且锯齿」,以及如何用 cgroups /
numactl/taskset/ IRQ 亲和把这些系统侧损耗一一收口。读完你应当能回答:「同型号两台机器,为什么训练吞吐能差 30%」。