multi-tenancy的GPU共享?MPS vs MIG?多模型multi-tenancy的GPU共享?MPS vs MIG?
多模型/多租户 共享同一 GPU:提高利用率、降成本;需 隔离(显存、算力、延迟)避免互相干扰。手段:MPS(多进程共享一卡)、MIG(多实例 GPU,硬件分区)、多进程/多容器 各占部分显存与时间片。
MPS(Multi-Process Service):多进程共享同一 GPU context,由 驱动做时间片调度;显存 各进程分配但共享设备,算力 共享。优点:实现简单、无需硬件分区;缺点:无硬隔离,某进程大 kernel 会阻塞其他、公平性与长尾 难保证。MIG(Multi-Instance GPU):A100 等 可将单卡 硬件划分 为多份 MIG 实例,每实例有 独立显存与算力,强隔离。优点:隔离好、可预测;缺点:仅部分型号支持、分区粒度固定、总利用率可能略降。
| 返回模块 | 返回总览 |