ai-infra-interview-305

第 99 题:ONNX Runtime的execution provider有哪些?CUDATensorRT、`Dire…

题目

ONNX Runtime的execution provider有哪些?CUDATensorRTDirectML


完整讲解

一、Execution Provider(EP)的作用

ONNX Runtime 的 Execution Provider 把算子在不同后端上执行:CPU、CUDA、TensorRT、DirectML 等。同一 ONNX 模型可切换 EP,在 GPU/CPU/不同框架间选择,无需改模型。

二、常见 EP

三、使用方式

创建 session 时指定 provider 列表:ort.InferenceSession(model_path, providers=['TensorRTExecutionProvider', 'CUDAExecutionProvider', 'CPUExecutionProvider']);按序 fallback:先试 TensorRT,再 CUDA,再 CPU。可传 EP 专属选项(如 TensorRT 的 fp16、cache 路径)。


面试要点


记忆要点

  1. EP = 后端;CPU/CUDA/TensorRT/DirectML 等。
  2. GPU 首选 CUDA 或 TensorRT;TensorRT 更优但依赖重。
  3. providers 列表决定优先级与 fallback。
返回模块 返回总览