ai-infra-interview-305

第 33 题:TorchInductor如何将PyTorch graph编译成Triton kernel?

题目

TorchInductor如何将PyTorch graph编译成Triton kernel?


完整讲解

一、TorchInductor 的定位

TorchInductor 是 PyTorch 2 的 默认编译后端:把 FX graph(或 Dynamo 捕获的 graph)转成 高性能代码;对 GPU 主要生成 Triton kernel,对 CPU 生成 C++/OpenMP 等。流程大致:Graph 捕获图级优化lowering 到 Inductor IR(ops)按 op/融合块生成 Triton 或 C++编译并调用

二、从 PyTorch graph 到 Triton 的步骤

三、关键点


面试要点


记忆要点

  1. 路径:PyTorch graph → 图优化 → Inductor IR → 按 fusion 生成 Triton → 编译成 kernel。
  2. Scheduler 决定哪些 op 进同一 kernel;codegen 出 Triton Python,Triton 编译出 so。
  3. Triton 作为目标:易融合、易 tune、与 PyTorch 栈一致。
返回模块 返回总览