ai-infra-interview-305

第 43 题:如何处理编译器的编译时间过长问题?缓存策略?

题目

如何处理编译器的编译时间过长问题?缓存策略?


完整讲解

一、编译时间为什么长?

AI 编译器要做的多:图优化(融合、等价替换)、schedule 搜索(auto-tune、多配置尝试)、lowering(多级 IR)、codegen(生成并调外部编译器如 nvcc/llvm)。尤其是 搜索/枚举多 shape/多后端 会成倍放大时间;首次cache 未命中 时用户会明显感到编译慢。

二、缓存策略

三、其他减编译时间的手段


面试要点


记忆要点

  1. 慢在:图优化、搜索、lowering、codegen;搜索与多 shape 放大时间。
  2. 缓存 key:图 hash、shape/config、guard;命中则加载 so/engine,否则编译并写缓存。
  3. 持久化、版本、预编译、超时降级可进一步减感知延迟。
返回模块 返回总览