| 31 |
TVM的Ansor和MetaSchedule的区别?如何搜索最优sche… |
031-TVM的Ansor和MetaSchedule的区别.md |
| 32 |
MLIR的设计哲学是什么?dialect、operation、`… |
032-MLIR的设计哲学是什么.md |
| 33 |
TorchInductor如何将PyTorch graph编译成Trit… |
033-TorchInductor如何将PyTorch-graph编译成Triton.md |
| 34 |
ONNX Runtime的图优化有哪些?`constant foldin… |
034-ONNX-Runtime的图优化有哪些.md |
| 35 |
TensorRT的plugin开发流程?如何支持dynamic shap… |
035-TensorRT的plugin开发流程.md |
| 36 |
解释loop tiling、loop unrolling、`ve… |
036-解释loop-tiling、loop-unrolling、vectoriza.md |
| 37 |
量化编译中的PTQ和QAT在编译器层面如何处理? |
037-量化编译中的PTQ和QAT在编译器层面如何处理.md |
| 38 |
稀疏化(sparsity)如何被编译器利用?`2:4 structure… |
038-稀疏化(sparsity)如何被编译器利用.md |
| 39 |
编译器的pass manager如何工作?top-down vs `… |
039-编译器的pass-manager如何工作.md |
| 40 |
如何为新的硬件后端添加编译器支持?以自定义AI芯片为例 |
040-如何为新的硬件后端添加编译器支持.md |
| 41 |
Apache TVM vs MLIR vs TorchDynamo,技术… |
041-Apache-TVM-vs-MLIR-vs-TorchDynamo,技术路线.md |
| 42 |
编译时优化和运行时优化的权衡?AOT vs JIT? |
042-编译时优化和运行时优化的权衡.md |
| 43 |
如何处理编译器的编译时间过长问题?缓存策略? |
043-如何处理编译器的编译时间过长问题.md |
| 44 |
operator decomposing和`operator fus… |
044-operator-decomposing和operator-fusion的边.md |
| 45 |
编译器如何处理control flow(if/while)?`traci… |
045-编译器如何处理control-flow(if-while).md |