sgr-interview-300

22-模型Serving(第 211–220 题)

题号 主题 文章
211 TensorFlow Serving的模型版本管理,金丝… 211.md
212 Triton Inference Server的动态批处… 212.md
213 模型量化部署,INT8的校准数据集选择? 213.md
214 GPU显存优化,模型并行与流水线并行? 214.md
215 边缘计算部署,模型压缩与端侧推理? 215.md
216 模型热更新,零停机部署的技术方案? 216.md
217 A/B测试框架,流量分割与实验正交性? 217.md
218 影子流量验证,线上数据的无风险测试? 218.md
219 服务降级策略,熔断与限流的触发条件? 219.md
220 全链路监控,延迟分解与异常定位? 220.md

返回总览