ai-infra-interview-305

第 245 题:推理服务的safety guardrails?内容过滤、速率限制?

题目

推理服务的safety guardrails?内容过滤、速率限制?


完整讲解

一、Safety guardrails 的含义

安全护栏:在推理 输入与输出 上做 内容过滤、滥用检测、速率限制,保证 合规、防滥用、可控风险。例如:禁止违法/违规内容限速防刷敏感信息脱敏

二、内容过滤

输入Prompt 过滤— 检测并拒绝 越狱、恶意指令、敏感词;可用 规则 + 分类模型(如敏感词表、小模型分类)。输出Response 过滤— 对生成结果做 敏感内容、PII、违规 检测;截断或替换 后再返回,或 拒绝生成 并返回安全提示。多模态:图/视频输入也需 内容审核(暴恐、违规图);可调用 审核 API 或模型 做前置或后置。

三、速率限制

限速:按 user_id、API key、IP 等维度限制 QPS 或并发,防止 单用户占满恶意刷量实现网关层推理网关令牌桶/漏桶滑动窗口 计数;超限返回 429 或排队。分级:不同用户/套餐 不同限速;与 计费与 quota 一致。Guardrails业务策略 结合:过滤规则可配置、可 A/B;限速与套餐与成本挂钩。

面试要点


记忆要点

  1. Guardrails = 内容过滤 + 限速。
  2. 输入/输出过滤;多模态审核。
  3. 限速按维度;429;可配置、与套餐一致。
返回模块 返回总览