使用 大型语言模型(LLM)的应用会面临 LLM 处理输入所特有的威胁——提示注入攻击、提示中的 PII 泄露,以及与不安全主题相关的提示。
AI Security for Apps(原 Firewall for AI)通过专为这些 LLM 特定威胁设计的检测能力,补充您现有的 WAF 规则。它与模型无关——无论您使用哪种 LLM,检测均可工作。
- PII 检测 — 检测传入提示中的个人身份信息 (PII),例如电话号码、电子邮件地址、社会保障号码和信用卡号。
- 不安全与自定义主题检测 — 检测与暴力犯罪或仇恨言论等不安全主题相关的提示,或与您组织相关的自定义主题。
- 提示注入检测 — 检测旨在破坏 LLM 预期行为的提示,例如试图让模型忽略其指令或泄露系统提示。
启用后,AI Security for Apps 会扫描发往标记为 cf-llm 的端点的传入请求,以查找可能包含威胁的 LLM 提示。目前,检测仅处理内容类型为 JSON(application/json)的请求。
根据扫描结果,Cloudflare 会填充 AI 检测字段——您可在 WAF 规则表达式中使用的字段。您可以通过两种方式使用这些字段:
- 监控: 在 Security Analytics 中按
cf-llm标签筛选,以查看流量中的检测结果。 - 缓解: 在自定义规则或速率限制规则中使用这些字段,根据检测结果阻止或质询请求。
AI Security for Apps 的功能因 Cloudflare 套餐而异:
| 功能 | Free | Pro | Business | Enterprise |
|---|---|---|---|---|
| LLM endpoint discovery(LLM 端点发现) — 自动识别 Web 资产中的 AI 驱动端点 | Yes | Yes | Yes | Yes |
| AI Security Log Mode Ruleset(AI 安全日志模式规则集) — 预构建规则集,在记录完整请求体的同时记录检测结果 | No | No | No | Paid add-on |
| AI detection fields(AI 检测字段) — PII 检测、提示注入评分、不安全主题检测、自定义主题 | No | No | No | Paid add-on |
要获取 AI Security Log Mode Ruleset 的访问权限并启用 AI 检测字段,请联系您的客户经理。
AI Security for Apps 内置于 Cloudflare Web Application Firewall (WAF) — 必须先在您的 zone 上启用 WAF,检测字段才能被填充并用于规则表达式。
- AI Gateway — 监控、控制并缓存发往 LLM 提供商的请求。
- What are the OWASP Top 10 risks for LLMs? ↗ — 关于 LLM 驱动应用最常见安全风险的背景信息。