跳转到内容
搜索文档

AI Security for Apps(应用 AI 安全)

最后更新 查看 MarkdownAgent 设置

使用 大型语言模型(LLM)的应用会面临 LLM 处理输入所特有的威胁——提示注入攻击、提示中的 PII 泄露,以及与不安全主题相关的提示。

AI Security for Apps(原 Firewall for AI)通过专为这些 LLM 特定威胁设计的检测能力,补充您现有的 WAF 规则。它与模型无关——无论您使用哪种 LLM,检测均可工作。

  • PII 检测 — 检测传入提示中的个人身份信息 (PII),例如电话号码、电子邮件地址、社会保障号码和信用卡号。
  • 不安全与自定义主题检测 — 检测与暴力犯罪或仇恨言论等不安全主题相关的提示,或与您组织相关的自定义主题。
  • 提示注入检测 — 检测旨在破坏 LLM 预期行为的提示,例如试图让模型忽略其指令或泄露系统提示。

启用后,AI Security for Apps 会扫描发往标记为 cf-llm 的端点的传入请求,以查找可能包含威胁的 LLM 提示。目前,检测仅处理内容类型为 JSON(application/json)的请求。

根据扫描结果,Cloudflare 会填充 AI 检测字段——您可在 WAF 规则表达式中使用的字段。您可以通过两种方式使用这些字段:

可用性

AI Security for Apps 的功能因 Cloudflare 套餐而异:

功能 Free Pro Business Enterprise
LLM endpoint discovery(LLM 端点发现) — 自动识别 Web 资产中的 AI 驱动端点 Yes Yes Yes Yes
AI Security Log Mode Ruleset(AI 安全日志模式规则集) — 预构建规则集,在记录完整请求体的同时记录检测结果 No No No Paid add-on
AI detection fields(AI 检测字段) — PII 检测、提示注入评分、不安全主题检测、自定义主题 No No No Paid add-on

要获取 AI Security Log Mode Ruleset 的访问权限并启用 AI 检测字段,请联系您的客户经理。

AI Security for Apps 内置于 Cloudflare Web Application Firewall (WAF) — 必须先在您的 zone 上启用 WAF,检测字段才能被填充并用于规则表达式。

更多资源

这篇文档对您有帮助吗?