配置式(profile)设置用于控制单个 DLP 配置式的检测行为。当您构建自定义配置式或编辑现有的预定义或自定义配置式时,需要配置这些设置。
配置式设置与 DLP 设置不同,DLP 设置是适用于所有配置式和策略的账户级别设置。
要编辑现有预定义或自定义 DLP 配置式的配置式设置:
- 在 Cloudflare 仪表板 ↗中,转到 Zero Trust > Data loss prevention(数据防泄露) > Profiles(配置文件)。
- 选择一个配置式,然后选择 Edit(编辑)。
- 在 Settings(设置) 中,为您的配置式配置设置。
- 选择 Save profile(保存配置文件)。
预定义和自定义 DLP 配置式提供以下高级检测设置。
匹配计数(match count)设置触发操作所需的最低检测数量阈值。在检测计数达到此阈值之前,DLP 不会阻止内容或记录日志。
例如,如果您设置匹配计数为 10,当 DLP 在单个文件或 HTTP 正文中找到 10 个或更多匹配项时,将采取操作。匹配项不一定是唯一的 — 同一个信用卡号出现 10 次将被计为 10 次匹配。
光学字符识别 (OCR) 可提取并分析图像文件中的文本。启用后,DLP 能够检测用户上传或下载的图像中的敏感数据。
OCR 支持扫描 .jpg/.jpeg 和 .png 文件,其大小介于 4 KB 到 1 MB 之间。文本以 UTF-8 格式编码,包括支持非拉丁字符。
有关更多信息,请参阅 DLP 设置。
AI 上下文分析使用机器学习模型来评估检测的周围上下文并调整其置信度级别。该模型检查附近的文本,以确定模式匹配是真正的敏感数据还是误报。
例如,如果一个与信用卡模式匹配的 16 位数字出现在不太可能出现信用卡号的上下文中(例如产品 SKU 列表),它可能会获得较低的置信度评分。相反,如果该数字出现在“payment(付款)”或“billing(计费)”等词项附近,它将获得较高的置信度评分。DLP 会记录达到或超过您配置的置信度阈值的匹配。
有关 AI 上下文分析的完整文档,请参阅 DLP 设置。
置信度阈值表示 Cloudflare DLP 对检测的置信程度。DLP 通过检查内容中的邻近关键字(出现在检测数据附近的关联词项)来确定置信度级别。例如,出现在 9 位数字附近的单词“SSN”会增加该数字是社会安全号码的置信度。
当您在配置式上设置置信度阈值时,DLP 仅在达到或超过该级别的检测上触发:
- Low(默认)— 基于带有少量邻近关键字的正则表达式。这是最包容的设置,对误报有很高的容忍度。
- Medium — 应用额外的验证,以过滤掉低置信度的检测。此设置对误报具有中等容忍度。
- Medium — 应用额外的验证,以过滤掉低置信度的检测。此设置对误报具有中等容忍度。
置信度阈值是在 DLP 配置式上设置的。并非所有检测条目都支持置信度阈值 — 当您在仪表板中选择阈值时,支持置信度评分的条目将显示其当前级别。未显示置信度级别的条目要么不支持此功能,要么使用的是不适用置信度评分的检测方法(例如精确匹配)。
要更改 DLP 配置式的置信度阈值:
- 在 Cloudflare 仪表板 ↗中,转到 Zero Trust > Data loss prevention(数据防泄露) > Profiles(配置文件)。
- 选择该配置式,然后选择 Edit(编辑)。
- 在 Settings(设置) > Confidence threshold 中,从下拉菜单中选择一个新的置信度阈值。
- 选择 Save profile(保存配置文件)。
对于 Gateway 中的内联检测,您可以记录较低置信度的匹配,同时仅阻止高置信度的检测。这种方式需要两个具有不同 DLP 配置式的 HTTP 策略:
- 具有 Allow 操作的 Low 或 Medium 置信度配置式 — 记录检测而不进行阻止。
- 具有 Block 操作的 High 置信度配置式 — 阻止请求。
例如:
| 选择器 | 运算符 | 值 | 操作 |
|---|---|---|---|
| DLP Profile(DLP 配置文件) | in | Low Confidence Detections | Allow(允许) |
| 选择器 | 运算符 | 值 | 操作 |
|---|---|---|---|
| DLP Profile(DLP 配置文件) | in | Medium Confidence Detections | Allow(允许) |
| 选择器 | 运算符 | 值 | 操作 |
|---|---|---|---|
| DLP Profile(DLP 配置文件) | in | High Confidence Detections | Block(阻止) |