控制 AI Search 相似性缓存新鲜度
AI Search 现在让您能够更好地控制相似性缓存新鲜度。相似性缓存通过重用语义相似查询的响应,有助于降低延迟和推理成本。
通过这些更新,您可以选择允许重用响应的时间长度,并在缓存的响应可能过时时将其清除。
以前,AI Search 缓存响应的固定时间为 30 天。缓存的响应现在使用实例的 cache_ttl 设置,默认值为 48 小时。
您可以在创建或更新实例时设置 cache_ttl,以选择从 10 分钟到 6 天不等的缓存持续时间。
当您的源内容变化频繁且新鲜度更重要时,请使用较短的 TTL。当您的内容稳定且您希望更多地重用缓存时,请使用较长的 TTL。
例如,将 cache_ttl 设置为 518400 以将缓存的响应保留 6 天:
{
"cache_ttl": 518400
}您还可以按需清除实例的所有缓存响应。清除缓存响应不会删除已索引的内容或源文件。
这会阻止 AI Search 重用以前缓存的响应,因此后续的相似查询会生成新鲜的答案并重新填充缓存。
curl -X POST "https://api.cloudflare.com/client/v4/accounts/$ACCOUNT_ID/ai-search/instances/$INSTANCE_NAME/purge_cache" \
-H "Authorization: Bearer $CLOUDFLARE_API_TOKEN"您还可以从 Cloudflare 仪表板中的实例设置页面清除缓存响应。
请参阅相似性缓存以获取支持的 cache_ttl 值的完整列表以及有关缓存行为的更多详细信息。