在 AI Search 接受上传、同步或抓取请求后,会在后台处理你的内容以便搜索。处理失败时,AI Search 会记录本页中的某个错误代码。部分错误仅影响单个条目;另一些会暂停整个实例。
由于该处理发生在请求成功之后,这些错误不会出现在原始 API 响应中。要查找它们,请检查 条目日志、条目详情或实例统计。请求失败时立即返回的错误单独记录在 API 错误代码 中。
索引错误是异步的:上传、同步或抓取请求可能成功,随后在 AI Search 处理内容时失败。它们分为两类:
- 条目级错误 影响单个条目。该条目会变为
status: "error",而实例其余部分继续索引。 - 实例级错误 影响整个实例。AI Search 会暂停索引,因为诸如来源、令牌、模型或限制等问题会阻止每个条目。
要重试单个失败条目,请检查 条目日志,修复明显的来源或配置问题,然后再次 同步该条目。对于网站与 R2 数据源,你也可以运行 来源同步作业。
如果实例已暂停,请先解决根本原因,再恢复实例。
如果瞬时错误在重试后仍然存在,请向 Cloudflare 支持 提供条目 ID、实例 ID、错误代码与请求时间戳。
这些错误影响单个条目。该条目会变为 status: "error",而实例其余部分继续索引。请修复该条目或重试。
当 AI Search 无法读取、转换、分块或嵌入源文件时会出现这些错误。有关受支持的格式与文件大小限制,请参阅 数据源。有关分块与模型限制,请参阅 分块 与 受支持的模型。
| 错误 | 详情 | 建议操作 |
|---|---|---|
unknown_error |
发生意外的处理错误。 | 检查 条目日志 中的失败步骤,然后再次 同步该条目。若错误持续,请 联系支持。 |
over_size |
文件超过允许的最大大小。 | 减小文件大小、拆分文件或排除它。查看 文件限制。 |
unsupported_type |
不支持该文件类型。 | 将文件转换为 受支持的文件类型,然后再次上传或同步。 |
file_not_found |
在来源中未找到该文件。 | 恢复源文件,然后 同步该条目 或运行 来源同步作业。若文件是有意删除的,请运行来源同步以便 AI Search 更新索引。 |
invalid_url |
文件 URL 无效。 | 修复 网站数据源 或 sitemap 中的 URL,然后运行来源同步作业。 |
file_is_corrupt |
文件已损坏。 | 用不损坏的副本替换该文件,然后再次上传或同步。 |
file_is_password_locked |
文件已加密或需要密码后 AI Search 才能读取其内容。 | 移除密码,上传未锁定的副本,然后再次同步该条目。 |
invalid_pdf |
AI Search 无法将该文件解析为有效 PDF。 | 上传可正常打开的 PDF,或将内容转换为其他 受支持的文件类型。 |
unable_to_convert_to_markdown |
AI Search 无法将该文件转换为文本。 | 使用 受支持的文件类型,或用可提取文本替换扫描内容。 |
markdown_too_large |
AI Search 已转换该文件,但生成的 Markdown 超出了 AI Search 处理限制。 | 若源文件在 AI Search 文件限制 内,请 联系支持。作为权宜之计,可在可行时将源文件拆分为更小的文件。 |
markdown_conversion_empty |
AI Search 已转换该文件,但转换未返回可用文本。 | 确保文件包含可提取文本。扫描版或纯图像文件不会产生文本,请添加文本层或上传基于文本的版本。 |
file_content_empty |
文件为空或仅包含标题。 | 添加可搜索的正文内容,然后再次上传或同步该文件。 |
chunk_too_large_for_storage |
AI Search 生成的分块超出了内部存储限制。 | 若你配置了较高的值,请降低 分块大小。若该条目仍然失败,请 联系支持。 |
timeout_error |
条目处理超时。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
file_length_exceed_embedding_model |
文件对嵌入模型而言过长。 | 使用更小的源文件;若文件在文档限制内,请 联系支持。 |
file_too_large_for_embedder |
文件超过嵌入模型接受的最大字节大小。 | 使用更小的源文件;若文件在文档限制内,请 联系支持。 |
当 AI Search 无法从 网站数据源 获取、渲染或纳入页面时会出现这些错误。AI Search 在后台使用 Browser Run 抓取并渲染页面,并为你管理该过程。
| 错误 | 详情 | 建议操作 |
|---|---|---|
too_many_redirects |
爬虫跟随了过多重定向,或发现重定向循环。 | 修复 网站数据源 的重定向链,然后运行来源同步作业。 |
invalid_host_after_redirect |
页面重定向到了当前抓取范围之外的主机名。 | 在条目日志中检查重定向目标。若应索引该目标,请 联系支持。否则,使用 路径过滤 排除原始 URL。 |
subdomains_not_allowed |
该 URL 不在 AI Search 可为此网站数据源抓取的主机名范围内。 | 若该 URL 应由实例索引,请 联系支持。否则,使用 路径过滤 排除它。 |
blocked_by_robots_txt |
robots.txt 禁止了抓取。 |
更新 robots.txt,使 AI Search 爬虫 能够访问该站点。 |
blocked_by_robots_txt_path |
robots.txt 禁止了该路径。 |
在 robots.txt 中允许该路径;若不希望索引,请使用 路径过滤 排除它。 |
blocked_by_content_signal |
站点通过 Content Signals 阻止了抓取。 | 查看 robots.txt 中的 Content Signals 指令。若不应索引该内容,请使用路径过滤排除。 |
excluded_by_path_filter |
你的路径过滤排除了该条目。 | 若该条目应被索引,请查看 包含与排除规则。 |
network_connection_lost |
网络连接中断。 | 再次同步该条目。若错误持续,请检查来源是否可达。 |
crawl_got_http_error |
爬虫收到了 HTTP 错误。 | 在条目日志中检查 HTTP 状态。修复源站响应或访问控制,然后运行来源同步作业。 |
crawl_got_http_401 |
爬虫收到了 401 Unauthorized。 |
使该页面对爬虫可访问。对于受保护页面,配置 额外请求头 或 Cloudflare Access 服务凭据。 |
crawl_got_http_403 |
爬虫收到了 403 Forbidden。 |
在访问控制与源站防火墙中允许 AI Search 爬虫。 |
crawl_got_http_429 |
源站对爬虫进行了速率限制。 | 允许 AI Search 爬虫、提高源站限制,或使用 路径过滤 缩小抓取范围。 |
blocked_by_payment |
站点返回了 402 Payment Required。 |
使用路径过滤排除该页面。AI Search 不支持付费抓取。 |
blocked_by_waf |
Web 应用防火墙 (WAF) 阻止了爬虫。 | 在 WAF 中允许 AI Search 爬虫。 |
blocked_by_bot_management |
机器人控制阻止了爬虫。 | 在机器人防护设置中允许 AI Search 爬虫。 |
blocked_by_turnstile |
Turnstile 阻止了爬虫。 | 允许 AI Search 爬虫,或使用 路径过滤 排除该页面。 |
http_4xx |
站点返回了 HTTP 4xx 错误。 | 在条目日志中检查确切状态。修复 URL 或访问控制,或使用路径过滤排除该页面。 |
http_5xx |
站点返回了 HTTP 5xx 错误。 | 修复源站健康状况,然后同步该条目或运行来源同步作业。 |
unreachable_timeout |
爬虫在超时前无法到达该页面。 | 检查源站延迟、防火墙规则与页面可用性,然后运行来源同步作业。 |
unreachable_dns |
来源域名未解析。 | 检查来源域名的 DNS 记录。 |
page_limit_reached |
托管爬虫达到了你的计划每日页面上限,因此本次运行中部分页面未被抓取。 | 升级到 Workers Paid 以获得无限每日抓取,或使用 路径过滤 减少范围内的页面。Free 计划每天最多抓取 500 页。请参阅 限制。 |
browser_rendering_unknown_error |
Browser Run 返回了未知错误。 | 再次运行 来源同步作业。检查 Cloudflare Status ↗,若同一页面持续失败请 联系支持。 |
browser_rendering_authentication_error |
Browser Run 需要身份验证。 | 为受保护页面配置 额外请求头,或排除该页面。 |
browser_rendering_no_body_status_error |
Browser Run 未返回可供 AI Search 索引的页面内容。 | 若应索引该页面,请 联系支持。否则,使用 路径过滤 排除该页面。 |
browser_rendering_timeout_error |
Browser Run 超时。 | 再次运行 来源同步作业。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
browser_rendering_network_connection_closed_error |
渲染期间浏览器连接关闭。 | 再次运行 来源同步作业。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
browser_rendering_server_refused_connection_error |
源站拒绝了浏览器连接。 | 在源站网络控制中允许 AI Search 爬虫,然后运行来源同步作业。 |
browser_rendering_rate_limit_error |
Browser Run 受到速率限制。 | 稍后运行 来源同步作业。若错误持续,请 联系支持。 |
当 嵌入模型、Workers AI、外部提供商或 AI Gateway 无法处理条目内容时会出现这些错误。
| 错误 | 详情 | 建议操作 |
|---|---|---|
error_embedding_data_with_workers_ai |
Workers AI 无法生成嵌入。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
workers_ai_invalid_input |
Workers AI 拒绝了输入。 | 检查文件内容、文件类型与 嵌入模型支持。 |
workers_ai_free_allocation_exceeded |
已超出 Workers AI 免费层配额。 | 查看 Workers AI 定价,等待配额重置,或升级你的 Workers 计划。 |
workers_ai_internal_error |
Workers AI 返回了内部错误。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
workers_ai_out_of_capacity_error |
Workers AI 容量不可用。 | 稍后重试,并查看 Workers AI 限制。 |
workers_ai_timeout_error |
Workers AI 超时。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
error_external_model_unknown_error |
外部嵌入模型返回了未知错误。 | 检查提供商状态与 AI Gateway 日志,然后再次同步该条目。 |
error_external_model_rate_limited |
外部嵌入模型对请求进行了速率限制。 | 稍后运行 来源同步作业,或向模型提供商提高速率限制。在 AI Gateway 日志 中检查提供商响应。 |
error_external_model_unauthorized |
外部嵌入模型拒绝了身份验证。 | 在 AI Gateway 中检查提供商凭据,然后再次同步该条目。 |
ai_gateway_request_blocked_firewall |
AI Gateway Guardrails 阻止了请求。 | 查看已配置网关的 AI Gateway Guardrails 提示设置,然后再次运行来源同步作业。 |
ai_gateway_dlp_blocked |
AI Gateway 数据丢失防护 (DLP) 阻止了内容。 | 查看 AI Gateway DLP 设置 与条目内容。 |
ai_gateway_response_blocked_firewall |
AI Gateway Guardrails 阻止了响应。 | 查看已配置网关的 AI Gateway Guardrails 响应设置,然后再次运行来源同步作业。 |
ai_gateway_rate_limited |
AI Gateway 对请求进行了速率限制。 | 稍后运行 来源同步作业。若错误持续,请 联系支持。 |
当存储或索引条目失败,或实例达到容量限制时会出现这些错误。AI Search 在后台使用 Vectorize 存储向量,并为你管理该过程。
| 错误 | 详情 | 建议操作 |
|---|---|---|
r2_unknown_error |
R2 返回了未知错误。 | 再次运行 来源同步作业。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
r2_internal_error |
R2 返回了内部错误。 | 再次运行 来源同步作业。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
vectorize_rate_limited |
Vectorize 对操作进行了速率限制。 | 稍后运行 来源同步作业。若错误持续,请 联系支持。 |
vectorize_ingestion_timeout |
Vectorize 未及时处理变更。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
vectorize_upstream_error |
Vectorize 返回了瞬时上游错误。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
hybrid_search_indexing_failed |
混合搜索索引失败。 | 再次同步该条目。检查 Cloudflare Status ↗,若错误持续请 联系支持。 |
ai_search_is_full |
AI Search 实例已满。与混合搜索索引已满不同,这不会暂停实例。 | 为实例 申请更高上限 ↗,或创建另一个实例以索引更多内容。请参阅 限制。 |
这些错误会暂停整个实例,并停止所有索引,直到解决根本原因并恢复实例。它们不同于手动暂停,或因一段时间不活动而自动暂停。
| 错误 | 详情 | 建议操作 |
|---|---|---|
r2_not_enabled |
暂停实例。账户未启用 R2。 | 为账户启用 R2,然后恢复实例。 |
bucket_not_found |
暂停实例。未找到来源 R2 存储桶。 | 检查 R2 数据源 的存储桶名称与账户,然后恢复实例。 |
bucket_unauthorized |
暂停实例。AI Search 无法访问 R2 存储桶。 | 检查 服务 API 令牌 与 R2 存储桶权限,然后恢复实例。 |
external_source_missing_api_token |
暂停实例。外部来源缺少 API 凭据。 | 添加或更新 服务 API 令牌,然后恢复实例。 |
bucket_name_invalid |
暂停实例。R2 存储桶名称无效。 | 使用不含大写字母或下划线的有效存储桶名称,更新 R2 数据源,然后恢复实例。 |
invalid_custom_header |
暂停实例。自定义抓取请求头无效。 | 移除或更新 额外请求头,然后恢复实例。 |
ai_gateway_not_configured |
暂停实例。未找到实例上设置的 AI Gateway。 | 将实例的 ai_gateway_id 更新为 AI Gateway 中已有的网关,然后恢复实例。 |
hybrid_search_is_full |
暂停实例。混合搜索索引已满。其文件上限低于标准实例上限,因此可能更早达到。 | 申请更高上限 ↗ 以恢复实例,或创建另一个实例以索引更多内容。请参阅 限制。 |