跳转到内容
搜索文档

索引错误代码

最后更新 查看 MarkdownAgent 设置

在 AI Search 接受上传、同步或抓取请求后,会在后台处理你的内容以便搜索。处理失败时,AI Search 会记录本页中的某个错误代码。部分错误仅影响单个条目;另一些会暂停整个实例。

由于该处理发生在请求成功之后,这些错误不会出现在原始 API 响应中。要查找它们,请检查 条目日志、条目详情或实例统计。请求失败时立即返回的错误单独记录在 API 错误代码 中。

错误的返回方式

索引错误是异步的:上传、同步或抓取请求可能成功,随后在 AI Search 处理内容时失败。它们分为两类:

  • 条目级错误 影响单个条目。该条目会变为 status: "error",而实例其余部分继续索引。
  • 实例级错误 影响整个实例。AI Search 会暂停索引,因为诸如来源、令牌、模型或限制等问题会阻止每个条目。

要重试单个失败条目,请检查 条目日志,修复明显的来源或配置问题,然后再次 同步该条目。对于网站与 R2 数据源,你也可以运行 来源同步作业

如果实例已暂停,请先解决根本原因,再恢复实例。

如果瞬时错误在重试后仍然存在,请向 Cloudflare 支持 提供条目 ID、实例 ID、错误代码与请求时间戳。

条目级错误

这些错误影响单个条目。该条目会变为 status: "error",而实例其余部分继续索引。请修复该条目或重试。

文件与内容

当 AI Search 无法读取、转换、分块或嵌入源文件时会出现这些错误。有关受支持的格式与文件大小限制,请参阅 数据源。有关分块与模型限制,请参阅 分块受支持的模型

错误 详情 建议操作
unknown_error 发生意外的处理错误。 检查 条目日志 中的失败步骤,然后再次 同步该条目。若错误持续,请 联系支持
over_size 文件超过允许的最大大小。 减小文件大小、拆分文件或排除它。查看 文件限制
unsupported_type 不支持该文件类型。 将文件转换为 受支持的文件类型,然后再次上传或同步。
file_not_found 在来源中未找到该文件。 恢复源文件,然后 同步该条目 或运行 来源同步作业。若文件是有意删除的,请运行来源同步以便 AI Search 更新索引。
invalid_url 文件 URL 无效。 修复 网站数据源 或 sitemap 中的 URL,然后运行来源同步作业。
file_is_corrupt 文件已损坏。 用不损坏的副本替换该文件,然后再次上传或同步。
file_is_password_locked 文件已加密或需要密码后 AI Search 才能读取其内容。 移除密码,上传未锁定的副本,然后再次同步该条目。
invalid_pdf AI Search 无法将该文件解析为有效 PDF。 上传可正常打开的 PDF,或将内容转换为其他 受支持的文件类型
unable_to_convert_to_markdown AI Search 无法将该文件转换为文本。 使用 受支持的文件类型,或用可提取文本替换扫描内容。
markdown_too_large AI Search 已转换该文件,但生成的 Markdown 超出了 AI Search 处理限制。 若源文件在 AI Search 文件限制 内,请 联系支持。作为权宜之计,可在可行时将源文件拆分为更小的文件。
markdown_conversion_empty AI Search 已转换该文件,但转换未返回可用文本。 确保文件包含可提取文本。扫描版或纯图像文件不会产生文本,请添加文本层或上传基于文本的版本。
file_content_empty 文件为空或仅包含标题。 添加可搜索的正文内容,然后再次上传或同步该文件。
chunk_too_large_for_storage AI Search 生成的分块超出了内部存储限制。 若你配置了较高的值,请降低 分块大小。若该条目仍然失败,请 联系支持
timeout_error 条目处理超时。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
file_length_exceed_embedding_model 文件对嵌入模型而言过长。 使用更小的源文件;若文件在文档限制内,请 联系支持
file_too_large_for_embedder 文件超过嵌入模型接受的最大字节大小。 使用更小的源文件;若文件在文档限制内,请 联系支持

网站抓取

当 AI Search 无法从 网站数据源 获取、渲染或纳入页面时会出现这些错误。AI Search 在后台使用 Browser Run 抓取并渲染页面,并为你管理该过程。

错误 详情 建议操作
too_many_redirects 爬虫跟随了过多重定向,或发现重定向循环。 修复 网站数据源 的重定向链,然后运行来源同步作业。
invalid_host_after_redirect 页面重定向到了当前抓取范围之外的主机名。 在条目日志中检查重定向目标。若应索引该目标,请 联系支持。否则,使用 路径过滤 排除原始 URL。
subdomains_not_allowed 该 URL 不在 AI Search 可为此网站数据源抓取的主机名范围内。 若该 URL 应由实例索引,请 联系支持。否则,使用 路径过滤 排除它。
blocked_by_robots_txt robots.txt 禁止了抓取。 更新 robots.txt,使 AI Search 爬虫 能够访问该站点。
blocked_by_robots_txt_path robots.txt 禁止了该路径。 robots.txt 中允许该路径;若不希望索引,请使用 路径过滤 排除它。
blocked_by_content_signal 站点通过 Content Signals 阻止了抓取。 查看 robots.txt 中的 Content Signals 指令。若不应索引该内容,请使用路径过滤排除。
excluded_by_path_filter 你的路径过滤排除了该条目。 若该条目应被索引,请查看 包含与排除规则
network_connection_lost 网络连接中断。 再次同步该条目。若错误持续,请检查来源是否可达。
crawl_got_http_error 爬虫收到了 HTTP 错误。 在条目日志中检查 HTTP 状态。修复源站响应或访问控制,然后运行来源同步作业。
crawl_got_http_401 爬虫收到了 401 Unauthorized 使该页面对爬虫可访问。对于受保护页面,配置 额外请求头 或 Cloudflare Access 服务凭据。
crawl_got_http_403 爬虫收到了 403 Forbidden 在访问控制与源站防火墙中允许 AI Search 爬虫
crawl_got_http_429 源站对爬虫进行了速率限制。 允许 AI Search 爬虫、提高源站限制,或使用 路径过滤 缩小抓取范围。
blocked_by_payment 站点返回了 402 Payment Required 使用路径过滤排除该页面。AI Search 不支持付费抓取。
blocked_by_waf Web 应用防火墙 (WAF) 阻止了爬虫。 在 WAF 中允许 AI Search 爬虫
blocked_by_bot_management 机器人控制阻止了爬虫。 在机器人防护设置中允许 AI Search 爬虫
blocked_by_turnstile Turnstile 阻止了爬虫。 允许 AI Search 爬虫,或使用 路径过滤 排除该页面。
http_4xx 站点返回了 HTTP 4xx 错误。 在条目日志中检查确切状态。修复 URL 或访问控制,或使用路径过滤排除该页面。
http_5xx 站点返回了 HTTP 5xx 错误。 修复源站健康状况,然后同步该条目或运行来源同步作业。
unreachable_timeout 爬虫在超时前无法到达该页面。 检查源站延迟、防火墙规则与页面可用性,然后运行来源同步作业。
unreachable_dns 来源域名未解析。 检查来源域名的 DNS 记录
page_limit_reached 托管爬虫达到了你的计划每日页面上限,因此本次运行中部分页面未被抓取。 升级到 Workers Paid 以获得无限每日抓取,或使用 路径过滤 减少范围内的页面。Free 计划每天最多抓取 500 页。请参阅 限制
browser_rendering_unknown_error Browser Run 返回了未知错误。 再次运行 来源同步作业。检查 Cloudflare Status,若同一页面持续失败请 联系支持
browser_rendering_authentication_error Browser Run 需要身份验证。 为受保护页面配置 额外请求头,或排除该页面。
browser_rendering_no_body_status_error Browser Run 未返回可供 AI Search 索引的页面内容。 若应索引该页面,请 联系支持。否则,使用 路径过滤 排除该页面。
browser_rendering_timeout_error Browser Run 超时。 再次运行 来源同步作业。检查 Cloudflare Status,若错误持续请 联系支持
browser_rendering_network_connection_closed_error 渲染期间浏览器连接关闭。 再次运行 来源同步作业。检查 Cloudflare Status,若错误持续请 联系支持
browser_rendering_server_refused_connection_error 源站拒绝了浏览器连接。 在源站网络控制中允许 AI Search 爬虫,然后运行来源同步作业。
browser_rendering_rate_limit_error Browser Run 受到速率限制。 稍后运行 来源同步作业。若错误持续,请 联系支持

模型与 AI Gateway

嵌入模型Workers AI、外部提供商或 AI Gateway 无法处理条目内容时会出现这些错误。

错误 详情 建议操作
error_embedding_data_with_workers_ai Workers AI 无法生成嵌入。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
workers_ai_invalid_input Workers AI 拒绝了输入。 检查文件内容、文件类型与 嵌入模型支持
workers_ai_free_allocation_exceeded 已超出 Workers AI 免费层配额。 查看 Workers AI 定价,等待配额重置,或升级你的 Workers 计划。
workers_ai_internal_error Workers AI 返回了内部错误。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
workers_ai_out_of_capacity_error Workers AI 容量不可用。 稍后重试,并查看 Workers AI 限制
workers_ai_timeout_error Workers AI 超时。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
error_external_model_unknown_error 外部嵌入模型返回了未知错误。 检查提供商状态与 AI Gateway 日志,然后再次同步该条目。
error_external_model_rate_limited 外部嵌入模型对请求进行了速率限制。 稍后运行 来源同步作业,或向模型提供商提高速率限制。在 AI Gateway 日志 中检查提供商响应。
error_external_model_unauthorized 外部嵌入模型拒绝了身份验证。 AI Gateway 中检查提供商凭据,然后再次同步该条目。
ai_gateway_request_blocked_firewall AI Gateway Guardrails 阻止了请求。 查看已配置网关的 AI Gateway Guardrails 提示设置,然后再次运行来源同步作业。
ai_gateway_dlp_blocked AI Gateway 数据丢失防护 (DLP) 阻止了内容。 查看 AI Gateway DLP 设置 与条目内容。
ai_gateway_response_blocked_firewall AI Gateway Guardrails 阻止了响应。 查看已配置网关的 AI Gateway Guardrails 响应设置,然后再次运行来源同步作业。
ai_gateway_rate_limited AI Gateway 对请求进行了速率限制。 稍后运行 来源同步作业。若错误持续,请 联系支持

存储与 Vectorize

当存储或索引条目失败,或实例达到容量限制时会出现这些错误。AI Search 在后台使用 Vectorize 存储向量,并为你管理该过程。

错误 详情 建议操作
r2_unknown_error R2 返回了未知错误。 再次运行 来源同步作业。检查 Cloudflare Status,若错误持续请 联系支持
r2_internal_error R2 返回了内部错误。 再次运行 来源同步作业。检查 Cloudflare Status,若错误持续请 联系支持
vectorize_rate_limited Vectorize 对操作进行了速率限制。 稍后运行 来源同步作业。若错误持续,请 联系支持
vectorize_ingestion_timeout Vectorize 未及时处理变更。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
vectorize_upstream_error Vectorize 返回了瞬时上游错误。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
hybrid_search_indexing_failed 混合搜索索引失败。 再次同步该条目。检查 Cloudflare Status,若错误持续请 联系支持
ai_search_is_full AI Search 实例已满。与混合搜索索引已满不同,这不会暂停实例。 为实例 申请更高上限,或创建另一个实例以索引更多内容。请参阅 限制

实例级错误

这些错误会暂停整个实例,并停止所有索引,直到解决根本原因并恢复实例。它们不同于手动暂停,或因一段时间不活动而自动暂停。

错误 详情 建议操作
r2_not_enabled 暂停实例。账户未启用 R2。 为账户启用 R2,然后恢复实例。
bucket_not_found 暂停实例。未找到来源 R2 存储桶。 检查 R2 数据源 的存储桶名称与账户,然后恢复实例。
bucket_unauthorized 暂停实例。AI Search 无法访问 R2 存储桶。 检查 服务 API 令牌 与 R2 存储桶权限,然后恢复实例。
external_source_missing_api_token 暂停实例。外部来源缺少 API 凭据。 添加或更新 服务 API 令牌,然后恢复实例。
bucket_name_invalid 暂停实例。R2 存储桶名称无效。 使用不含大写字母或下划线的有效存储桶名称,更新 R2 数据源,然后恢复实例。
invalid_custom_header 暂停实例。自定义抓取请求头无效。 移除或更新 额外请求头,然后恢复实例。
ai_gateway_not_configured 暂停实例。未找到实例上设置的 AI Gateway。 将实例的 ai_gateway_id 更新为 AI Gateway 中已有的网关,然后恢复实例。
hybrid_search_is_full 暂停实例。混合搜索索引已满。其文件上限低于标准实例上限,因此可能更早达到。 申请更高上限 以恢复实例,或创建另一个实例以索引更多内容。请参阅 限制

这篇文档对您有帮助吗?