跳转到内容
搜索文档

更新日志

最后更新 查看 MarkdownAgent 设置
Subscribe to RSS

2026-06-11


在 AI Gateway 日志中查看请求的用户代理(User Agent)

AI Gateway 日志现在能够捕获发起每个请求的客户端的用户代理(User Agent),从而更容易识别是哪个 SDK、库或应用程序发送了流经您网关的流量。例如,您可以区分来自 openai-python 的请求与来自自定义应用程序或 Cloudflare Worker 的请求。

用户代理会与每个日志条目中的其他详细信息一起显示,并且您可以在仪表板中按用户代理(等于、不等于或包含)对日志进行筛选。

欲了解更多信息,请参阅日志记录

2026-06-04


使用支出限制控制 AI 成本

AI Gateway 现在支持支出限制(spend limits)——基于成本的预算,可追踪累计美元支出,并在超出预算时拦截请求。与限制请求次数的速率限制不同,支出限制是基于 Token 使用量和模型定价来追踪实际成本。

您可以按模型、提供商或自定义元数据维度来限定限制范围。例如,为每个用户分配每日 200 美元的预算,将网关总支出限制在每日 10,000 美元以内,或者限制每个用户对特定模型的每日支出上限为 50 美元。每条规则都使用可配置的时间窗口,可采用固定或滑动执行策略。

支出限制适用于具有已知定价模型的 统一计费(Unified Billing)BYOK(自带密钥) 请求。

欲了解更多细节,请参阅支出限制文档

2026-05-20


通过 AI Gateway 全新的 REST API 调用任何 AI 模型

AI Gateway 现在开始使用 api.cloudflare.com 上的 AI REST API。无论提供商是 OpenAI、Anthropic、Google 还是托管在 Workers AI 上,您都可以通过一个统一的 API 调用任何模型,并使用相同的端点和身份验证方式。共有四个端点可用:

  • POST /ai/run — 适用于所有模型和模态的通用端点
  • POST /ai/v1/chat/completions — 兼容 OpenAI SDK
  • POST /ai/v1/responses — 兼容 OpenAI Responses API
  • POST /ai/v1/messages — 兼容 Anthropic SDK
curl -X POST "https://api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/v1/chat/completions" \
  --header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "openai/gpt-5.5",
    "messages": [{"role": "user", "content": "What is Cloudflare?"}]
  }'

所有的 AI Gateway 功能(日志记录、缓存、速率限制和护栏)都会自动应用。第三方模型将通过统一计费(Unified Billing)进行计费,因此您无需管理单独的提供商 API 密钥。

第三方模型请求将通过您账户的默认网关(Gateway)进行路由,该网关会在首次使用时自动创建。若要通过特定网关路由请求,请添加 cf-aig-gateway-id 标头。

如果您已经通过现有的 REST API 调用 Workers AI 模型,该路径(/ai/run/@cf/{model})将继续有效。若要通过 AI Gateway 调用 Workers AI 模型,请使用 @cf/ 模型前缀(例如,@cf/moonshotai/kimi-k2.6)并包含 cf-aig-gateway-id 标头来指定要路由到的网关。

欲了解更多细节和示例,请参阅 REST API 文档

这篇文档对您有帮助吗?