跳转到内容
搜索文档

转换选项

最后更新 查看 MarkdownAgent 设置

默认情况下,toMarkdown 服务从您的文件中提取文本内容。要进一步扩展转换过程的能力,您可以向服务传递选项以控制特定文件类型的转换方式。

选项按文件类型组织,均为可选。

可用选项

输出

{
  output?: {
    format?: 'markdown' | 'text';
  }
}
  • format:控制转换内容的格式。默认为 markdown。设置为 text 以接收移除 Markdown 语法的纯文本。

formattext 时,ConversionResultformat 字段也设置为 text

图像

{
  image?: {
    descriptionLanguage?: 'en' | 'it' | 'de' | 'es' | 'fr' | 'pt';
  }
}
  • descriptionLanguage:控制 AI 生成图像描述的语言。

HTML

{
  html?: {
    hostname?: string;
    cssSelector?: string;
  }
}
  • hostname:解析 HTML 内相对链接时用作 host 的字符串。

  • cssSelector:包含 CSS 选择器模式的字符串,用于从 HTML 中选取特定元素。请参阅 HTML 处理方式了解更多详情。

PDF

{
  pdf?: {
    metadata?: boolean;
  }
}
  • metadata:以前,所有转换的 PDF 文件在转换时总是包含元数据信息。此选项允许您选择退出此行为。

示例

绑定(binding)

要配置自定义选项,在绑定调用的第二个参数内传递 conversionOptions 对象,如下所示:

await env.AI.toMarkdown(..., {
  conversionOptions: {
    html: { ... },
    pdf: { ... },
    ...
   }
})

REST API

由于 REST API 使用文件上传,请求的 Content-Type 将为 multipart/form-data。因此,添加一个新表单字段,将字符串化的对象作为值:

curl https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/tomarkdown \
  -X POST \
  -H 'Authorization: Bearer {API_TOKEN}' \
  ...
  -F 'conversionOptions={ "html": { ... }, ... }'

这篇文档对您有帮助吗?