我们为视频遵循特定的工作流和格式规范,以确保它们准确、引人入胜、具备可扩展性,并与 Cloudflare 文档风格指南保持一致。
我们使用以下格式规范来维护我们所有视频的质量和一致性。
视频应以 4K UHD 录制。如果无法使用 4K UHD,可在个案评估的基础(case-by-case basis)上接受 Full HD 素材。不使用低于 Full HD 的素材。最终导出的视频必须至少为 Full HD。
可接受的分辨率:
- 4K Ultra HD: 2160p (3840x2160)
- 2K Quad HD: 1440p (2560x1440)
- Full HD: 1080p (1920x1080)
帧率: 每秒 25 帧(FPS)
屏幕录制应在尽可能大的显示器上进行,并使用录制软件可用的最高分辨率(最低 1920x1080)。确保屏幕上可见的任何文本都足够大,以便在最终视频中轻松阅读。
宽高比对于观看体验非常重要。视频越能填满屏幕,提供的体验就越具沉浸感。
桌面端宽高比
最常见的屏幕和在线平台(例如 YouTube 和 Vimeo)使用 16:9 的比例,因此大多数视频应以 16:9 的比例制作。
移动端宽高比
社交媒体平台(如 Instagram 或 Facebook)通常在移动设备上访问,通常需要 9:16 的宽高比。为了提高效率,也可以采用 1:1 的宽高比,它适用于所有设备,但效果可能不那么完美。
字幕始终以英文发布,格式为 SubRip 格式 .srt。
字幕指南:
- 每行最多 45 个字符。
- 必要时拆分为 2 行。
- 每个字幕显示时间不超过 10 秒。
为了保持均衡的音频混音:
- 音乐声对应比人声低约 20dB。
- 背景音乐必须是纯音乐,以确保不会盖过演讲者的声音。
麦克风摆放:清晰且高质量的音频是优秀视频的关键。在设置麦克风时,最好让它尽可能靠近演讲者以捕获清晰的音频,并置于画面之外,这样就无法在素材中看到它。
- 枪式麦克风(Shotgun microphones):将麦克风悬挂在头部上方,刚好在画面之外。
- 领夹式麦克风(Lavalier microphones):隐藏线缆,但麦克风本身可以露出。
背景噪音: 选择一个安静、有家具陈设且表面柔软的房间来录制音频。尽最大努力避免带有背景噪音和回声的场所。例如,避开带有风扇、空调和喧哗声的区域,因为这些噪音往往会被麦克风拾取。
构图(Frame)
在设置演示者构图时,演示者应将自己置于画面中心,并与身后的墙壁保持一定距离以创造景深。他们应确保自己的视线直接看向镜头,与观众互动,并避免眼镜上出现任何可能干扰演示的反射光。这将有助于在整个视频中保持清晰、专业的形象。
着装规范
为了打造最专业、最一致的形象,视频体验(Video Experience)团队遵循以下着装规范指南:
- 穿着时尚休闲的上衣,如 Cloudflare T 恤、Polo 衫、休闲衬衫或衣物。坚持穿纯色、黑白色以及宝石色调(例如暗橙色、祖母绿、海军蓝、酒红色)的衣服。
- 避免佩戴带有干扰性图案的配饰或闪亮的珠宝。
- 不要穿着非关联品牌的服装,尤其是非开源公司的品牌。
为了获得最佳视频质量,请考虑以下空间搭建选项:
- 选项 A:选择一个有自然光且回声极小的位置。根据需要添加额外的照明。
- 选项 B:搭建绿幕。确保适当的照明以最大限度地减少阴影,从而获得最干净的背景。
我们在整个工作流中将 AI 用作工具,以加速并消除各个制作阶段(脚本编写、配音、动画、元数据和评审)的阻碍,而不是为了实现完全自动化。我们在相应的页面中详细说明了如何在每个制作阶段使用 AI。请参阅我们如何使用 AI 以了解更多关于我们方法的信息。
当视频能够提高用户对书面文档的理解时,我们会战略性地创建视频。请参阅为什么以及何时使用视频以了解我们对视频内容的处理方法。 在选择视频主题时,我们还会考虑页面浏览量、支持工单和社区反馈。我们的视频始终映射回特定的文档需求,并将书面文档视为真实信源。
脚本是每个视频的蓝图,用于指导旁白、屏幕文本以及动画插图和图表等视觉资产。我们使用 Cloudflare 文档作为我们编写脚本的原始素材。
在 Cloudflare,我们使用 Gemini 来加速脚本创作,随后由人工评审并修改 AI 生成的草稿,以使其符合 Cloudflare 的声音、准确性要求和视觉效果。高层次的流程如下所示:
- 根据现有文档生成初始脚本草稿。
- 尝试不同的语气、风格和旁白长度。
- 创建多个版本进行评审,这比从头开始撰写要快得多。
配音是我们视频文档工作流的重要组成部分。它们提供清晰度、节奏感和吸引力,与屏幕文本和视觉效果相得益彰。在 Cloudflare,我们利用 AI 辅助语音生成来简化这一过程。
我们使用 ElevenLabs(一种 AI 语音生成工具)来生成听起来自然的配音,以便:
- 快速实时听到您的脚本效果。
- 了解旁白的抑扬顿挫、时机和清晰度。
- 加快利益相关者的评审过程。
- 允许团队在没有麦克风的情况下制作视频。
- 支持早期测试节奏以及与屏幕视觉效果的整合。
视觉效果是视频的核心,提供上下文、强化关键概念并引导观众完成工作流。在 Cloudflare,视觉效果包括图表、动画、屏幕录制和真人出镜(talking head)画面,所有这些都旨在与脚本和配音相辅相成。
图表用于阐明复杂的概念或展示难以仅通过文本传达的关系。图表在脚本中被引用,并在视觉上进行时间调整,以与相应的旁白同步出现。
动画使图表和过程栩栩如生,帮助用户直观地看到动态工作流。传统上,制作动画涉及关键帧(keyframing)技术,这需要逐帧指定物体的移动方式。这是非常耗时且偏技术性的工作。
为了加速动画创作,我们使用 AI:
- 简单的提示词即可生成物体的运动,而无需手动为每个帧设置关键帧。
- AI 生成的运动可以在多个动画中重复使用,从而节省时间。
- 这种方法可以让动效设计师专注于创意设计,而不是重复性的技术工作。
当展示真实的产品交互时,我们通过直接从 Cloudflare 仪表板或开发人员工具中捕获 UI 驱动的工作流来使用屏幕录制。
最佳实践:
- 使用标注(callouts)或叠加层突出显示相关的 UI 元素。
- 配音应相匹配,以引导观众完成各个步骤。
- 确保显示的 UI 元素是最新的。
- 模糊敏感数据。
当真人的出现可以增加清晰度、参与感和亲和力时,我们会使用真人出镜画面,例如:
- 介绍工作流或视频片段。
- 提供上下文、强调或评论。
- 强化 Cloudflare 的品牌效应和亲和力。
当仅凭配音无法传达语气或强调时,真人出镜画面尤其有用,它能帮助用户与内容产生共鸣。
每个 Cloudflare 视频都要经过两阶段的评审流程,以确保准确性、清晰度以及与文档标准的一致性。我们利用人工评审员和 AI 工具来在实现可扩展制作的同时维护高质量。
脚本在制作前会经过评审,以确保:
- 技术准确性——对概念、工作流和产品行为的解释是正确的。
- UI 和工作流准确性——描述的步骤与实际产品相符。
- 术语一致性——语言符合 Cloudflare 文档和品牌形象。
视频制作完成后,会进行视觉评审以验证:
- 插图与旁白匹配——图表、动画和标注与口播内容保持一致。
- 图表准确性——架构图和概念图正确地反映了产品。
- 屏幕录制准确性——UI 导航、工作流和系统输出都是正确的。
Cloudflare 使用 AI,通过使用能记住您的评审偏好和重点区域的已保存提示词来增强质量保证,扮演评审员的角色以确保跨项目检查的一致性:
- 即时周转,即使在人工评审员不可用时也是如此。
- 降低出现错误和陈旧信息的风险。
- 先进的图像识别技术通过重新检查现有视频来支持维护,以查看 UI 或信息是否发生了变化。
制作视频只是故事的一部分。为了确保我们的视频可被找到、有用且易于获取,我们应用了结构化的元数据和 AI 辅助工具,以最大限度地提高人类用户和 AI 系统的可发现性。
在发布之前,我们为每个视频生成丰富的元数据:
- 标题:清晰、具描述性,且与文档术语保持一致。
- 描述:总结视频的内容和背景。
- 章节:将视频拆分为逻辑片段,以提高 AI 的理解能力。
- 转录文本和字幕:视频托管在 Cloudflare Stream 上,我们可以自动生成字幕并下载
.vtt字幕文件作为转录文本。
这有助于实现:
- 搜索索引
- AI 检索
- 生成式引擎优化(GEO)