随着技术进步的步伐加快,AI 市场正经历着快速的演变。随着突破性成果的频繁出现,对于旨在保持竞争力的组织来说,跟上最新的创新步伐势在必行。在这一背景下,短迭代周期和敏捷性已变得不可或缺,使企业能够迅速采用和利用 AI 技术的新进展。
在这个充满动态的环境中,模块化组合性、数据可移植性以及标准 API 的概念成为应对 AI 生态系统复杂性的关键因素:
- 模块化组合性:指将各种 AI 组件组装成定制解决方案的能力,使组织能够混合和匹配不同的技术以满足其特定需求。
- 数据可移植性:在促进不同 AI 系统和平台之间无缝数据交换方面发挥着关键作用,确保互操作性并防止数据孤岛。
- 用于互操作性的标准 API:是集成各种 AI 组件的基石,可实现不同系统之间的无缝通信和协作。
在缓解厂商锁定和促进灵活性方面,模块化组合性、数据可移植性以及标准 API 的重要性尤为突出。通过拥抱这些原则,组织可以避开对单一厂商的依赖,转而选择同类最佳(best-in-class)的方法,针对其独特要求选择最合适的解决方案。总的来说,这些原则为一个更敏捷、适应性强且面向未来的 AI 生态系统铺平了道路。
Cloudflare 的 AI 平台在设计时就考虑到了这些原则。该架构图展示了如何在 Cloudflare 上端到端构建 AI 应用程序,或如何将单个服务与外部基础设施及服务相集成。
- 计算(Compute):计算层是应用程序的核心。所有业务逻辑以及对其他组件的使用都在这里定义。计算层与推理服务、向量搜索、数据库和数据存储等其他服务进行交互。诸如 Cloudflare Workers 这样的无服务器(Serverless)解决方案提供了快速迭代和自动缩放,从而使开发人员能够专注于使用案例,而不是基础设施管理。对于组合性至关重要的一点是支持 HTTP 或 TCP 等标准接口,Workers 的运行环境分别通过
fetch()API 和connect()API 对其提供支持。 - 推理(Inference):AI 推理负责应用程序的 AI 功能。运营模式在自托管模型或消费如 Workers AI 等推理即服务(Inference-as-a-service)提供商之间各不相同。在后一种情况下, REST API 使得从任何服务/客户端与推理服务进行交互都易于实现。使用特定于平台的集成(例如用于 Workers 与其他服务之间交互的绑定(binding))可以简化开发,因为身份验证等复杂性被抽象掉了。
- 向量搜索(Vector Search):某些使用案例(例如 RAG)利用向量搜索来进行相似性匹配。运营模式在自托管数据库或消费如 Vectorize 等向量专用数据库即服务(DBaaS)提供商之间各不相同。在后一种情况下, REST API 使得从任何服务/客户端与其进行交互都易于实现。使用特定于平台的集成(例如用于 Workers 与其他服务之间交互的绑定)可简化开发,因为身份验证等复杂性被抽象掉了。
- 数据与存储(Data & Storage):数据库和数据存储为 AI 应用程序添加状态。用户管理、会话存储和数据持久化是 AI 应用程序的常见需求。根据使用案例,需要不同的解决方案,例如关系数据库或对象存储。存在各种用于自托管或托管服务的解决方案。在 Cloudflare 上,这可以是例如 D1 和 R2。REST API 使得与来自任何服务/客户端的推理服务进行交互都易于实现。使用特定于平台的集成(如用于 Workers 与数据和数据库服务之间交互的绑定)可简化开发,因为身份验证等复杂性被抽象掉了。