对于 AI 代理:可在 https://www.mongodb.com/zh-cn/docs/llms.txt 获取文档索引—通过在任何 URL 路径后添加 .md 可获取所有页面的 Markdown 版本。
Docs 菜单

使用Azure AI Foundry 通过MongoDB模型部署 Voyage AI

您可以使用Azure AI Foundry 在Azure环境中发现并部署Voyage AI by MongoDB模型。 Azure AI Foundry 为模型发现、部署、计费和访问权限管理提供了 Azure 原生路径。

通过Azure AI Foundry 使用 Voyage AI具有以下优势:

  1. 数据流和访问权限控制。 Azure AI Foundry 支持私有网络和 Azure 原生访问权限控制,因此可以使模型访问权限与Azure网络和安全要求保持一致。对于私有设置,请在Azure门户中验证 Foundry项目使用的特定部署模式和网络配置。

  2. 由Azure支持的可靠性和合合规。计费、身份和基础架构控制通过Azure进行托管。

  3. 通过Azure进行采购和计费。您可以使用Azure订阅、计费关系和适用的积分,而不是为模型托管建立单独的商业关系。

要查看Azure AI Foundry 当前可用的 Voyage AI by MongoDB模型,请打开Azure AI Foundry 中的 Voyage AI发布者页面。

模型可用性可能会随着时间的推移而变化。要学习;了解有关 Voyage AI模型功能和推荐使用案例的更多信息,请参阅模型概述。

Azure AI Foundry 的定价取决于Azure用于所选 Voyage AI模型的部署类型以及部署该模型的地区。

定价组件
期望是什么

Azure订阅计费

费用通过Azure订阅计费。

模型费用

在部署之前, Azure AI Foundry部署用户界面会显示所选模型或部署选项的定价详细信息。

基础设施费用

专用或托管计算部署可以包括按小时计算的基础架构费用,具体费用因加速器 SKU 和地区而异。

区域敏感度

总费用可能因Azure地区和部署配置而异。

Azure AI Foundry 提供两种部署计费模式:

  • Standard Foundry 部署通常按令牌使用量或预配吞吐量计费,具体取决于部署类型。

  • 托管计算部署按加速器 SKU 按小时计费。

Azure门户或Azure AI Foundry部署流程是部署时显示的确切价格的来源。有关更多信息,请参阅Microsoft文档了解Azure AI Foundry 中的部署选项和Azure定价计算器。

在通过Azure AI Foundry部署Voyage AI模型之前,请确保您具备以下条件:

  • 有效的Azure订阅。

  • 在目标订阅中创建或使用Azure AI Foundry 资源的权限。

  • 有权访问或创建Azure AI Foundry项目。

  • 对于所选 Voyage AI模型, Azure AI Foundry 所需的部署类型,目标地区中有足够的配额。

  • 您计划通过Azure AI Foundry部署Voyage AI模型的同一地区中的Azure AI中心资源。有关设置指导,请参阅有关创建中心和项目的Microsoft文档。

  • 如果您的组织需要私有网络,则需要现有的虚拟网络和Azure权限来创建和批准任何所需的私有端点连接。

本部分包括有关如何在部署之前验证和请求配额的指导。

Azure AI Foundry 中的配额模型取决于部署类型:

  • 某些部署路径使用Azure AI Foundry 配额,而不是Azure虚拟机配额。

  • 其他部署路径可能会在部署流程中出现面向基础架构的规模调整和地区可用性选择。

由于Azure AI Foundry 可以通过不同的部署模式路由不同的模型系列,因此请在开始之前从Azure门户和Azure AI Foundry部署用户界面验证配额。

1

登录Azure门户。

2

打开你计划使用的订阅。

3

查看 Foundry部署中涉及的服务和地区的配额相关设置。

4

在Azure AI Foundry 中,开始要使用的 Voyage AI模型的部署流程,并查看用户界面中显示的任何配额或容量要求。

5

确认目标地区有足够的容量用于所选部署选项。

有关Azure AI Foundry 配额指导,请参阅有关部署选项的Microsoft文档。

如果您没有足够的配额或容量:

  • 使用Azure门户请求增加所需服务或地区的相关配额。

  • 如果部署流程指示特定于Azure AI Foundry 的配额要求,请按照Azure用户界面链接的配额工作流程进行操作。

  • 批准增加后重试部署。

由于Azure AI Foundry部署类型在不断发展,因此请使用Azure门户和部署工作流程作为确切配额进程的数据来源。

如果您的组织不需要私有网络,则可以使用部署支持的默认Azure AI Foundry 网络选项。

如果您的组织需要专用连接,请在部署之前准备好网络:

  • 确定Azure AI Foundry项目或客户端应用程序将使用的虚拟网络和子网。

  • 确认您有权创建私有端点并批准私有端点连接(如果您的组织使用它们)。

  • 确认专用访问权限的 DNS 解析和路由要求。

  • 验证应用程序、验证主机或代理工具所需的任何出站访问权限策略。

有关Azure AI Foundry 专用网络指导,请参阅有关Azure AI Foundry 网络隔离性的Microsoft文档。

在本部分中,您部署来自Azure AI Foundry 的 Voyage AI by MongoDB模型。

由于 Voyage AI在Azure AI Foundry 中作为第三方托管计算产品提供,因此Azure使用部署向导来预配支持 GPU 的基础架构,并在其上部署选定的 Voyage AI模型。

1

打开Azure AI Foundry 门户。

2

New Foundry 切换到左侧(关闭位置)。

3

在左侧边栏中,选择 Model Catalogue

4

单击 See All Models(连接)。

5

搜索 Voyage 系列型号。

6

选择所需型号的型号卡。

7

单击 Use this model(连接)。

8

选择要使用该模型的项目。

9

单击 Create(连接)。

10

按照部署向导中的说明进行操作,然后单击 Deploy

Azure AI Foundry 门户为所选模型选择适当的部署路径。根据模型和 Azure 针对该列表的当前集成,这可能会影响您在部署期间看到的字段以及连接到已部署模型的方式。

在部署期间仔细查看以下设置:

设置
指南

订阅

使用应接收部署账单的Azure订阅。

项目

使用应拥有模型部署的Azure AI Foundry项目。

区域

选择具有足够容量和组织所需网络配置文件的受支持地区。

部署类型

使用Azure为所选 Voyage AI模型提供的部署类型。

身份验证

使用Azure AI Foundry 为部署提供的项目密钥。

网络

如有必要,应用Foundry资源和项目支持的私有网络或私有端点设置。

部署成功后:

  • 打开Azure AI Foundry 中已部署的模型或部署详细信息页面。

  • 捕获客户端所需的端点信息、部署名称、身份验证方法以及任何地区或网络详细信息。

  • 记录部署是使用统一的Azure AI Foundry项目端点,还是门户公开的其他 Azure 托管连接模式。

Azure AI Foundry 连接详细信息取决于Azure用于所选模型的部署模式。使用Azure AI Foundry 中的部署详细信息页面作为事实来源。

部署后,从Azure AI Foundry 捕获以下值:

为什么需要它

项目端点或模型端点

您的客户端使用此基本URL发送推理请求。

部署名称

某些 SDK 和API路由需要部署标识符。

身份验证方法

您需要Azure AI Foundry 为部署提供的密钥或令牌。

区域

对于管理、故障排除和延迟预期非常有用。

网络限制

指示客户端是否必须从批准的网络或通过私有访问权限进行连接。

Azure AI Foundry 通常会公开以下连接模式之一:

  • Unified Foundry项目端点。某些Azure AI Foundry 部署是通过项目的统一端点调用的,并在请求路径或有效负载中提供部署名称。

  • 私有或网络隔离的访问权限。如果您的 Foundry项目配置为私有访问权限,则客户端必须从批准的网络运行并正确解析Azure私有端点。

对已部署的模型使用Azure AI Foundry 所示的身份验证方法。 Voyage AI模型部署目前仅支持基于密钥的身份验证:

  • Azure AI Foundry项目密钥或部署公开的其他基于密钥的凭证。

部署后,验证应用程序是否可以连接到已部署的模型。

1

打开Azure AI Foundry 中的部署详细信息页面。

2

复制端点和身份验证信息。

3

使用 Azure 提供的示例代码、SDK示例或为部署显示的API Playground 发送小型测试请求,并确认响应成功以及返回的模型元数据与您创建的部署匹配。

如果您的部署使用私有网络,还请执行以下操作:

  • 从批准的网络边界内的客户端运行测试。

  • 验证预期私有端点的 DNS 解析(如果适用)。

  • 确认防火墙、子网和私有端点设置允许该请求。

对于专用网络验证,请参阅有关Azure AI Foundry 网络隔离性的Microsoft文档。

使用以下工作流程端到端验证部署:

1

在Azure AI Foundry 中部署模型。

2

打开部署页面,记下端点、部署名称和身份验证要求。

3

使用小示例字符串运行单个嵌入请求。

4

确认请求成功返回嵌入。

5

记录Azure公开的确切连接模式,以便您的生产应用程序可以遵循相同的路径。

如果无法连接到部署:

  • 确认模型部署已成功完成。

  • 确认您使用正确的端点和部署名称。

  • 确认您的身份验证方法与Azure AI Foundry 中显示的方法匹配。

  • 如果已启用专用网络,请确认 DNS、专用端点批准、子网路由和防火墙配置。

  • 如果部署在完成之前失败,查看Azure配额、地区可用性以及部署流程中显示的任何容量限制。

为避免产生持续费用,删除不再需要的模型部署。

1

打开您的Azure AI Foundry项目。

2

查找已部署的 Voyage AI模型。

3

从Azure用户界面删除部署并确认删除。

如果您的设置包括私有端点或其他仅为此部署创建的支持网络资源,查看是否也应将其删除。