Você pode gerenciar a Incorporação automatizada na IU do Atlas.
Ativar ou desativar o embedding automático
Para habilitar o embedding automatizado, você deve criar um índice do MongoDB pesquisa vetorial com o tipo autoEmbed. Para **aprender** mais, consulte Criar um índice de **embedding** automatizado.
Para desabilitar a Incorporação Automática no nível da organização , use uma Política de Recursos do Atlas. Você pode desabilitar totalmente a Incorporação automatizada ou desativá-la com exceções no nível do projeto.
Para desativar o Automated Embedding completamente, use a seguinte sintaxe em sua política de recursos do Atlas:
forbid ( principal, action == ResourcePolicy::Action::"search.index.modify", resource ) when { context.search.index.isAutoEmbed };
Para desativar a Incorporação Automática com exceções para projetos específicos, utilize a seguinte sintaxe em sua Política de Recursos do Atlas . Substitua cada <project-id> pelo ID do projeto a ser isento. Para encontrar o ID do projeto, consulte: Gerenciar configurações do projeto.
forbid ( principal, action == ResourcePolicy::Action::"search.index.modify", resource ) when { context.search.index.isAutoEmbed } unless { resource in ResourcePolicy::Project::"<project-id-1>" || resource in ResourcePolicy::Project::"<project-id-2>" };
Quando ativas, essas políticas impedem a criação de novos índices do tipo autoEmbed. Os índices criados antes da ativação da política de recursos não são afetados e devem ser excluídos manualmente para manter a compliance.
Para aplicar esta política à sua organização:
Para ativar o Automated embedding, você deve fazer o seguinte:
Crie uma chave de API do Voyage AI para operações de indexação.
Para saber mais,consulte Gerenciar chaves de API do modelo Voyage AI.
Crie uma chave de API do Voyage AI para operações de query.
Para saber mais,consulte Gerenciar chaves de API do modelo Voyage AI.
Configure o mongot para utilizar as chaves API.
Para saber mais, consulte Chaves de API do Voyage AI.
Crie um índice de Vector Search do MongoDB tipo autoEmbed.
Para aprender mais, consulte Criar um índice de embedding automatizado.
Visualizar o uso de embedding automatizado
Para visualizar o uso agregado de tokens e as solicitações de modelo de embedding para o serviço de embedding automatizado, você pode usar o dashboard de pesquisa vetorial do MongoDB ou as métricas do Atlas.
Monitorar dashboard
Conecte-se ao Atlas.
In Atlas, vá para a página Search & Vector Search para seu cluster.
Você pode acessar a página de pesquisa do MongoDB a partir da opção Search & Vector Search ou do Data Explorer.
Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.
Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.
Na barra lateral, clique em Search & Vector Search sob o título Database.
Se o seu projeto tiver vários clusters, selecione o cluster que deseja usar no menu suspenso Select cluster e clique em Go to Atlas Search.
A página Pesquisa & Pesquisa Vetorial é exibida.
Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.
Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.
Na barra lateral, clique em Data Explorer sob o título Database.
Expanda o banco de dados e selecione a coleção.
Clique na guia Indexes da coleção.
Clique no link Search and Vector Search no banner.
A página Pesquisa & Pesquisa Vetorial é exibida.
Clique em Usage em Automated Embedding.
A página Uso da incorporação automatizada é exibida. A página Automated Embedding Usage exibe as seguintes informações:
Seção | Descrição |
|---|---|
Resumo do uso | Visão geral do uso da Automated embedding, incluindo o total de tokens usados e os tokens gratuitos restantes. |
Uso por modelo ou índice | Detalhes do uso total de tokens por modelo de embedding ou índice selecionado durante um período selecionado. |
Uso por operação | Detalhes das solicitações de token por tipo de operação (indexação e consulta). |
O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.
Conecte-se ao Atlas.
Visualize o uso de token e as solicitações de **embedding model** para Incorporação Automática.
A página Usage exibe métricas de uso para todas as chaves de API de modelo na sua organização. A página fornece as seguintes abas:
Usage Activity: mostra métricas e gráficos de uso detalhados da sua organização.
Free Usage: mostra o consumo de cota gratuita por modelo.
Paid Usage: Mostra o uso pago por modelo e chave de API.
Para aprender mais, consulte Recursos da página de uso.
Monitorar Métricas
Para monitorar o uso de embedding automatizado usando métricas:
Conecte-se ao Atlas.
Acesse a visualização Metrics do seu cluster.
Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.
Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.
Clique no nome do cluster para abrir a barra lateral do Cluster.
Na barra lateral, clique em Metrics.
Selecione o Auto Embedding Metrics para revisar.
Você pode monitorar o uso de embedding automatizado por meio das seguintes métricas na seção Auto Embedding Metrics:
Métrica | Descrição |
|---|---|
Auto Embedding Index Embedding Request | O grafo de solicitação de embedding de índice de embedding automático exibe o número de solicitações para gerar embedding para operações de indexação. As taxas são mostradas para cada modelo de embedding em uso. |
Auto Embedding Index Tokens | O grafo de tokens de índice de embedding automático exibe o número de tokens usados para operações de indexação. |
Auto Embedding Query Embedding Request | O grafo de solicitação de embedding de query de embedding automático exibe o número de solicitações para gerar embedding para operações de query. |
Auto Embedding Query Tokens | O grafo de tokens de query de embedding automático exibe o número de tokens usados para operações de query. |
Auto Embedding Replication Lag | O grafo de atraso de replicação de embedding automático exibe o atraso de replicação em milissegundos para operações de indexação de embedding automatizadas. |
Para cada cluster, o Atlas exibe um único grafo que agrega o uso de tokens em todos os índices de embedding automatizados no cluster. O grafo inclui o uso de tokens da sincronização inicial e das atualizações de estado estável, e exibe uma linha separada para cada modelo de embedding que seus índices usam para que você possa comparar o uso de tokens por modelo.
Se você implantou nós de pesquisa para isolamento de carga de trabalho, o Atlas exibe este grafo na visualização de métricas Search Nodes para cada nó de pesquisa em vez da visualização de métricas do cluster.
As métricas de embedding automatizadas não estão disponíveis para implantações autogerenciadas.
Gerenciar limites de taxa
Você pode gerenciar limites de taxa para embedding automatizado na IU do Atlas.
Visualizar limites de taxa
Para visualizar os limites de taxa da Automated embedding:
Conecte-se ao Atlas.
Go Vá para a Search & Vector Search página do seu projeto.
Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.
Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.
Na barra lateral, clique em Search & Vector Search abaixo do cabeçalho Database.
A página Pesquisa & Pesquisa Vetorial é exibida.
Clique em Rate Limits em Automated Embedding.
A página exibe as seguintes informações:
Nome | Descrição |
|---|---|
Model | Lista de modelos de integração do Voyage IA. |
Tokens Per Minute (TPM) | Número de tokens que você pode processar por minuto. |
Requests Per Min (RPM) | Número de solicitações de API que você pode enviar por minuto. |
O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.
Conecte-se ao Atlas.
Consulte os limites de taxa de Automated embedding.
A página exibe as seguintes informações:
Nome | Descrição |
|---|---|
Model | Lista de modelos de integração do Voyage IA. |
Tokens Per Minute (TPM) | Número de tokens que você pode processar por minuto. |
Requests Per Min (RPM) | Número de solicitações de API que você pode enviar por minuto. |
Aumentar limites de taxa
Se você estiver no nível gratuito e precisar aumentar os limites de taxa para a incorporação automática, adicione um método de pagamento para atualizar para um nível pago. Para saber mais, consulte Definir Forma de Pagamento.
Se você estiver em um nível pago, o MongoDB aumentará automaticamente os limites de taxa à medida que seu uso aumenta. Se você ainda precisar de um limite de taxa maior, entre em contato com o Suporte do MongoDB .