Para agentes de IA: um índice de documentação está disponível em https://www.mongodb.com/pt-br/docs/llms.txt — as versões de markdown de todas as páginas estão disponíveis anexando .md a qualquer caminho de URL.
Menu Docs

Gerenciar embedding automatizada

Você pode gerenciar a Incorporação automatizada na IU do Atlas.

Para habilitar o embedding automatizado, você deve criar um índice do MongoDB pesquisa vetorial com o tipo autoEmbed. Para **aprender** mais, consulte Criar um índice de **embedding** automatizado.

Para desabilitar a Incorporação Automática no nível da organização , use uma Política de Recursos do Atlas. Você pode desabilitar totalmente a Incorporação automatizada ou desativá-la com exceções no nível do projeto.

Para desativar o Automated Embedding completamente, use a seguinte sintaxe em sua política de recursos do Atlas:

forbid (
principal,
action == ResourcePolicy::Action::"search.index.modify",
resource
)
when {
context.search.index.isAutoEmbed
};

Para desativar a Incorporação Automática com exceções para projetos específicos, utilize a seguinte sintaxe em sua Política de Recursos do Atlas . Substitua cada <project-id> pelo ID do projeto a ser isento. Para encontrar o ID do projeto, consulte: Gerenciar configurações do projeto.

forbid (
principal,
action == ResourcePolicy::Action::"search.index.modify",
resource
)
when {
context.search.index.isAutoEmbed
}
unless {
resource in ResourcePolicy::Project::"<project-id-1>" ||
resource in ResourcePolicy::Project::"<project-id-2>"
};

Quando ativas, essas políticas impedem a criação de novos índices do tipo autoEmbed. Os índices criados antes da ativação da política de recursos não são afetados e devem ser excluídos manualmente para manter a compliance.

Para aplicar esta política à sua organização:

1
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Na barra lateral, clique em Organization Settings.

2

Na barra lateral, clique em Resource Policies abaixo do cabeçalho Configurations.

3
4
  1. Dê um nome exclusivo à política.

  2. (Opcional) Adicione uma descrição.

  3. No campo Cedar Policy, cole a política da Cedar. Substitua <project-id> pelo ID do grupo.

5

Para ativar o Automated embedding, você deve fazer o seguinte:

1

Para saber mais,consulte Gerenciar chaves de API do modelo Voyage AI.

2

Para saber mais,consulte Gerenciar chaves de API do modelo Voyage AI.

3

Para saber mais, consulte Chaves de API do Voyage AI.

4

Para aprender mais, consulte Criar um índice de embedding automatizado.

Para visualizar o uso agregado de tokens e as solicitações de modelo de embedding para o serviço de embedding automatizado, você pode usar o dashboard de pesquisa vetorial do MongoDB ou as métricas do Atlas.

1
2

Você pode acessar a página de pesquisa do MongoDB a partir da opção Search & Vector Search ou do Data Explorer.

  1. Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Search & Vector Search sob o título Database.

  4. Se o seu projeto tiver vários clusters, selecione o cluster que deseja usar no menu suspenso Select cluster e clique em Go to Atlas Search.

    A página Pesquisa & Pesquisa Vetorial é exibida.

  1. Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Data Explorer sob o título Database.

  4. Expanda o banco de dados e selecione a coleção.

  5. Clique na guia Indexes da coleção.

  6. Clique no link Search and Vector Search no banner.

    A página Pesquisa & Pesquisa Vetorial é exibida.

3
4

A página Uso da incorporação automatizada é exibida. A página Automated Embedding Usage exibe as seguintes informações:

Seção
Descrição

Resumo do uso

Visão geral do uso da Automated embedding, incluindo o total de tokens usados e os tokens gratuitos restantes.

Uso por modelo ou índice

Detalhes do uso total de tokens por modelo de embedding ou índice selecionado durante um período selecionado.

Uso por operação

Detalhes das solicitações de token por tipo de operação (indexação e consulta).

5

O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. No nível da organização , clique em Usage sob o cabeçalho AI Model APIs na barra de navegação.

3
4

A página Usage exibe métricas de uso para todas as chaves de API de modelo na sua organização. A página fornece as seguintes abas:

  • Usage Activity: mostra métricas e gráficos de uso detalhados da sua organização.

  • Free Usage: mostra o consumo de cota gratuita por modelo.

  • Paid Usage: Mostra o uso pago por modelo e chave de API.

Para aprender mais, consulte Recursos da página de uso.

Para monitorar o uso de embedding automatizado usando métricas:

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.

  3. Clique no nome do cluster para abrir a barra lateral do Cluster.

  4. Na barra lateral, clique em Metrics.

3

Você pode monitorar o uso de embedding automatizado por meio das seguintes métricas na seção Auto Embedding Metrics:

Métrica
Descrição
Auto Embedding Index Embedding Request

O grafo de solicitação de embedding de índice de embedding automático exibe o número de solicitações para gerar embedding para operações de indexação. As taxas são mostradas para cada modelo de embedding em uso.

Auto Embedding Index Tokens

O grafo de tokens de índice de embedding automático exibe o número de tokens usados para operações de indexação.

Auto Embedding Query Embedding Request

O grafo de solicitação de embedding de query de embedding automático exibe o número de solicitações para gerar embedding para operações de query.

Auto Embedding Query Tokens

O grafo de tokens de query de embedding automático exibe o número de tokens usados para operações de query.

Auto Embedding Replication Lag

O grafo de atraso de replicação de embedding automático exibe o atraso de replicação em milissegundos para operações de indexação de embedding automatizadas.

Para cada cluster, o Atlas exibe um único grafo que agrega o uso de tokens em todos os índices de embedding automatizados no cluster. O grafo inclui o uso de tokens da sincronização inicial e das atualizações de estado estável, e exibe uma linha separada para cada modelo de embedding que seus índices usam para que você possa comparar o uso de tokens por modelo.

Se você implantou nós de pesquisa para isolamento de carga de trabalho, o Atlas exibe este grafo na visualização de métricas Search Nodes para cada nó de pesquisa em vez da visualização de métricas do cluster.

As métricas de embedding automatizadas não estão disponíveis para implantações autogerenciadas.

Você pode gerenciar limites de taxa para embedding automatizado na IU do Atlas.

Para visualizar os limites de taxa da Automated embedding:

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Search & Vector Search abaixo do cabeçalho Database.

    A página Pesquisa & Pesquisa Vetorial é exibida.

3
4

A página exibe as seguintes informações:

Nome
Descrição
Model

Lista de modelos de integração do Voyage IA.

Tokens Per Minute (TPM)

Número de tokens que você pode processar por minuto.

Requests Per Min (RPM)

Número de solicitações de API que você pode enviar por minuto.

O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. No nível da organização , clique em Rate Limits sob o cabeçalho AI Model APIs na barra de navegação.

3

A página exibe as seguintes informações:

Nome
Descrição
Model

Lista de modelos de integração do Voyage IA.

Tokens Per Minute (TPM)

Número de tokens que você pode processar por minuto.

Requests Per Min (RPM)

Número de solicitações de API que você pode enviar por minuto.

Se você estiver no nível gratuito e precisar aumentar os limites de taxa para a incorporação automática, adicione um método de pagamento para atualizar para um nível pago. Para saber mais, consulte Definir Forma de Pagamento.

Se você estiver em um nível pago, o MongoDB aumentará automaticamente os limites de taxa à medida que seu uso aumenta. Se você ainda precisar de um limite de taxa maior, entre em contato com o Suporte do MongoDB .