Para agentes de IA: um índice de documentação está disponível em https://www.mongodb.com/pt-br/docs/llms.txt — as versões de markdown de todas as páginas estão disponíveis anexando .md a qualquer caminho de URL.
Menu Docs

Gerenciar embedding automatizada

Você pode gerenciar a Incorporação automatizada na IU do Atlas.

Para habilitar o embedding automatizado, você deve criar um índice do MongoDB pesquisa vetorial com o tipo autoEmbed. Para **aprender** mais, consulte Criar um índice de **embedding** automatizado.

Para desabilitar o Automated Embedding no nível da organização, use uma Atlas Resource Policy. Você pode desabilitar o Automated Embedding completamente ou desabilitá-lo com exceções no nível do projeto.

Para desativar o Automated Embedding completamente, use a seguinte sintaxe em sua política de recursos do Atlas:

forbid (
principal,
action == ResourcePolicy::Action::"search.index.modify",
resource
)
when {
context.search.index.isAutoEmbed
};

Para desabilitar o Automated Embedding com exceções para projetos específicos, use a seguinte sintaxe em sua Atlas recurso Policy. Substitua cada <project-id> pelo ID do projeto a ser isento. Para localizar seu ID do projeto, consulte: Gerenciar configurações de projeto.

forbid (
principal,
action == ResourcePolicy::Action::"search.index.modify",
resource
)
when {
context.search.index.isAutoEmbed
}
unless {
resource in ResourcePolicy::Project::"<project-id-1>" ||
resource in ResourcePolicy::Project::"<project-id-2>"
};

Quando ativas, essas políticas impedem a criação de novos índices do tipo autoEmbed. Os índices criados antes da ativação da política de recursos não são afetados e devem ser excluídos manualmente para manter a compliance.

Para aplicar esta política à sua organização:

1
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Na barra lateral, clique em Organization Settings.

2

Na barra lateral, clique em Resource Policies abaixo do cabeçalho Configurations.

3
4
  1. Dê um nome exclusivo à política.

  2. (Opcional) Adicione uma descrição.

  3. No campo Cedar Policy, cole a política da Cedar. Substitua <project-id> pelo ID do grupo.

5

Para ativar o Automated embedding, você deve fazer o seguinte:

1

Para saber mais, consulte Chaves de API do modelo.

2

Para saber mais, consulte Chaves de API do modelo.

3

Para saber mais, consulte Voyage AI API Keys.

4

Para aprender mais, consulte Criar um índice de embedding automatizado.

Para visualizar o uso de token agregado e as solicitações de modelo de incorporação para o serviço de incorporação automatizada, você pode usar o painel Vector Search do MongoDB ou as métricas do Atlas .

1
2

Você pode acessar a página de pesquisa do MongoDB a partir da opção Search & Vector Search ou do Data Explorer.

  1. Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Search & Vector Search sob o título Database.

  4. Se o seu projeto tiver vários clusters, selecione o cluster que deseja usar no menu suspenso Select cluster e clique em Go to Atlas Search.

    A página Pesquisa & Pesquisa Vetorial é exibida.

  1. Se ainda não tiver sido exibido, selecione a organização que contém seu projeto no menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione seu projeto no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Data Explorer sob o título Database.

  4. Expanda o banco de dados e selecione a coleção.

  5. Clique na guia Indexes da coleção.

  6. Clique no link Search and Vector Search no banner.

    A página Pesquisa & Pesquisa Vetorial é exibida.

3
4

A página Uso do embedding automatizado é exibida. A página Automated Embedding Usage exibe as seguintes informações:

Seção
Descrição

Resumo do uso

Visão geral do uso da Automated embedding, incluindo o total de tokens usados e os tokens gratuitos restantes.

Uso por modelo ou índice

Detalhamento do uso total de token por modelo de incorporação ou índice selecionado durante um período de tempo selecionado.

Uso por operação

Detalhamento das solicitações de token por tipo de operação (indexação e query).

5

O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. No nível da organização , clique em Usage sob o cabeçalho AI Model APIs na barra de navegação.

3
4

A página Usage exibe métricas de uso para todas as chaves de API de modelo na sua organização. A página fornece as seguintes abas:

  • Usage Activity: mostra métricas e gráficos de uso detalhados da sua organização.

  • Free Usage: mostra o consumo de cota gratuita por modelo.

  • Paid Usage: mostra o uso pago por modelo e chave de API.

Para aprender mais, consulte Recursos da página de uso.

Para monitorar o uso da Incorporação automatizada usando métricas:

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.

  3. Clique no nome do cluster para abrir a barra lateral Cluster .

  4. Na barra lateral, clique em Metrics.

3

Você pode monitorar o uso da Incorporação automatizada por meio das seguintes métricas na seção Auto Embedding Metrics:

Métrica
Descrição
Auto Embedding Index Embedding Request

O gráfico Solicitação de incorporação de índice de incorporação automática exibe o número de solicitações para gerar incorporações para operações de indexação. As taxas são mostradas para cada modelo de incorporação em uso.

Auto Embedding Index Tokens

O gráfico Tokens de índice de incorporação automática exibe o número de tokens usados para operações de indexação.

Auto Embedding Query Embedding Request

O gráfico Solicitação de incorporação de query de incorporação automática exibe o número de solicitações para gerar incorporações para operações de query.

Auto Embedding Query Tokens

O gráfico Tokens de query de incorporação automática exibe o número de tokens usados para operações de query.

Auto Embedding Replication Lag

O gráfico Atraso de replicação de incorporação automática exibe o atraso de replicação em milissegundos para operações de indexação de incorporação automatizada.

Para cada cluster, o Atlas exibe um único gráfico que agrega o uso de token em todos os índices de Incorporação Automatizada no cluster. O gráfico inclui o uso de token das atualizações de sincronização inicial e de estado constante e exibe uma linha separada para cada modelo de incorporação que seus índices usam para que você possa comparar o uso de token por modelo.

Se você distribuiu Nós de Pesquisa para isolamento do volume de trabalho, o Atlas exibirá este gráfico na exibição de métricas do Search Nodes para cada Nó de Pesquisa em vez da exibição de métricas do cluster.

As métricas de Incorporação automatizada não estão disponíveis para sistemas autogerenciados.

Você pode gerenciar os limites de taxa para a incorporação automatizada na UI do Atlas .

Para visualizar os limites de taxa da Automated embedding:

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. Se ainda não estiver exibido, selecione o projeto desejado no menu Projects na barra de navegação.

  3. Na barra lateral, clique em Search & Vector Search abaixo do cabeçalho Database.

    A página Pesquisa & Pesquisa Vetorial é exibida.

3
4

A página exibe as seguintes informações:

Nome
Descrição
Model

Lista de modelos de integração do Voyage IA.

Tokens Per Minute (TPM)

Número de tokens que você pode processar por minuto.

Requests Per Min (RPM)

Número de solicitações de API que você pode enviar por minuto.

O procedimento a seguir se aplica somente às chaves API criadas a partir da UI do Atlas . Para chaves de API criadas diretamente da Voyage AI, consulte Limites de taxa.

1
2
  1. Se ainda não estiver exibido, selecione sua organização desejada no Menu Organizations na barra de navegação.

  2. No nível da organização , clique em Rate Limits sob o cabeçalho AI Model APIs na barra de navegação.

3

A página exibe as seguintes informações:

Nome
Descrição
Model

Lista de modelos de integração do Voyage IA.

Tokens Per Minute (TPM)

Número de tokens que você pode processar por minuto.

Requests Per Min (RPM)

Número de solicitações de API que você pode enviar por minuto.

Se você estiver na camada grátis e precisar aumentar os limites de taxa para o Automated embedding, adicione um método de pagamento para atualizar para um tier pago. Para saber mais, consulte Definir Forma de Pagamento.

Se você estiver em um tier pago, o MongoDB aumentará automaticamente os limites de taxa à medida que seu uso aumenta. Se você ainda precisar de um limite de taxa maior, entre em contato com o Suporte do MongoDB.