Recuperação de agente (antiga pesquisa vetorial 2.0)

O Agent Retrieval (antigo Vector Search 2.0) é um Google Cloud produto projetado como um mecanismo de pesquisa nativo de IA, totalmente gerenciado e com ajuste automático. Embora Google Cloud's o Vector Search atual seja um sistema de índice de vizinho mais próximo aproximado (ANN) como serviço, o Agent Retrieval evolui esse conceito para um sistema abrangente de armazenamento e recuperação. Em vez de gerenciar índices como o recurso principal, você trabalha com coleções de objetos de dados.

A arquitetura do mecanismo de pesquisa oferece um mecanismo de armazenamento replicado e escalonável, tornando o Agent Retrieval uma única fonte de dados unificada para seus aplicativos de IA e eliminando a necessidade de armazenamento de dados auxiliar.

Dentre os principais benefícios estão:

  • Fácil para desenvolvedores:comece rapidamente com bibliotecas de cliente intuitivas que exigem um código mínimo. O sistema é ajustado automaticamente para manter o alto desempenho, abstraindo a infraestrutura subjacente para que você não precise configurar VMs ou réplicas.

  • Integração e avaliação rápidas:crie coleções, adicione seus dados e comece a pesquisar rapidamente.

  • Armazenamento de dados unificado:armazene, recupere e filtre seus documentos por similaridade de vetor e dados de payload, tudo em um só lugar.

  • Recursos avançados:preencha automaticamente os campos de incorporação usando modelos integrados, explore seus dados com recursos de consulta avançados, traga suas próprias incorporações (BYOE, na sigla em inglês) e crie índices rapidamente para escalonar o desempenho.

  • Preços simplificados:os preços adaptáveis apresentam dois modelos: com base no uso para cargas de trabalho menores e com base em recursos para desempenho ajustado. Para informações sobre como estimar os custos do seu caso de uso, acesse Estimativa de preços.

O Agent Retrieval mantém o alto desempenho e a escalonabilidade massiva disponíveis no Vector Search 1.0, facilitando o início e o escalonamento.

Conceitos

Antes de começar, é útil entender os seguintes conceitos do Agent Retrieval:

  • **Coleção**: um contêiner para um conjunto de objetos JSON relacionados. Isso é semelhante a uma tabela em um banco de dados relacional. É possível criar muitas coleções em um único banco de dados.

  • Objeto de dados: um objeto JSON individual armazenado em uma coleção.

  • Coleção: esquema: Define a estrutura e as restrições dos objetos de dados em uma coleção. Ele pode ser configurado para validações de esquema estritas e flexíveis.

  • Índice de coleção:permite a pesquisa eficiente do vizinho mais próximo aproximado (ANN, na sigla em inglês) em objetos de dados em uma coleção. Uma coleção pode ter vários índices, como um para cada campo de vetor nos objetos de dados.

Estimativa de preços

Preços e calculadora de preços do Agent Retrieval: os preços do Agent Retrieval incluem o custo das máquinas virtuais usadas para hospedar índices implantados, bem como as despesas de criação e atualização de índices. Mesmo uma configuração mínima (menos de US $100 por mês) pode acomodar alta capacidade de processamento para casos de uso de tamanho moderado. Para estimar seus custos mensais:

  1. Acesse a calculadora de preços do Agent Retrieval da Agent Platform.
  2. Atualize as configurações para:
    • Descrever sua coleção
    • Escolher o método de pesquisa: KNN ou ANN
    • Implantação (disponível apenas para o método de pesquisa ANN)
    • Tráfego mensal
    • Ingestão de dados
  3. A estimativa de custos será atualizada no painel Detalhes de custos.

Regiões compatíveis

Há suporte nas seguintes regiões:

  • asia-east1
  • asia-northeast1
  • asia-southeast1
  • europe-north1
  • europe-west2
  • europe-west4
  • us-central1
  • us-east4
  • us-west1

A seguir