Esta página descreve os apps e repositórios de dados do Gemini Enterprise.
Com o Gemini Enterprise, você cria um app e o conecta a um repositório de dados. Um determinado Google Cloud projeto pode conter vários apps.
Termos-chave:
App: um app Gemini Enterprise fornece resultados de pesquisa, ações e agentes aos usuários finais. O termo app pode ser usado de forma intercambiável com o termo mecanismo no contexto das APIs.
Repositório de dados: um repositório de dados é uma entidade que contém os dados ingeridos de uma fonte de dados própria, como o Cloud Storage, ou de aplicativos de terceiros , como o Jira ou o Salesforce. Os repositórios de dados que contêm dados de aplicativos de terceiros também são chamados de conectores de dados.
Relação entre apps e repositórios de dados
Um app precisa estar conectado a um repositório de dados para usar os dados dele e fornecer resultados de pesquisa, respostas ou ações.
Os apps têm uma relação de muitos para muitos com os repositórios de dados. Quando vários repositórios de dados estão conectados a um único app, isso é chamado de pesquisa combinada. Para informações sobre as limitações de conectar um app de pesquisa a mais de um repositório de dados, consulte Sobre a pesquisa combinada.
Método de criação de apps e ingestão de dados
A forma como você cria um app e ingere dados depende do tipo de dados que você tem:
Para dados de terceiros, use o Google Cloud console, não a API, para criar seu app e ingerir dados.
Para outros dados, você pode usar o Google Cloud console ou a API.
Documentos
Cada repositório de dados tem um ou mais registros de dados, chamados de documentos. O que um documento representa varia dependendo do tipo de dados no repositório de dados:
Dados de fontes de dados de terceiros. Um documento é uma entidade específica da fonte de dados de terceiros, como um problema do Jira ou um espaço do Confluence.
Dados estruturados. Um documento é uma linha em uma tabela ou um registro JSON que segue um esquema específico. Você pode fornecer esse esquema ou deixar que o Gemini Enterprise o derive dos dados ingeridos.
Dados não estruturados. Um documento é um arquivo em HTML, em PDF com textos incorporados ou no formato TXT. Os formatos PPTX e DOCX estão disponíveis na visualização.
Repositórios de dados e apps
No Gemini Enterprise, há vários tipos de repositórios de dados. Um repositório de dados pode conter apenas um tipo de dados.
Dados estruturados para repositórios de dados de terceiros
Os seguintes conectores de fontes de dados de terceiros estão disponíveis na pré-visualização com lista de permissões:
- Confluence
- Jira
- Salesforce
- SharePoint Online
- Slack
Os dados desses terceiros são considerados dados estruturados.
Ao configurar um novo conector, você seleciona uma frequência de sincronização. Você também seleciona quais entidades sincronizar. As entidades variam dependendo da origem, como problemas do Jira e conteúdo e espaços do Confluence. Um repositório de dados exclusivo é criado para cada entidade. Os repositórios de dados de entidades são agrupados por instância de conector.
A seguir
Dados estruturados
Um repositório de dados estruturados permite a pesquisa semântica ou recomendações com dados estruturados. É possível importar dados do BigQuery ou do Cloud Storage. Também é possível fazer upload manual de dados JSON estruturados pela API.
Por exemplo, ative a pesquisa ou recomendações em um catálogo de produtos para sua experiência de e-commerce ou um diretório de médicos para pesquisa ou recomendações de profissionais.
O Gemini Enterprise detecta automaticamente o esquema dos dados importados. Opcionalmente, você pode fornecer um esquema para seus dados. Fornecer um esquema para seus dados normalmente melhora a qualidade dos resultados.
A seguir
- Prepare dados estruturados para ingestão.
- Crie um repositório de dados de pesquisa usando um destes métodos:
- Crie um app.
Dados não estruturados
Um repositório de dados não estruturados permite a pesquisa semântica ou recomendações com dados como documentos e imagens.
Os repositórios de dados não estruturados oferecem suporte a documentos em HTML, PDF com texto incorporado e formato TXT. Os formatos PPTX e DOCX estão disponíveis na visualização.
A pesquisa fornece resultados na forma de 10 URLs e respostas resumidas para consultas em linguagem natural. Os documentos precisam ser enviados para um bucket do Cloud Storage com as permissões de acesso adequadas. Por exemplo, uma instituição financeira pode ativar a pesquisa ou recomendações no corpus particular de publicações de pesquisa financeira, ou uma empresa de biotecnologia pode ativar a pesquisa ou recomendações no repositório particular de pesquisa médica.
A seguir
- Prepare dados não estruturados para ingestão.
- Crie um repositório de dados de pesquisa usando um destes métodos:
- Crie um repositório de dados próprio para seus dados não estruturados.
- Crie um app.
Sobre a pesquisa combinada
Com a pesquisa combinada, vários repositórios de dados podem ser conectados a um único app. Isso permite que o app pesquise em várias fontes e tipos de dados.
Para criar um app de pesquisa combinada, conecte um ou mais repositórios de dados a um app depois que ele for criado.
Ao receber resultados de pesquisa, você pode pesquisar em todos os repositórios de dados ou filtrar os resultados de um único repositório de dados.
A pesquisa combinada tem as seguintes limitações:
- Os repositórios de dados que contêm dados não estruturados importados usando o BigQuery não são compatíveis.
- A pesquisa combinada permite os seguintes campos em
solicitações de pesquisa:
boostSpeccontentSearchSpecdataStoreSpecsfacetSpecsfilterlanguageCodeoffsetoneBoxPageSizeorderByquerypageSizepageTokenrelevanceScoreSpecrelevanceThresholdsessionsessionSpecspellCorrectionSpecuserInfouserPseudoId
- A pesquisa combinada permite os seguintes campos em
dataStoreSpecs:dataStoreboostSpec: se houver especificações de aumento especificadas paraSearchRequestedataStoreSpecs, ambas as especificações de aumento serão aplicadas aos resultados da pesquisafilter: se houver filtros especificados paraSearchRequestedataStoreSpecs, ambos os filtros serão aplicados aos resultados da pesquisa
- As operações de criação, leitura, atualização e exclusão (CRUD) em configurações de exibição são compatíveis com apps combinados. Somente os seguintes campos podem ser adicionados ou atualizados em uma configuração de exibição:
boostControlIdsdisplayNamefilterControlIdsgenericConfig:contentSearchSpec
namesolutionTypesynonymsControlIds
- As operações CRUD nos seguintes controles são compatíveis com apps de pesquisa combinada:
boostActionsynonymActionfilterAction
- Há um limite de 50 repositórios de dados por app de pesquisa.
- Se um repositório de dados usar uma configuração de CMEK, todos os outros repositórios de dados também precisarão usar a mesma configuração de CMEK.