Neste documento, descrevemos como criar um repositório de dados que se conecta aos dados do BigQuery. Você pode vincular esse repositório de dados a um app Gemini Enterprise para permitir que os agentes analisem seus dados.
Para se conectar aos dados do BigQuery usando um repositório de dados do Gemini Enterprise, use um dos seguintes modos:
- Consulta federada (recomendada) [Prévia]: conecte-se aos dados do BigQuery sem custos de saída para copiar e mover os dados. A consulta federada envia sua consulta diretamente ao BigQuery em todos os conjuntos de dados e tabelas que sua identidade tem permissão do Identity and Access Management (IAM) para acessar, o que é mais eficiente para consultas analíticas. Como as consultas são executadas usando suas credenciais, as permissões do IAM do BigQuery, incluindo a segurança no nível da linha, permanecem intactas. Ao usar o modo de consulta federada, o Knowledge Catalog é ativado automaticamente na guia Assistente do app Gemini Enterprise para dar ao agente ferramentas de pesquisa de dados a que o usuário tem acesso e de contexto.
- Ingestão de dados: copie dados de uma tabela do BigQuery específica para o repositório de dados do Gemini Enterprise. Os dados precisam ser atualizados para refletir as mudanças na tabela do BigQuery. Esse modo gera custos de saída para mover dados para um novo local, e as permissões do IAM atuais não são replicadas no repositório de dados.
Antes de começar
Para criar um repositório de dados do BigQuery no Gemini Enterprise, você precisa ter a função de Administrador do Gemini Enterprise (roles/discoveryengine.agentspaceAdmin) ou Administrador do Discovery Engine (roles/discoveryengine.admin). Para mais informações, consulte
Conceder permissões aos administradores.
Se o projeto estiver protegido por um perímetro do VPC Service Controls ou tiver a aplicação da política da organização ativada, verifique se a política permite o conector:
- Adicione
bigquery_mcpao parâmetroallowedDataSourcesna restrição gerenciadadiscoveryengine.managed.allowedDataSources(Restringir fontes de dados permitidas para conectores de dados). Para mais informações, consulte Visão geral das restrições de política gerenciada e Configurar fontes de dados permitidas.
Além disso, configure as permissões necessárias do IAM do BigQuery para o modo de conector que você planeja usar:
Consulta federada
O modo de consulta federada usa o servidor MCP do BigQuery. Como diferentes ferramentas do MCP (ações) exigem permissões diferentes, as permissões do IAM necessárias dependem das ferramentas que você usa. Para mais informações, consulte Papéis necessários na documentação do MCP do BigQuery.
Estes são os papéis do IAM mais usados para usuários que consultam ou realizam ações pelo conector:
- Usuário de jobs do BigQuery (
roles/bigquery.jobUser) no projeto do BigQuery Google Cloud em que a consulta é executada (projeto de computação ou de faturamento), para permitir que os usuários executem jobs de consulta. - Leitor de dados do BigQuery (
roles/bigquery.dataViewer) no projeto do BigQuery Google Cloud em que os dados estão armazenados (projeto de armazenamento), para permitir que os usuários acessem dados em uma consulta ou com ferramentas de metadados do BigQuery, comoget_table_info. Se as ações de gravação estiverem ativadas, conceda o papel de Editor de dados do BigQuery (roles/bigquery.dataEditor) em vez disso. - Usuário da ferramenta MCP (
roles/mcp.toolUser) nos projetos de armazenamento Google Cloud e computaçãoGoogle Cloud do BigQuery.
Ingestão de dados
Para ingerir dados de um projeto Google Cloud de origem diferente do projeto Google Cloud que contém o repositório de dados do Gemini Enterprise que você está criando, conceda os seguintes papéis do IAM no projeto do BigQuery de origem à conta de serviçoservice-PROJECT_NUMBER@gcp-sa-discoveryengine.iam.gserviceaccount.com, em que PROJECT_NUMBER é o número do projetoGoogle Cloud que contém o repositório de dados do Gemini Enterprise:
Criar um repositório de dados do BigQuery
Para criar um repositório de dados que conecte dados do BigQuery ao Gemini Enterprise, siga estas etapas:
No console Google Cloud , acesse a página Gemini Enterprise.
Acesse a página Repositório de dados.
Clique em Criar repositório de dados.
Na página Origem, escolha uma fonte de dados para seu repositório de dados. Pesquise "BigQuery" no campo de pesquisa Selecionar uma fonte de dados ou encontre o BigQuery na lista de Fontes de dados próprias. Selecione Adicionar fonte de dados.
Na página Dados, selecione o modo do conector para saber como se conectar aos seus dados. Selecione uma das guias a seguir para mais instruções com base no modo escolhido.
Consulta federada
- Selecione Consulta federada (recomendado).
- Opcionalmente, em Opções avançadas, especifique o projeto de faturamento Google Cloud para a execução de consultas do seu repositório de dados digitando o ID do projeto no campo ID do projeto de faturamento. Se você deixar esse campo em branco, as consultas vão pedir ao usuário um projeto de faturamento ou depender de instruções personalizadas.
- Clique em Continuar.
- Na página Ações, selecione as ações do BigQuery que você quer ativar para seu repositório de dados. Você pode editar essas configurações mais tarde. Clique em Continuar.
Ingestão de dados
- Selecione Ingestão de dados.
- Determine o tipo de dados que você está importando. Antes de importar seus dados, consulte Preparar dados para ingestão.
- Se você estiver importando dados estruturados, selecione Tabela do BigQuery com seu próprio esquema ou Tabela do BigQuery com metadados. Se você estiver usando seu próprio esquema, ele será detectado automaticamente durante a importação. Se você usar metadados, defina um esquema especificado pelo Google durante a importação.
- Se você estiver importando dados que exigem processamento especializado, selecione uma das opções em Importação de dados especializados.
Em Frequência de sincronização, selecione a frequência com que você quer importar dados da sua tabela do BigQuery. Essa opção não pode ser alterada depois que o repositório de dados é criado.
- Selecione Uma vez para uma única importação.
- Selecione Periódica para definir uma programação de importação recorrente.
Selecione a tabela de dados que você quer importar. No campo Caminho do BigQuery, clique em Procurar, selecione uma tabela que você preparou para ingestão e clique em Selecionar. Ou digite o local da tabela diretamente no campo Caminho do BigQuery.
Clique em Continuar.
Depois de criar o repositório de dados, você pode verificar o status da ingestão acessando a página Repositórios de dados e clicando no nome do repositório para conferir os detalhes na página Dados. Quando a coluna de status na guia Atividade mudar de Em andamento para Importação concluída, a ingestão será concluída.
Dependendo do tamanho dos dados, a ingestão pode levar de vários minutos a várias horas.
Na página Configuração, configure as definições do repositório de dados.
- Local do conector de dados: escolha uma região para armazenar os metadados do repositório de dados. Não é possível mudar o local depois que o repositório de dados é criado. Para informações importantes sobre multirregiões, consulte os locais do Gemini Enterprise.
- Nome do conector de dados: no campo Nome do conector de dados, insira um nome para o conector. Não é possível mudar o nome depois que o conector de dados é criado. Ao inserir um nome, um ID exclusivo é gerado para o conector de dados. Se quiser, no campo Tag (opcional), insira uma tag para o conector de dados, que serve como um identificador estável para o conector em todas as versões.
- Política de proteção de dados sensíveis: selecione uma política de proteção de dados sensíveis para seu repositório de dados. O formato precisa ser:
projects/{project}/locations/{location}/contentPolicies/{policy}. Você pode editar essa configuração mais tarde.
Clique em Criar.
Agora você pode anexar seu repositório de dados a um app do Gemini Enterprise. No modo de consulta federada, as consultas geram custos de computação do BigQuery quando os usuários executam consultas pelo app anexado. No modo de ingestão de dados, a importação de dados gera custos de indexação do BigQuery e do Gemini Enterprise, mesmo antes de o repositório de dados ser anexado a um app. Para saber mais sobre essas cobranças, consulte os preços do Gemini Enterprise.
Próximas etapas
Para anexar seu repositório de dados a um app, crie um app e selecione o repositório seguindo as etapas em Criar um app Gemini Enterprise.
Saiba como o Knowledge Catalog funciona com os conectores da Data Cloud (ativados automaticamente quando você usa o modo de consulta federada) para ajudar o agente a pesquisar dados a que o usuário tem acesso e consultar o contexto organizacional.
Para criar um agente com escopo e consultas verificadas no BigQuery, consulte Publicar um agente de dados do BigQuery no Gemini Enterprise.