Gemini Enterprise Agent Platform e retenção de dados zero

O Google foi o primeiro no setor a publicar um compromisso de privacidade de IA/ML, que descreve que os clientes devem ter o mais alto nível de segurança e controle sobre os dados armazenados na nuvem. Esse compromisso se estende aos Google Cloud's produtos de IA generativa do. O Google garante que as equipes sigam esses compromissos por meio de práticas robustas de governança de dados, que incluem revisões dos dados que o usa no desenvolvimento dos produtos. Google Cloud Para mais detalhes sobre como o Google processa dados, consulte o Adendo sobre tratamento de dados do Cloud (CDPA).

Restrição de treinamento

Conforme descrito em "Restrição de treinamento" na seção Termos de Serviço dos Termos de Serviço Específicos, o Google não usará seus dados para treinar ou ajustar modelos de IA/ML sem sua permissão ou instrução prévia. Isso se aplica a todos os modelos gerenciados na Gemini Enterprise Agent Platform, incluindo modelos em disponibilidade geral e em pré-GA.

Retenção de dados do cliente e como alcançar a retenção zero de dados

Os dados do cliente são retidos na Gemini Enterprise Agent Platform para Modelos como um Serviço (MaaS, na sigla em inglês) por períodos limitados nos seguintes cenários e condições. Para alcançar a retenção zero de dados, os clientes precisam realizar ações específicas em cada uma dessas áreas:

  • Registro de comandos para monitoramento de abuso de modelos do Google: conforme descrito na Seção 4.3 "Segurança e abuso de IA generativa" dos Termos de Serviço do Google Cloud Platform, o Google pode registrar comandos para detectar possíveis abusos e violações da Política de Uso Aceitável e da Política de Uso Proibido como parte da prestação de serviços de IA generativa aos clientes. Somente os clientes cujo uso de Google Cloud é regido pelos Termos de Serviço do Google Cloud Platform estão sujeitos ao registro de comandos para monitoramento de abuso. Se você estiver no escopo do registro de comandos para monitoramento de abuso e quiser retenção zero de dados, poderá solicitar uma exceção para monitoramento de abuso. Consulte Monitoramento de abuso.

  • Registro de comandos e respostas para monitoramento de abuso de modelos de IA avançada: alguns modelos ou recursos também podem estar sujeitos a registro adicional de comandos e respostas para evitar abusos, conforme descrito no Adendo de segurança de IA avançada. A retenção zero de dados pode não ser possível ao usar alguns recursos de IA avançada. Entre em contato com sua equipe de conta para esclarecimentos. Consulte Monitoramento de abuso para mais informações.

  • Embasamento com a Pesquisa Google: conforme descrito na Seção 20 "Serviços de IA generativa: Embasamento com a Pesquisa Google" dos Termos de Serviço Específicos, o Google coleta e armazena registros que contêm os seguintes Dados do Cliente: consultas derivadas de comandos do Usuário Final e informações contextuais que o Cliente pode fornecer junto com os comandos que não estão associados a nenhum Cliente ou Usuário Final por até três (3) dias. Essas informações armazenadas podem ser usadas para depuração de sistemas que oferecem suporte ao Embasamento com a Pesquisa Google. Não é possível desativar o armazenamento dessas informações se você usar o Embasamento com a Pesquisa Google. Se você precisar de retenção zero de dados, recomendamos o uso do Embasamento na Web para empresas.

  • Embasamento com o Google Maps: conforme descrito na Seção 20 "Serviços de IA generativa: Embasamento com o Google Maps" dos Termos de Serviço Específicos, o Google armazena comandos e informações contextuais que os clientes podem fornecer, além de resultados gerados por 30 (trinta) dias para criar resultados embasados. Essas informações armazenadas só podem ser usadas para engenharia de confiabilidade, como depuração em caso de problemas de serviço, de sistemas que oferecem suporte ao Embasamento com o Google Maps. Não é possível desativar o armazenamento dessas informações se você usar o Embasamento com o Google Maps.

  • Registro de solicitação/resposta: esse recurso está desativado por padrão. Ele pode ser ativado usando uma configuração por modelo e por projeto. A ativação desse registro faz com que determinadas solicitações e respostas ao modelo especificado sejam gravadas em uma tabela do BigQuery designada. Para alcançar a retenção zero de dados, não ative esse recurso. Para mais informações sobre esse recurso, incluindo como ativá-lo ou desativá-lo ou ler a configuração atual , consulte Solicitações e respostas de registro.

  • API Interactions: ao usar a API Interactions com store = true, o Google armazena dados do usuário (como comandos, respostas, e estado da conversa) para permitir conversas multiturno e recuperação posterior. Se você não especificar um valor para store, o padrão será true para todos os modelos. Para alcançar a retenção zero de dados, defina explicitamente store = false nas solicitações de API.

Isso se aplica a todos os modelos gerenciados na Gemini Enterprise Agent Platform, incluindo modelos em disponibilidade geral e em pré-GA.

Produtos do agente

Para alcançar a retenção zero de dados para produtos do agente, os clientes precisam obedecer às seguintes condições e programações de retenção para cada produto:

  • Dados da sessão do CodeMender : para permitir a retomada de verificações de localização e correção de longa duração, o CodeMender armazena o estado da sessão no Spanner. Enquanto uma verificação está em andamento, os dados da sessão, incluindo snippets de código-fonte de destino, diferenças, configuração e pontos de verificação de análise, são armazenados criptografados por até sete (7) dias a partir da criação da sessão. Quando uma sessão atinge um estado terminal, o código-fonte e o conteúdo relacionado são limpos em segundos. O registro de sessão restante é excluído automaticamente no TTL de sete dias. Os clientes podem excluir uma sessão (removendo todos os dados associados) antes que o TTL expire.

Modelos do Google

Para alcançar a retenção zero de dados para modelos treinados pelo Google, os clientes precisam realizar ações específicas adicionais em cada uma dessas áreas:

Retomada da sessão para a API Gemini Live

A retomada da sessão para a API Gemini Live está desativada por padrão. Ela precisa ser ativada pelo usuário sempre que ele chamar a API especificando o campo na solicitação de API, e a privacidade para envolvidos no projeto é aplicada aos dados armazenados em cache. A ativação da retomada da sessão permite que o usuário se reconecte a uma sessão anterior em até 24 horas, armazenando dados em cache, incluindo texto, vídeo e dados de comando de áudio e saídas de modelo, por até 24 horas. Para alcançar a retenção zero de dados, não ative esse recurso. Para mais informações sobre esse recurso, incluindo como ativá-lo, consulte API Gemini Live.

Armazenamento em cache de dados na memória

Por padrão, os modelos do Gemini publicados pelo Google armazenam em cache os Dados do Cliente (entradas, saídas e dados derivados) na memória para reduzir a latência e acelerar as respostas. Esses dados são armazenados apenas na memória (não em repouso), são isolados no nível do projeto e têm um TTL de 24 horas. Os dados armazenados em cache são usados apenas para melhorar o desempenho do serviço e obedecem a todos os requisitos de residência de dados para o local selecionado, sem violar a retenção zero de dados. Esse recurso pode ser desativado no nível do projeto.

Como ativar e desativar o armazenamento em cache de dados

Você pode usar os seguintes comandos curl para receber o status de armazenamento em cache, desativar o armazenamento em cache ou reativar o armazenamento em cache. Quando você desativa ou reativa o armazenamento em cache, a alteração é aplicada a todas as Google Cloud regiões. Para mais informações sobre como usar o Identity and Access Management para conceder permissões necessárias para ativar ou desativar o armazenamento em cache, consulte Controle de acesso da Gemini Enterprise Agent Platform com o IAM. Expanda as seções a seguir para saber como conseguir a configuração atual de cache e ativá-lo e desativá-lo.

Acessar a configuração de armazenamento em cache atual

Execute o comando a seguir para determinar se o armazenamento em cache está ativado ou desativado para um projeto. Para executar esse comando, o usuário precisa receber um dos seguintes papéis: roles/aiplatform.viewer, roles/aiplatform.user ou roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
# Setup project_id
$ gcloud config set project PROJECT_ID

# GetCacheConfig
$ curl -X GET \
    -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" \
    -H "Content-Type: application/json" \
    https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig

# Response if caching is enabled (caching is enabled by default).
{
  "name": "projects/PROJECT_ID/cacheConfig"
}

# Response if caching is turned off.
{
  "name": "projects/PROJECT_ID/cacheConfig"
  "disableCache": true
}
    

Desativar o armazenamento em cache

Execute o comando curl a seguir para desativar o armazenamento em cache para um Google Cloud projeto. Para executar esse comando, o usuário precisa receber o papel de administrador da Gemini Enterprise Agent Platform, roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
# Setup project_id
$ gcloud config set project PROJECT_ID

# Setup project_id.
$ gcloud config set project ${PROJECT_ID}

# Opt-out of caching.
$ curl -X PATCH \
    -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" \
    -H "Content-Type: application/json" \
    https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig \
    -d '{
      "name": "projects/PROJECT_ID/cacheConfig",
      "disableCache": true
    }'

# Response.
{
  "name": "projects/PROJECT_ID/locations/us-central1/projects/PROJECT_ID/cacheConfig/operations/${OPERATION_ID}",
  "done": true,
  "response": {
    "@type": "type.googleapis.com/google.protobuf.Empty"
  }
}
    

Ativar o armazenamento em cache

Se você desativou o armazenamento em cache para um Google Cloud projeto e quer reativá-lo, execute o comando curl a seguir. Para executar esse comando, o usuário precisa receber o papel de administrador da Gemini Enterprise Agent Platform, roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
LOCATION_ID="us-central1"
# Setup project_id
$ gcloud config set project PROJECT_ID

# Setup project_id.
$ gcloud config set project ${PROJECT_ID}

# Opt in to caching.
$ curl -X PATCH     -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" -H "Content-Type: application/json" https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig -d '{
  "name": "projects/PROJECT_ID/cacheConfig",
  "disableCache": false
}'

# Response.
{
  "name": "projects/PROJECT_ID/locations/us-central1/projects/PROJECT_ID/cacheConfig/operations/${OPERATION_NUMBER}",
  "done": true,
  "response": {
    "@type": "type.googleapis.com/google.protobuf.Empty"
  }
}
    

A seguir

Visão geral

Saiba mais sobre algumas das limitações da IA generativa e as práticas recomendadas para usar a IA generativa.

Visão geral

Saiba como o Gemini para Google Cloud está em conformidade com o compromisso de privacidade do Google em relação às tecnologias de IA generativa.