Gemini Enterprise Agent Platform e retenção de dados zero

O Google foi o primeiro no setor a publicar um compromisso de privacidade de IA/ML, que descreve que os clientes devem ter o mais alto nível de segurança e controle sobre os dados armazenados na nuvem. Esse compromisso se estende aos produtos de IA generativa do Google Cloud. Para que nossas equipes honrem o compromisso, o Google adota práticas robustas de governança de dados, que incluem análises dos dados que o Google Cloud usa para desenvolver produtos. Para mais detalhes sobre como o Google trata dados, consulte o Adendo sobre tratamento de dados do Cloud (CDPA).

Restrição de treinamento

Conforme descrito na "Restrição de treinamento" na seção Termos de serviço dos Termos específicos do serviço, o Google não usará seus dados para treinar ou refinar modelos de IA/ML sem sua permissão ou instrução prévia. Isso se aplica a todos os modelos gerenciados na Gemini Enterprise Agent Platform, incluindo modelos em GA e pré-GA.

Retenção de dados do cliente e como alcançar a retenção zero de dados

Os dados do cliente são retidos na Gemini Enterprise Agent Platform para modelos como serviço (MaaS) por períodos limitados nos seguintes cenários e condições. Para alcançar a retenção zero de dados, os clientes precisam realizar ações específicas em cada uma destas áreas:

  • Registro de comandos para monitoramento de abuso em modelos do Google: conforme descrito na seção 4.3 "Segurança e abuso da IA generativa" dos Termos de Serviço do Google Cloud Platform, o Google pode registrar comandos para detectar possíveis abusos e violações da Política de uso aceitável e da Política de uso proibido como parte da prestação de serviços de IA generativa aos clientes. Somente os clientes cujo uso de Google Cloud é regido pelos Termos de Serviço do Google Cloud Platform estão sujeitos ao registro de solicitações para monitoramento de abuso. Se você estiver no escopo da geração de registros de solicitações para monitoramento de abuso e quiser retenção de dados zero, peça uma exceção para monitoramento de abuso. Consulte Monitoramento de abuso.

  • Registro de comandos e respostas para monitoramento de abuso em modelos de IA avançada: alguns modelos ou recursos também podem estar sujeitos a registro adicional de comandos e respostas para evitar abuso, conforme descrito no Aditivo de segurança de IA avançada. A retenção de dados zero pode não ser possível ao usar alguns recursos avançados de IA. Entre em contato com sua equipe de conta para esclarecimentos. Consulte Monitoramento de abuso para mais informações.

  • Embasamento com a Pesquisa Google: conforme descrito na Seção 20 "Serviços de IA generativa: embasamento com a Pesquisa Google" dos Termos específicos do serviço, o Google coleta e armazena registros que contêm os seguintes Dados do cliente: consultas derivadas de comandos do usuário final e informações contextuais que o cliente pode fornecer junto com os comandos que não estão associados a nenhum cliente ou usuário final por até três (3) dias. Essas informações armazenadas podem ser usadas para depuração de sistemas que oferecem suporte ao embasamento com a Pesquisa Google. Não é possível desativar o armazenamento dessas informações se você usa o embasamento com a Pesquisa Google. Se você precisar de retenção de dados zero, recomendamos usar o Web Grounding para empresas.

  • Embasamento com o Google Maps: conforme descrito na seção 20 "Serviços de IA generativa: embasamento com o Google Maps" dos Termos específicos do serviço, o Google armazena comandos e informações contextuais que os clientes podem fornecer, além de resultados gerados por 30 dias para criar resultados embasados. Essas informações armazenadas só podem ser usadas para engenharia de confiabilidade, como depuração em caso de problemas no serviço, de sistemas que oferecem suporte ao embasamento com o Google Maps. Não é possível desativar o armazenamento dessas informações se você usa o embasamento com o Google Maps.

  • Registro de solicitações e respostas: esse recurso fica desativado por padrão. Ele pode ser ativado usando uma configuração por modelo e por projeto. Ao ativar essa geração de registros, algumas solicitações e respostas ao modelo especificado são gravadas em uma tabela designada do BigQuery. Para alcançar a retenção de dados zero, não ative esse recurso. Para mais informações sobre esse recurso, incluindo como ativar ou desativar ou ler a configuração atual, consulte Registrar solicitações e respostas.

Isso se aplica a todos os modelos gerenciados na Gemini Enterprise Agent Platform, incluindo modelos em GA e pré-GA.

Produtos do agente

Para alcançar retenção zero de dados nos produtos do agente, os clientes precisam obedecer às seguintes condições e cronogramas de retenção para cada produto:

  • Dados da sessão do CodeMender: para permitir a retomada de verificações de localização e correção de longa duração, o CodeMender armazena o estado da sessão no Spanner. Enquanto uma verificação está em andamento, os dados da sessão, incluindo snippets de código-fonte de destino, diffs, configuração e pontos de verificação de análise, são armazenados criptografados por até sete (7) dias a partir da criação da sessão. Quando uma sessão atinge um estado final, o código-fonte e o conteúdo relacionado são limpos em segundos. O registro restante da sessão é excluído automaticamente no TTL de sete dias. Os clientes podem excluir uma sessão (removendo todos os dados associados) antes que o TTL expire.

Modelos do Google

Para alcançar retenção zero de dados nos modelos treinados pelo Google, os clientes precisam realizar outras ações específicas em cada uma destas áreas:

Retomada de sessão para a API Gemini Live

A retomada de sessão para a API Gemini Live fica desativada por padrão. Ele precisa ser ativado pelo usuário sempre que ele chama a API especificando o campo na solicitação de API, e a privacidade para envolvidos no projeto é aplicada aos dados armazenados em cache. Ao ativar a retomada de sessão, o usuário pode se reconectar a uma sessão anterior em até 24 horas armazenando dados em cache, incluindo texto, vídeo e dados de comandos de áudio e saídas de modelo, por até 24 horas. Para ter retenção de dados zero, não ative esse recurso. Para mais informações sobre esse recurso, incluindo como ativá-lo, consulte API Gemini Live.

Armazenamento em cache de dados na memória

Por padrão, os modelos do Gemini publicados pelo Google armazenam em cache os dados do cliente (entradas, saídas e dados derivados) na memória para reduzir a latência e acelerar as respostas. Esses dados são armazenados apenas na memória (não em repouso), são isolados no nível do projeto e têm um TTL de 24 horas. Os dados armazenados em cache são usados apenas para melhorar o desempenho do serviço e obedecem a todos os requisitos de residência de dados para o local selecionado, sem violar a retenção de dados zero. Esse recurso pode ser desativado no nível do projeto.

Como ativar e desativar o armazenamento em cache de dados

Você pode usar os seguintes comandos curl para receber o status de armazenamento em cache, desativar o armazenamento em cache ou reativar o armazenamento em cache. Quando você desativa ou reativa o armazenamento em cache, a mudança é aplicada a todas as regiões Google Cloud . Para mais informações sobre como usar o Identity and Access Management para conceder permissões necessárias para ativar ou desativar o armazenamento em cache, consulte Controle de acesso da plataforma de agentes do Gemini Enterprise com IAM. Expanda as seções a seguir para saber como conseguir a configuração atual de cache e ativá-lo e desativá-lo.

Acessar a configuração de armazenamento em cache atual

Execute o comando a seguir para determinar se o armazenamento em cache está ativado ou desativado em um projeto. Para executar esse comando, o usuário precisa receber um dos seguintes papéis: roles/aiplatform.viewer, roles/aiplatform.user ou roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
# Setup project_id
$ gcloud config set project PROJECT_ID

# GetCacheConfig
$ curl -X GET \
    -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" \
    -H "Content-Type: application/json" \
    https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig

# Response if caching is enabled (caching is enabled by default).
{
  "name": "projects/PROJECT_ID/cacheConfig"
}

# Response if caching is turned off.
{
  "name": "projects/PROJECT_ID/cacheConfig"
  "disableCache": true
}
    

Desativar o armazenamento em cache

Execute o comando curl a seguir para desativar o armazenamento em cache para um projeto do Google Cloud . Para executar esse comando, o usuário precisa receber o papel de administrador da Gemini Enterprise Agent Platform, roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
# Setup project_id
$ gcloud config set project PROJECT_ID

# Setup project_id.
$ gcloud config set project ${PROJECT_ID}

# Opt-out of caching.
$ curl -X PATCH \
    -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" \
    -H "Content-Type: application/json" \
    https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig \
    -d '{
      "name": "projects/PROJECT_ID/cacheConfig",
      "disableCache": true
    }'

# Response.
{
  "name": "projects/PROJECT_ID/locations/us-central1/projects/PROJECT_ID/cacheConfig/operations/${OPERATION_ID}",
  "done": true,
  "response": {
    "@type": "type.googleapis.com/google.protobuf.Empty"
  }
}
    

Ativar o armazenamento em cache

Se você desativou o armazenamento em cache de um projeto do Google Cloud e quer reativá-lo, execute o comando curl a seguir. Para executar esse comando, o usuário precisa ter o papel de administrador da Gemini Enterprise Agent Platform, roles/aiplatform.admin.

PROJECT_ID=PROJECT_ID
LOCATION_ID="us-central1"
# Setup project_id
$ gcloud config set project PROJECT_ID

# Setup project_id.
$ gcloud config set project ${PROJECT_ID}

# Opt in to caching.
$ curl -X PATCH     -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" -H "Content-Type: application/json" https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/cacheConfig -d '{
  "name": "projects/PROJECT_ID/cacheConfig",
  "disableCache": false
}'

# Response.
{
  "name": "projects/PROJECT_ID/locations/us-central1/projects/PROJECT_ID/cacheConfig/operations/${OPERATION_NUMBER}",
  "done": true,
  "response": {
    "@type": "type.googleapis.com/google.protobuf.Empty"
  }
}
    

A seguir

Visão geral

Saiba mais sobre algumas das limitações da IA generativa e as práticas recomendadas para usar essa tecnologia.

Visão geral

Saiba como o Gemini para Google Cloud está em conformidade com o compromisso de privacidade do Google em relação às tecnologias de IA generativa.