Onde seus dados ficam e são tratados
A plataforma de agentes do Gemini Enterprise oferece transparência sobre onde seus dados são armazenados ("em repouso") e onde ocorre a computação real do modelo ("processamento de ML").
1. Dados em repouso (armazenamento)
Quando você armazena dados na plataforma do agente (como pesos de modelos personalizados ou metadados), eles permanecem armazenados fisicamente no local específico Google Cloud que você escolheu. Essa residência é mantida independente do endpoint usado para chamar o modelo.
2. Processamento de ML (em uso)
O processamento de ML é o método pelo qual os dados são tratados para produzir ponderações de modelo (ajuste e treinamento) ou aplicar o modelo aos dados para inferência. A localização geográfica desse tratamento é determinada pela sua escolha de endpoint:
Endpoints multirregionais jurisdicionais: quando você usa endpoints jurisdicionais, o processamento de ML permanece nessa região geográfica específica (como os Estados Unidos ou a União Europeia).
Eficiência operacional (capacidade unificada): os endpoints multirregionais eliminam silos de recursos regionais. Em vez de comprar e gerenciar alocações separadas de Capacidade de Processamento Provisionada para regiões individuais (como
us-central1eus-east4), você pode implantar um único compromisso de Capacidade de Processamento Provisionada que abrange todo o limite jurisdicional (como os Estados Unidos).Habilitação da conformidade: os endpoints multirregionais oferecem os controles de isolamento de dados em uso necessários para atender a estruturas regulatórias rigorosas. Embora os endpoints multirregionais sirvam como uma capacidade técnica fundamental para obedecer aos requisitos do Nível de impacto 5 (IL5) do Departamento de Defesa (DoD) ou do Regulamento Internacional de Tráfego de Armas (ITAR, na sigla em inglês), para alcançar a conformidade total, também é necessário ter uma arquitetura, identidade e controles de acesso mais amplos gerenciados pelo cliente.
Endpoints de local: esses endpoints (como
us-central1,europe-west1) garantem que o processamento de ML permaneça totalmente dentro da jurisdição multirregional ou do país associado a essa região (por exemplo, solicitações para us-central1 são processadas nos Estados Unidos).Para regiões europeias, o processamento local no país varia de acordo com o tipo de modelo. Por exemplo, alguns modelos específicos podem ter processamento local na França ou na Alemanha, enquanto outros são processados no limite mais amplo da multirregião da UE. Consulte a seção a seguir para conferir os compromissos exatos de processamento de ML para cada modelo e local.
- Alinhamento de compliance: embora os endpoints de local atendam aos requisitos padrão de governança de dados corporativos e soberanos (como GDPR e HIPAA), as cargas de trabalho que exigem estruturas de isolamento governamental especializadas, como DoD IL5 ou ITAR, precisam ser implantadas em endpoints jurisdicionais como parte de uma arquitetura compatível mais ampla.
Endpoints globais: os endpoints globais roteiam e processam dados em qualquer lugar do mundo, sem restringir a uma região geográfica específica. Esses endpoints (como
https://aiplatform.googleapis.com) não especificam uma região no nome do host. Eles são projetados para maximizar a disponibilidade e minimizar a latência encerrando as sessões TLS o mais próximo possível do cliente, mas não oferecem isolamento regional nem garantias de residência de dados.
Modelos compatíveis
As tabelas nesta seção abordam o suporte regional para processamento de ML por modelo nas seguintes categorias:
Modelos do Google
Para saber quais recursos oferecem suporte à residência de dados, consulte Recursos compatíveis.
| Modelo | EUA multirregional | UE multirregional | Brasil(southamerica-east1) | Canadá(northamerica-northeast1) | França(europe-west9) | Alemanha(europe-west3) | Países Baixos(europe-west4) | Reino Unido(europe-west2) | Austrália(australia-southeast1) | Índia(asia-south1) | Japão(asia-northeast1) | Singapura(asia-southeast1) | Coreia do Sul(asia-northeast3) |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)
|
|||||||||||||
Gemini 3.5 Flash(gemini-3.5-flash)
|
|||||||||||||
Gemini 3.1 Flash-Lite(gemini-3.1-flash-lite)
|
|||||||||||||
Áudio nativo da API Gemini 2.5 Flash Live(gemini-live-2.5-flash-native-audio)
|
|||||||||||||
Gemini 2.5 Flash, 128k(gemini-2.5-flash)
|
|||||||||||||
Gemini 2.5 Flash, 1M(gemini-2.5-flash)
|
|||||||||||||
Criação de Imagens do Gemini 2.5 Flash(gemini-2.5-flash-image)
|
|||||||||||||
Gemini 2.5 Flash-Lite(gemini-2.5-flash-lite)
|
|||||||||||||
Gemini 2.5 Pro, 1M(gemini-2.5-pro)
|
|||||||||||||
Gemini 2.5 Pro, 64k(gemini-2.5-pro)
|
|||||||||||||
Ajuste para o Gemini 2.5 Flash(gemini-2.5-flash)
|
|||||||||||||
Ajuste do Gemini 2.5 Flash-Lite(gemini-2.5-flash-lite)
|
|||||||||||||
Ajuste para o Gemini 2.5 Pro(gemini-2.5-pro)
|
|||||||||||||
Embeddings do Gemini(gemini-embedding-001)
|
|||||||||||||
Embedding do Gemini 2(gemini-embedding-2)
|
|||||||||||||
Chirp 2: transcrição(chirp_2)
|
|||||||||||||
Chirp 3: transcrição(chirp_3)
|
|||||||||||||
| Chirp 3: vozes em alta definição | |||||||||||||
| Chirp 3: voz personalizada instantânea | |||||||||||||
| Embeddings para multimodal | |||||||||||||
Embeddings para texto(text-embedding-004)
|
|||||||||||||
Embeddings para texto(text-embedding-005)
|
|||||||||||||
Embeddings para texto(text-multilingual-embedding-002)
|
Suporte ao modelo deGoogle Cloud parceiro
| Modelo | EUA multirregional | UE multirregional | Bélgica(europe-west1) | Países Baixos(europe-west4) | Singapura(asia-southeast1) | Taiwan(asia-east1) | Global |
|---|---|---|---|---|---|---|---|
| Claude Sonnet 5 da Anthropic no Google Cloud | |||||||
| Claude Opus 5 da Anthropic no Google Cloud | |||||||
| Claude Fable 5 da Anthropic no Google Cloud | |||||||
| Claude Haiku 4.5 da Anthropic no Google Cloud | |||||||
| Claude Opus 4 da Anthropic no Google Cloud | |||||||
| Claude Opus 4.1 da Anthropic no Google Cloud | |||||||
| Claude Opus 4.5 da Anthropic no Google Cloud | |||||||
| Claude Opus 4.8 da Anthropic no Google Cloud | |||||||
| Claude Opus 4.7 da Anthropic no Google Cloud | |||||||
| Claude Opus 4.6 da Anthropic no Google Cloud | |||||||
| Claude Sonnet 4 da Anthropic no Google Cloud | |||||||
| Claude Sonnet 4.5 da Anthropic no Google Cloud | |||||||
| Claude Sonnet 4.6 da Anthropic no Google Cloud | |||||||
| Claude 3.5 Haiku da Anthropic no Google Cloud (descontinuado) | |||||||
| Haiku do Claude 3 da Anthropic no Google Cloud (descontinuado) | |||||||
| Claude 3.7 Sonnet da Anthropic no Google Cloud (descontinuado) | |||||||
| Codestral (24.05) | |||||||
| Codestral 2 | |||||||
| Mistral Large (24.07) | |||||||
| Mistral Medium 3 | |||||||
| OCR do Mistral (25/05) | |||||||
| Mistral Small 3.1 (25/03) |
Suporte a modelos abertos doGoogle Cloud
| Modelo | EUA multirregional | UE multirregional | Singapura(asia-southeast1) | Global |
|---|---|---|---|---|
| DeepSeek-OCR | ||||
| DeepSeek R1 (0528) | ||||
| DeepSeek-V3.1 | ||||
| DeepSeek-V3.2 | ||||
| Gemma 4 26B A4B IT | ||||
| GLM 4.7 | ||||
| GLM 5 | ||||
| gpt-oss 120B | ||||
| gpt-oss 20B | ||||
| Kimi K2 Thinking | ||||
| Llama 3.3 70B (pré-lançamento) | ||||
| Llama 4 Maverick 17B-128E (pré-lançamento) | ||||
| Llama 4 Scout 17B-16E (pré-lançamento) | ||||
| MiniMax M2 | ||||
| Multilíngue E5 Large | ||||
| E5 Small multilíngue | ||||
| Qwen3 235B | ||||
| Qwen3 Coder | ||||
| Qwen3-Next-80B Instruct | ||||
| Qwen3-Next-80B Thinking |
A seguir
- Saiba mais sobre as regiões doGoogle Cloud .
Saiba mais sobre os controles de segurança por recurso.
Saiba mais sobre os locais da Gemini Enterprise Agent Platform.