Gemini 2.0 Flash

O Gemini 2.0 Flash oferece recursos de próxima geração e capacidades aprimoradas projetadas para a era do agente, incluindo velocidade superior, uso de ferramentas integradas, geração multimodal e uma janela de contexto de 1 milhão de tokens. O Gemini 2.0 Flash melhora nosso modelo Flash anterior e oferece qualidade aprimorada em velocidades semelhantes.

Testar no Agent Studio Ver no Model Garden Implantar app de exemplo

Observação: "Implantar app de exemplo" exige um projeto do Google Cloud com o faturamento e a API Agent Platform ativados.
ID do modelo gemini-2.0-flash
Modalidades
Texto Entrada e saída
Imagem Somente entrada
Áudio Somente entrada
Vídeo Somente entrada
Limites de tokens Janela de contexto 1.048.576
Máximo de tokens de saída 8.192 (padrão)
Recursos
Ferramentas
Opções de consumo
Consulte Opções de consumo para mais informações.
Limite de tamanho da entrada 500 MB
Especificações técnicas Imagem
  • Máximo de imagens por comando: 3.000
  • Tamanho máximo do arquivo para dados inline ou uploads diretos pelo console: 7 MB
  • Tamanho máximo do arquivo por arquivo do Google Cloud Storage: 30 MB
  • Número máximo de tokens por minuto (TPM) por projeto:
    • Resolução de mídia alta/média/padrão:
      • EUA/Ásia: 40 M
      • UE: 10 M
    • Resolução de mídia baixa:
      • EUA/Ásia: 10 M
      • UE: 2,6 M
  • Tipos MIME compatíveis:
    image/png, image/jpeg, image/webp, image/heic, image/heif
Texto
  • Número máximo de arquivos por comando: 3.000
  • Número máximo de páginas por arquivo: 1.000
  • Tamanho máximo do arquivo por arquivo para a API ou importações do Cloud Storage: 50 MB(application/pdf) ou 7 MB(text/plain)
  • Tamanho máximo do arquivo por arquivo para uploads diretos pelo console: 7 MB
  • Número máximo de tokens por minuto (TPM) por projeto1:
    • EUA/Ásia: 3,4 M
    • UE: 3,4 M
  • Tipos MIME compatíveis:
    application/pdf, text/plain
Vídeo
  • Duração máxima do vídeo (com áudio): aproximadamente 45 minutos
  • Duração máxima do vídeo (sem áudio): aproximadamente 1 hora
  • Número máximo de vídeos por comando: 10
  • Número máximo de tokens por minuto (TPM):
    • Resolução de mídia alta/média/padrão:
      • EUA/Ásia: 38 M
      • UE: 10 M
    • Resolução de mídia baixa:
      • EUA/Ásia: 10 M
      • UE: 2,5 M
  • Tipos MIME compatíveis:
    video/x-flv, video/quicktime, video/mpeg, video/mpegs, video/mpg, video/mp4, video/webm, video/wmv, video/3gpp
Áudio
  • Duração máxima de áudio por comando: aproximadamente 8, 4 horas ou até 1 milhão de tokens
  • Número máximo de arquivos de áudio por comando: 1
  • Entendimento de fala para: resumo, transcrição e tradução de áudio
  • Número máximo de tokens por minuto (TPM):
    • EUA/Ásia: 3,5 M
    • UE: 3,5 M
  • Tipos MIME compatíveis:
    audio/x-aac, audio/flac, audio/mp3, audio/m4a, audio/mpeg, audio/mpga, audio/mp4, audio/ogg, audio/pcm, audio/wav, audio/webm
Padrões de parâmetros
  • Temperatura: 0,0 a 2,0 (padrão 1,0)
  • topP: 0,0 a 1,0 (padrão 0,95)
  • topK: 64 (fixo)
  • candidateCount: 1 a 8 (padrão 1)
Regiões compatíveis

Disponibilidade do modelo

  • Global
    • global
  • Estados Unidos
    • us-central1
    • us-east1
    • us-east4
    • us-east5
    • us-south1
    • us-west1
    • us-west4
  • Europa
    • europe-central2
    • europe-north1
    • europe-southwest1
    • europe-west1
    • europe-west4
    • europe-west8
    • europe-west9

Processamento de ML

Consulte Implantações e endpoints para mais informações.
Data limite de conhecimento Junho de 2024
Versões
  • gemini-2.0-flash-001
    • Etapa de lançamento: descontinuado
    • Data de lançamento: 5 de fevereiro de 2025
    • Data de desativação: 1º de junho de 2026
Preços Consulte a seção "Preços".