Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite è l'ultimo modello della nostra linea di modelli Flash-Lite convenienti. È ottimizzato per attività di programmazione semplici, comprensione precisa dei documenti e workflow agentici leggeri che richiedono un'inferenza rapida a costi minimi. 3.5 Flash-Lite è un modello sostitutivo adatto per Gemini 2.5 Flash e carichi di lavoro Gemini 3 Flash meno complessi.

Quando utilizzi 3.5 Flash-Lite, puoi utilizzare diversi livelli di ragionamento per ottimizzare la qualità, la velocità e l'output di token:

  • Utilizza thinking_level.MINIMAL per attività di classificazione ed estrazione più semplici o sensibili alla latenza: 3.5 Flash-Lite utilizza per impostazione predefinita il ragionamento minimo, che ottimizza la velocità e l'efficienza dei costi. È ideale per attività di classificazione, routing o estrazione JSON ad alto throughput.
  • Utilizza thinking_level.MEDIUM o thinking_level.HIGH per i subagent: se utilizzi 3.5 Flash-Lite come subagent autonomo che scrive codice, esegue comandi del terminale o chiama API esterne, imposta il livello di ragionamento su medio o alto. L'utilizzo del livello di ragionamento minimo può causare la terminazione prematura dello strumento nelle attività in più passaggi.

3.5 Flash-Lite include le seguenti modifiche potenzialmente irreversibili rispetto ai modelli Gemini precedenti:

  • I valori personalizzati per parametri come temperatura, top-K e top-P non sono supportati. Se imposti un valore personalizzato per questi parametri, il valore verrà ignorato.
  • I valori personalizzati per i parametri di penalità di frequenza e presenza non sono supportati. L'impostazione di un valore personalizzato per questi parametri genererà un errore.
  • Le richieste API in cui l'ultimo turno di input ha un ruolo di Model non sono supportate. I seguenti tipi di richieste restituiranno un errore:
    • Quando utilizzi l'API Interactions: richieste in cui l'ultimo oggetto nell' input array ha "type": "model_output".
    • Quando utilizzi l'API GenerateContent: richieste in cui l'ultimo oggetto in the contents array ha "role": "model".

Prova in Agent Studio Esegui il deployment dell'app di esempio Prezzi

Nota: "Esegui il deployment dell'app di esempio" richiede un progetto Google Cloud con la fatturazione e l'API Agent Platform abilitate.
ID modello gemini-3.5-flash-lite
Modalità
Text Input and output
Image Input only
Audio Input only
Video Input only
Limiti di token Finestra contestuale 1.048.576
Numero massimo di token di output 65.536
Funzionalità
Strumenti
Opzioni di consumo
Specifiche tecniche Immagine
  • Numero massimo di immagini per prompt: 3000
  • Dimensione massima del file per i dati in linea o i caricamenti diretti tramite la console: 7 MB
  • Dimensione massima del file per file da Google Cloud Storage: 30 MB
  • Tipi MIME supportati:
    image/png, image/jpeg, image/webp, image/heic, image/heif
Testo
  • Numero massimo di file per prompt: 3000
  • Numero massimo di pagine per file: 3000
  • Dimensione massima del file per file per le importazioni API o Cloud Storage: 50 MB(application/pdf) o 7 MB(text/plain)
  • Dimensione massima del file per file per i caricamenti diretti tramite la console: 7 MB
  • Tipi MIME supportati:
    application/pdf, text/plain
Video
  • Durata massima del video (con audio): circa 45 minuti
  • Durata massima del video (senza audio): circa 1 ora
  • Numero massimo di video per prompt: 10
  • Tipi MIME supportati:
    video/x-flv, video/quicktime, video/mpeg, video/mpegs, video/mpg, video/mp4, video/webm, video/wmv, video/3gpp
Audio
  • Durata massima dell'audio per prompt: circa 8, 4 ore o fino a 1 milione di token
  • Numero massimo di file audio per prompt: 1
  • Tipi MIME supportati:
    audio/x-aac, audio/flac, audio/mp3, audio/m4a, audio/mpeg, audio/mpga, audio/mp4, audio/ogg, audio/pcm, audio/wav, audio/webm
Valori predefiniti dei parametri
  • Temperatura: 1.0
  • topP: 0,95
  • topK: 64
  • Penalità di frequenza: 0
  • Penalità di presenza: 0
Aree geografiche supportate

Disponibilità del modello

  • Globale: global
  • Multiregionale: us, eu

Elaborazione ML

  • Multiregionale: us, eu

Throughput riservato

  • Globale: global
  • Multiregionale: us, eu

Standard PayGo

  • Globale: global
  • Multiregionale: us, eu
Versioni
  • gemini-3.5-flash-lite
    • Fase di avvio: GA
    • Data di rilascio: 21 luglio 2026
    • Data di ritiro: 21 luglio 2027 o successiva
Controlli di sicurezza Previsione online
  • Residenza dei dati
  • CMEK
  • VPC-SC
  • AXT
Inferenza batch
  • Residenza dei dati
  • CMEK
  • VPC-SC
  • AXT
Memorizzazione nella cache del contesto
  • Residenza dei dati
  • CMEK
  • VPC-SC
  • AXT
Per ulteriori informazioni, consulta Controlli di sicurezza.