Google utilizza la tecnologia AI per tradurre i contenuti nella tua lingua preferita. Le traduzioni generate dall'AI potrebbero contenere errori.

Modelli Google

Modelli Gemini in primo piano

3.6 Flash

Maggiore efficienza e ragionamento pratico, per creare e iterare con maggiore facilità

Maggiore efficienza dei token
Generazione di codice più affidabile
Ragionamento multimodale più efficace

3.5 Flash-Lite

Il nostro modo rapido ed economico per potenziare le tue applicazioni quotidiane

Ottimizzato per bassa latenza e traffico a volume elevato
Orchestrazione efficiente degli strumenti
Comprensione precisa dei documenti

3.1 Flash Image

Trasforma le idee in asset pronti per la produzione

Genera immagini di alta qualità
Consente la modifica conversazionale a turni
Consente la fusione di più immagini e la coerenza dei personaggi per workflow creativi avanzati

Modelli Gemini disponibili a livello generale

spark Gemini 3.6 Flash Ottimizzato per workflow complessi in più passaggi, generazione di codice migliorata e ragionamento multimodale migliorato, il tutto utilizzando meno token.

performance_auto Gemini 3.5 Flash-Lite Crea workflow agentici leggeri alla massima velocità e al minimo costo.

🍌 Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) Trasforma le idee in asset pronti per la produzione. Progettato per workload a volume elevato e sensibili alla latenza.

🍌 Gemini 3.1 Flash Image Trasforma le idee in asset pronti per la produzione. Include funzionalità di modifica conversazionale, fusione di più immagini e coerenza dei personaggi per workflow creativi avanzati.

🍌 Gemini 3 Pro Image Generazione di immagini ad alta fedeltà con composizione migliorata dal ragionamento. Supporta il rendering di testo leggibile, la modifica complessa in più passaggi e la coerenza dei personaggi utilizzando fino a 14 input di riferimento.

spark Gemini 3.5 Flash Gemini 3.5 Flash offre un'intelligenza di livello quasi Pro al costo e alla velocità del livello Flash: competenza di programmazione di livello Pro, esecuzione agentica parallela, il tutto allo stesso prezzo di un modello Flash.

performance_auto Gemini 3.1 Flash-Lite Il nostro modello più economico, ottimizzato per casi d'uso a bassa latenza per il traffico LLM a volume elevato e sensibile ai costi.

diamond Gemini 2.5 Pro Il nostro modello ad alta capacità per ragionamenti e programmazione complessi. Include funzionalità di pensiero adattivo per risolvere sfide agentiche e multimodali complesse con un contesto di 1 milione di token.

spark Gemini 2.5 Flash Velocissimo e altamente capace. Offre un equilibrio tra intelligenza e latenza con budget di pensiero controllabili per applicazioni versatili.

🍌 Gemini 2.5 Flash Image Trasforma le idee in asset pronti per la produzione. Include funzionalità di modifica conversazionale, fusione di più immagini e coerenza dei personaggi per workflow creativi avanzati.

performance_auto Gemini 2.5 Flash-Lite Progettato per una scalabilità elevata. Bilancia costi e prestazioni per attività a throughput elevato, ottimizzato per l'efficienza senza sacrificare la comprensione multimodale.

audio_spark Gemini 2.5 Flash con API Gemini Live Progettato per lo streaming bidirezionale in tempo reale. Include funzionalità audio integrate a bassa latenza e di dialogo affettivo per interazioni conversazionali naturali.

Anteprima dei modelli Gemini

anteprima Gemini Omni Flash Genera video da testo o asset di riferimento oppure modifica i video esistenti.

anteprima Gemini 3 Flash Il nostro modello migliore per la comprensione multimodale complessa, progettato per affrontare i problemi agentici più difficili con solide funzionalità di programmazione e ragionamento allo stato dell'arte.

anteprima Gemini 3 Pro Image Generazione di immagini ad alta fedeltà con composizione migliorata dal ragionamento. Supporta il rendering di testo leggibile, la modifica complessa in più passaggi e la coerenza dei personaggi utilizzando fino a 14 input di riferimento.

Modelli Gemma

Gemma 4 Un modello open adatto per attività come la generazione di testo, la programmazione e il ragionamento, che supporta l'input multimodale (testo e immagine per tutte le varianti e, in aggiunta, audio per le varianti E2B ed E4B).

Gemma 3n Un modello open progettato per un'esecuzione efficiente su dispositivi con poche risorse, che supporta l'input multimodale (testo, immagine, video e audio) e l'output di testo in oltre 140 lingue.

Gemma 3 Un modello open che include input di testo e immagini, supporto per oltre 140 lingue e una finestra contestuale di 128.000 token.

Gemma 2 Un modello open che supporta la generazione, il riepilogo e l'estrazione di testo.

Gemma Un modello open piccolo e leggero che supporta la generazione, il riepilogo e l'estrazione di testo.

ShieldGemma 2 Modelli ottimizzati per le istruzioni per valutare la sicurezza di testo e immagini in base a policy definite.

PaliGemma Un modello open di visione-linguaggio che combina SigLIP e Gemma.

CodeGemma Un modello open potente e leggero per attività di programmazione, tra cui il completamento, la generazione e la comprensione del codice.

TxGemma Un modello che genera previsioni, classificazioni o testo in base a dati correlati alla terapia, per creare modelli di AI con meno dati e calcoli.

MedGemma Una raccolta di varianti di Gemma 3 addestrate per le prestazioni nella comprensione di testo e immagini mediche.

MedSigLIP Una variante di SigLIP addestrata per codificare immagini e testo medici in uno spazio di embedding comune.

T5Gemma Una famiglia di modelli di ricerca encoder-decoder leggeri.

Modelli di embedding

width_normal Embedding per il testo Converte i dati di testo in rappresentazioni vettoriali per la ricerca semantica, la classificazione e il clustering.

width_normal Embedding multimodali Genera vettori basati su immagini, per attività come la classificazione e la ricerca di immagini.

Modelli Veo

movie Veo 2 Genera Genera video da prompt di testo e immagini.

movie Veo 3 Genera Genera video da prompt di testo e immagini di alta qualità.

movie Veo 3 Fast Genera video da prompt testuali e immagini di alta qualità e a bassa latenza.

movie Veo 3.1 Generate Genera video da prompt di testo e immagini di alta qualità.

movie Veo 3.1 Veloce Genera video da prompt di testo e immagini di alta qualità e a bassa latenza.

Anteprima dei modelli Veo

movie Veo 3.1 Lite (anteprima) Genera video da prompt di testo e immagini di alta qualità e a basso costo.

Modelli Lyria

music_note_spark Lyria 3 Pro (anteprima) Genera brani musicali completi da prompt di testo e immagini.

music_note_spark Lyria 3 Clip (anteprima) Genera clip audio di 30 secondi da prompt di testo e immagini.

audio_spark Lyria 2 Genera musica da prompt di testo.

Supporto dei linguaggi

Gemini

Tutti i modelli Gemini possono comprendere e rispondere nelle seguenti lingue:

Afrikaans (af), albanese (sq), amarico (am), arabo (ar), armeno (hy), assamese (as), azero (az), basco (eu), bielorusso (be), bengalese (bn), bosniaco (bs), bulgaro (bg), catalano (ca), cebuano (ceb), cinese (semplificato e tradizionale) (zh), corso (co), croato (hr), ceco (cs), danese (da), divehi (dv), olandese (nl), inglese (en), esperanto (eo), estone (et), filippino (tagalog) (fil), finlandese (fi), francese (fr), frisone (fy), galiziano (gl), georgiano (ka), tedesco (de), greco (el), gujarati (gu), creolo haitiano (ht), hausa (ha), hawaiano (haw), ebraico (iw), hindi (hi), hmong (hmn), ungherese (hu), islandese (is), igbo (ig), indonesiano (id), irlandese (ga), italiano (it), giapponese (ja), giavanese (jv), kannada (kn), kazako (kk), khmer (km), coreano (ko), krio (kri), curdo (ku), kirghiso (ky), lao (lo), latino (la), lettone (lv), lituano (lt), lussemburghese (lb), macedone (mk), malgascio (mg), malese (ms), malayalam (ml), maltese (mt), maori (mi), marathi (mr), meiteilon (manipuri) (mni-Mtei), mongolo (mn), birmano (my), nepalese (ne), norvegese (no), nyanja (chichewa) (ny), odia (oriya) (or), pashto (ps), persiano (fa), polacco (pl), portoghese (pt), punjabi (pa), rumeno (ro), russo (ru), samoano (sm), gaelico scozzese (gd), serbo (sr), sesotho (st), shona (sn), sindhi (sd), singalese (si), slovacco (sk), sloveno (sl), somalo (so), spagnolo (es), sundanese (su), swahili (sw), svedese (sv), tagico (tg), tamil (ta), telugu (te), tailandese (th), turco (tr), ucraino (uk), urdu (ur), uiguro (ug), uzbeco (uz), vietnamita (vi), gallese (cy), xhosa (xh), yiddish (yi), yoruba (yo) e zulu (zu).

Gemma

Gemma e Gemma 2 supportano solo la lingua inglese (en). Gemma 3 e Gemma 3n forniscono supporto multilingue in oltre 140 lingue.

Embedding

I modelli di text embedding multilingue supportano le seguenti lingue:

Afrikaans (af), albanese (sq), amarico (am), arabo (ar), armeno (hy), azero (az), basco (eu), bielorusso (be), bengalese (bn), bulgaro (bg), catalano (ca), cebuano (ceb), cinese (semplificato e tradizionale) (zh), corso (co), ceco (cs), danese (da), olandese (nl), inglese (en), esperanto (eo), estone (et), filippino (tagalog) (fil), finlandese (fi), francese (fr), frisone (fy), galiziano (gl), georgiano (ka), tedesco (de), greco (el), gujarati (gu), creolo haitiano (ht), hausa (ha), hawaiano (haw), ebraico (iw), hindi (hi), hmong (hmn), ungherese (hu), islandese (is), igbo (ig), indonesiano (id), irlandese (ga), italiano (it), giapponese (ja), giavanese (jv), kannada (kn), kazako (kk), khmer (km), coreano (ko), curdo (ku), kirghiso (ky), lao (lo), latino (la), lettone (lv), lituano (lt), lussemburghese (lb), macedone (mk), malgascio (mg), malese (ms), malayalam (ml), maltese (mt), maori (mi), marathi (mr), mongolo (mn), birmano (my), nepalese (ne), nyanja (chichewa) (ny), norvegese (no), pashto (ps), persiano (fa), polacco (pl), portoghese (pt), punjabi (pa), rumeno (ro), russo (ru), samoano (sm), gaelico scozzese (gd), serbo (sr), sesotho (st), shona (sn), sindhi (sd), singalese (si), slovacco (sk), sloveno (sl), somalo (so), spagnolo (es), sundanese (su), swahili (sw), svedese (sv), tagico (tg), tamil (ta), telugu (te), tailandese (th), turco (tr), ucraino (uk), urdu (ur), uzbeco (uz), vietnamita (vi), gallese (cy), xhosa (xh), yiddish (yi), yoruba (yo) e zulu (zu).

Esplora tutti i modelli in Model Garden

Model Garden è una piattaforma che ti aiuta a scoprire, testare, personalizzare ed eseguire il deployment di modelli e asset proprietari di Google e di modelli e asset open source selezionati. Per esplorare i modelli e le API di AI generativa disponibili in Gemini Enterprise Agent Platform, vai a Model Garden nella Google Cloud console.

Vai a Model Garden

Per saperne di più su Model Garden, inclusi i modelli e le funzionalità disponibili, consulta Esplora i modelli di AI in Model Garden.

Versioni modello

Per visualizzare tutte le versioni del modello, inclusi i modelli legacy e ritirati, consulta Versioni e ciclo di vita del modello.

Modelli Google Mantieni tutto organizzato con le raccolte Salva e classifica i contenuti in base alle tue preferenze.