Model Google

Model Gemini unggulan

Model Gemini yang tersedia secara umum

Gemini 3.8 Flash Cyber (Gemini Cyber) Model kami yang dioptimalkan untuk keamanan siber.
Gemini 3.8 Live Dioptimalkan untuk interaksi langsung, dengan kualitas suara, keandalan, dan orkestrasi agen real-time yang ditingkatkan.
Gemini 3.8 Flash Model andalan kami yang paling cerdas sejauh ini, dibuat untuk coding dengan cakupan panjang dan agen otonom.
Gemini 3.7 Flash Driver cerdas kami untuk developer, yang menghadirkan langkah maju dalam rekayasa software dan terasa jauh lebih baik untuk digunakan dalam membangun aplikasi.
Gemini 3.6 Flash Dioptimalkan untuk alur kerja multi-langkah yang kompleks, pembuatan kode yang lebih baik, dan penalaran multimodal yang lebih baik—semuanya dengan menggunakan lebih sedikit token.
Gemini 3.5 Flash-Lite Buat alur kerja agentik ringan dengan kecepatan tertinggi dan biaya minimal.
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) Ubah ide menjadi aset siap produksi. Dirancang untuk workload bervolume tinggi dan sensitif terhadap latensi.
Gemini 3.1 Flash Image Ubah ide menjadi aset siap produksi. Menampilkan pengeditan via percakapan, penggabungan multi-gambar, dan konsistensi karakter untuk alur kerja kreatif tingkat lanjut.
Gambar Gemini 3 Pro Pembuatan gambar dengan fidelitas tinggi dan komposisi yang ditingkatkan dengan kemampuan penalaran. Mendukung rendering teks yang mudah dibaca, pengeditan bertahap yang kompleks, dan konsistensi karakter menggunakan hingga 14 input referensi.
Gemini 3.5 Flash Gemini 3.5 Flash memberikan kecerdasan hampir setara Pro dengan biaya dan kecepatan tingkat Flash: Kemahiran coding tingkat Pro, eksekusi agentik paralel, semuanya dengan titik harga yang sama seperti model Flash.
Gemini 3.1 Flash-Lite Model kami yang paling hemat biaya, dioptimalkan untuk kasus penggunaan dengan latensi rendah untuk traffic LLM bervolume tinggi dan sensitif biaya.
Gemini 2.5 Pro Model kami yang memiliki kemampuan tinggi untuk penalaran dan coding yang kompleks. Memiliki kemampuan berpikir adaptif untuk memecahkan tantangan multimodal dan agentik yang kompleks dengan konteks 1 juta token.
Gemini 2.5 Flash Sangat cepat dan sangat mumpuni. Menghadirkan keseimbangan antara kecerdasan dan latensi dengan anggaran pemikiran yang dapat dikontrol untuk aplikasi serbaguna.
Gemini 2.5 Flash Image Ubah ide menjadi aset siap produksi. Menampilkan pengeditan via percakapan, penggabungan multi-gambar, dan konsistensi karakter untuk alur kerja kreatif tingkat lanjut.
Gemini 2.5 Flash-Lite Dibuat untuk skala besar. Menyeimbangkan biaya dan performa untuk tugas dengan throughput tinggi, dioptimalkan untuk efisiensi tanpa mengorbankan pemahaman multimodal.
Gemini 2.5 Flash dengan Gemini Live API Dirancang untuk streaming dua arah secara real-time. Menampilkan audio bawaan berlatensi rendah dan kemampuan dialog afektif untuk interaksi percakapan yang alami.

Melihat pratinjau model Gemini

Gemini Omni 1.1 Flash Buat video dari teks atau aset referensi, atau edit video yang ada.
Gemini Omni Flash Buat video dari teks atau aset rujukan, atau edit video yang ada.
Gemini 3 Flash Model terbaik kami untuk pemahaman multimodal yang kompleks, yang dirancang untuk mengatasi masalah agen yang paling menantang dengan kemampuan coding yang kuat dan penalaran canggih.
Gemini 3 Pro Image Pembuatan gambar dengan fidelitas tinggi dan komposisi yang ditingkatkan dengan penalaran. Mendukung rendering teks yang mudah dibaca, pengeditan bertahap yang kompleks, dan konsistensi karakter menggunakan hingga 14 input referensi.

Model Gemma

Gemma 4 Model terbuka yang cocok untuk tugas seperti pembuatan teks, pengodean, dan penalaran, serta mendukung input multimodal (teks dan gambar untuk semua varian, dan audio untuk varian E2B dan E4B).
Gemma 3n Model terbuka yang dirancang untuk eksekusi yang efisien di perangkat dengan resource rendah, mendukung input multimodal (teks, gambar, video, dan audio) serta output teks dalam lebih dari 140 bahasa.
Gemma 3 Model terbuka yang menampilkan input teks dan gambar, dukungan untuk lebih dari 140 bahasa, dan jendela konteks 128K.
Gemma 2 Model terbuka yang mendukung pembuatan, peringkasan, dan ekstraksi teks.
Gemma Model terbuka kecil dan ringan yang mendukung pembuatan, peringkasan, dan ekstraksi teks.
ShieldGemma 2 Model yang disesuaikan untuk mengikuti perintah guna mengevaluasi keamanan teks dan gambar berdasarkan kebijakan yang ditentukan.
PaliGemma Model bahasa visual terbuka yang menggabungkan SigLIP dan Gemma.
CodeGemma Model terbuka yang ringan dan canggih untuk tugas coding, termasuk penyelesaian, pembuatan, dan pemahaman kode.
TxGemma Model yang menghasilkan prediksi, klasifikasi, atau teks berdasarkan data terkait terapi, untuk membangun model AI dengan lebih sedikit data dan komputasi.
MedGemma Kumpulan varian Gemma 3 yang dilatih untuk performa dalam pemahaman teks dan gambar medis.
MedSigLIP Varian SigLIP yang dilatih untuk mengenkode gambar dan teks medis ke dalam ruang penyematan umum.
T5Gemma Serangkaian model riset encoder-decoder ringan.

Model embedding

Embeddings untuk Teks Mengonversi data teks menjadi representasi vektor untuk penelusuran semantik, klasifikasi, dan pengelompokan.
Embedding Multimodal Membuat vektor berdasarkan gambar, untuk tugas seperti klasifikasi dan penelusuran gambar.

Model Veo

Pembuatan Veo 3 Membuat video dari perintah teks dan gambar dengan kualitas tinggi.
Veo 3 Fast Membuat video dari perintah teks dan gambar dengan kualitas tinggi dan latensi rendah.
Pembuatan Veo 3.1 Membuat video dari perintah teks dan gambar dengan kualitas tinggi.
Veo 3.1 Cepat Membuat video dari perintah teks dan gambar dengan kualitas tinggi dan latensi rendah.

Melihat pratinjau model Veo

Pratinjau Veo 3.1 Lite Membuat video dari perintah teks dan gambar dengan kualitas tinggi dan biaya rendah.

Model Lyria

Lyria 3 Pro (Pratinjau) Membuat trek musik berdurasi penuh dari perintah teks dan gambar.
Klip Lyria 3 (Pratinjau) Membuat klip audio berdurasi 30 detik dari teks dan perintah gambar.
Lyria 2 Membuat musik dari perintah teks.

Dukungan bahasa

Gemini

Semua model Gemini dapat memahami dan merespons dalam bahasa berikut:

Afrikaans (af), Albania (sq), Amharik (am), Arab (ar), Armenia (hy), Assam (as), Azerbaijan (az), Basque (eu), Belarusia (be), Bengali (bn), Bosnia (bs), Bulgaria (bg), Katalan (ca), Cebuano (ceb), China (Sederhana dan Tradisional) (zh), Korsika (co), Kroasia (hr), Ceko (cs), Denmark (da), Dhivehi (dv), Belanda (nl), Inggris (en), Esperanto (eo), Estonia (et), Filipina (Tagalog) (fil), Finlandia (fi), Prancis (fr), Frisia (fy), Galicia (gl), Georgia (ka), Jerman (de), Yunani (el), Gujarati (gu), Haiti (ht), Hausa (ha), Hawaii (haw), Ibrani (iw), Hindi (hi), Hmong (hmn), Hungaria (hu), Islandia (is), Igbo (ig), Indonesia (id), Irlandia (ga), Italia (it), Jepang (ja), Jawa (jv), Kannada (kn), Kazakh (kk), Khmer (km), Korea (ko), Krio (kri), Kurdi (ku), Kirgiz (ky), Lao (lo), Latin (la), Latvia (lv), Lituania (lt), Luksemburg (lb), Makedonia (mk), Malagasi (mg), Melayu (ms), Malayalam (ml), Malta (mt), Maori (mi), Marathi (mr), Meiteilon (Manipuri) (mni-Mtei), Mongolia (mn), Myanmar (Burma) (my), Nepal (ne), Norwegia (no), Nyanja (Chichewa) (ny), Odia (Oriya) (or), Pashto (ps), Persia (fa), Polandia (pl), Portugis (pt), Punjabi (pa), Romania (ro), Rusia (ru), Samoa (sm), Gaelik Skotlandia (gd), Serbia (sr), Sesotho (st), Shona (sn), Sindhi (sd), Sinhala (Sinhala) (si), Slovakia (sk), Slovenia (sl), Somalia (so), Spanyol (es), Sunda (su), Swahili (sw), Swedia (sv), Tajikistan (tg), Tamil (ta), Telugu (te), Thai (th), Turkiye (tr), Ukraina (uk), Urdu (ur), Uighur (ug), Uzbekistan (uz), Vietnam (vi), Wales (cy), Xhosa (xh), Yiddish (yi), Yoruba (yo), dan Zulu (zu).

Gemma

Gemma dan Gemma 2 hanya mendukung bahasa Inggris (en). Gemma 3 dan Gemma 3n memberikan dukungan multibahasa dalam lebih dari 140 bahasa.

Embedding

Model embedding teks multibahasa mendukung bahasa berikut:

Afrikaans (af), Albania (sq), Amharik (am), Arab (ar), Armenia (hy), Azerbaijan (az), Basque (eu), Belarusia (be), Bengali (bn), Bulgaria (bg), Catalan (ca), Cebuano (ceb), China (Sederhana dan Tradisional) (zh), Korsika (co), Ceko (cs), Denmark (da), Belanda (nl), Inggris (en), Esperanto (eo), Estonia (et), Filipina (Tagalog) (fil), Finlandia (fi), Prancis (fr), Frisia (fy), Galicia (gl), Georgia (ka), Jerman (de), Yunani (el), Gujarati (gu), Kreo Haiti (ht), Hausa (ha), Hawaii (haw), Ibrani (iw), Hindi (hi), Hmong (hmn), Hungaria (hu), Islandia (is), Igbo (ig), Indonesia (id), Irlandia (ga), Italia (it), Jepang (ja), Jawa (jv), Kannada (kn), Kazakh (kk), Khmer (km), Korea (ko), Kurdi (ku), Kirgizstan (ky), Laos (lo), Latin (la), Latvia (lv), Lituania (lt), Luksemburg (lb), Makedonia (mk), Malagasi (mg), Melayu (ms), Malayalam (ml), Malta (mt), Maori (mi), Marathi (mr), Mongolia (mn), Myanmar (Burma) (my), Nepal (ne), Nyanja (Chichewa) (ny), Norwegia (no), Pashto (ps), Persia (fa), Polandia (pl), Portugis (pt), Punjabi (pa), Romania (ro), Rusia (ru), Samoa (sm), Gaelik Skotlandia (gd), Serbia (sr), Sesotho (st), Shona (sn), Sindhi (sd), Sinhala (Sinhala) (si), Slovakia (sk), Slovenia (sl), Somalia (so), Spanyol (es), Sunda (su), Swahili (sw), Swedia (sv), Tajikistan (tg), Tamil (ta), Telugu (te), Thai (th), Turkiye (tr), Ukraina (uk), Urdu (ur), Uzbekistan (uz), Vietnam (vi), Wales (cy), Xhosa (xh), Yiddish (yi), Yoruba (yo), dan Zulu (zu).

Mempelajari semua model di Model Garden

Model Garden adalah platform yang membantu Anda menemukan, menguji, menyesuaikan, dan men-deploy model & aset OSS tertentu serta eksklusif Google. Untuk mempelajari model dan API AI generatif yang tersedia di Gemini Enterprise Agent Platform, buka Model Garden di konsol Google Cloud .

Buka Model Garden

Untuk mempelajari lebih lanjut Model Garden, termasuk model dan kemampuan yang tersedia, lihat Mempelajari model AI di Model Garden.

Versi model

Untuk melihat semua versi model, termasuk model lama dan yang tidak digunakan lagi, lihat Versi dan siklus proses model.