Gemini Embedding 2 adalah model pembuatan embedding Google yang ideal untuk tugas pengambilan dan analisis yang kompleks.
Gemini Embedding 2 menerima input multimodal untuk menghasilkan vektor 3072 dimensi. Model ini menerima input gambar, teks, dokumen, audio, dan video serta memetakan vektor yang dihasilkan secara semantik ke dalam ruang semantik terpadu. Hal ini memungkinkan Anda melakukan tugas, seperti menelusuri gambar berdasarkan deskripsi teks.
Gemini Embedding 2 memperkenalkan beberapa fitur untuk mengoptimalkan kualitas dan fleksibilitas embedding:
Petunjuk tugas kustom: Dengan menentukan petunjuk tugas (misalnya,
task:code retrievalatautask:search result), optimalkan embedding untuk hubungan yang diinginkan dan ambil hasil yang lebih akurat untuk tujuan tertentu.Ukuran hasil yang dapat disesuaikan: Model ini menghasilkan vektor float 3072 dimensi, secara default. Namun, Anda dapat mengambil output dimensi yang lebih kecil dengan menentukan parameter
output_dimensionality.OCR dokumen: Baca OCR dari input dokumen.
Ekstraksi trek audio: Ekstrak trek audio dari input video dan sisipkan dengan frame video.
Untuk mengetahui informasi selengkapnya tentang cara menggunakan Gemini Embedding 2, lihat Mendapatkan embedding multimodal.
| ID Model | gemini-embedding-2 |
|
|---|---|---|
| Modalities |
|
|
| Batas token | Token input maksimum | 8.192 |
| Token output maksimum | T/A | |
| Dimensi output | Hingga 3.072 (dengan dukungan MRL) | |
| Panjang urutan maksimum | 8.192 token | |
| Opsi pemakaian |
|
|
| Spesifikasi teknis | Teks |
|
| Gambar |
|
|
| Video |
|
|
| Audio |
|
|
| Region yang didukung |
|
|
| Tanggal batas informasi | November 2025 | |
| Versi |
|
|