Gemini Embedding 2 est le modèle de génération d'embeddings de Google, idéal pour les tâches complexes de récupération et d'analyse.
Gemini Embedding 2 accepte les entrées multimodales pour générer des vecteurs de 3 072 dimensions. Il accepte les entrées d'images, de texte, de documents, d'audio et de vidéo, et mappe sémantiquement les vecteurs générés dans un espace sémantique unifié. Cela vous permet d'effectuer des tâches telles que la recherche d'une image à partir d'une description textuelle.
Gemini Embedding 2 introduit plusieurs fonctionnalités pour optimiser la qualité et la flexibilité des embeddings :
Instructions de tâche personnalisées : en spécifiant des instructions de tâche (par exemple,
task:code retrievaloutask:search result), vous optimisez les embeddings pour les relations souhaitées et récupérez des résultats plus précis pour l'objectif spécifique.Taille de résultat ajustable : par défaut, le modèle génère un vecteur flottant de 3 072 dimensions. Toutefois, vous pouvez récupérer une sortie de dimensionnalité inférieure en spécifiant le paramètre
output_dimensionality.OCR de documents : lisez l'OCR à partir des entrées de documents.
Extraction de pistes audio : extrayez des pistes audio à partir d'entrées vidéo et entrelacez-les avec des images vidéo.
Pour en savoir plus sur l'utilisation de Gemini Embedding 2, consultez Obtenir des embeddings multimodaux.
| ID du modèle | gemini-embedding-2 |
|
|---|---|---|
| Modalités |
|
|
| Limites de jetons | Nombre maximal de jetons d'entrée | 8 192 |
| Nombre maximal de jetons de sortie | N/A | |
| Dimensions de sortie | Jusqu'à 3 072 (avec prise en charge de MRL) | |
| Longueur maximale de la séquence | 8 192 jetons | |
| Options de consommation |
|
|
| Spécifications techniques | Texte |
|
| Image |
|
|
| Vidéo |
|
|
| Audio |
|
|
| Régions où le service est disponible |
|
|
| Date limite des connaissances | Novembre 2025 | |
| Versions |
|
|