Gemini Embedding 2 es el modelo de generación de embeddings de Google que es ideal para tareas complejas de recuperación y análisis.
Gemini Embedding 2 acepta entradas multimodales para generar vectores de 3,072 dimensiones. Acepta imágenes, texto, documentos, audio y video como entradas, y asigna semánticamente los vectores generados a un espacio semántico unificado. Esto te permite realizar tareas, como buscar una imagen en función de una descripción de texto.
Gemini Embedding 2 presenta varias funciones para optimizar la calidad y la flexibilidad de las embeddings:
Instrucciones de tareas personalizadas: Si especificas instrucciones de tareas (por ejemplo,
task:code retrievalotask:search result), optimizas las embeddings para las relaciones deseadas y recuperas resultados más precisos para el objetivo específico.Tamaño de resultado ajustable: De forma predeterminada, el modelo genera un vector flotante de 3,072 dimensiones. Sin embargo, puedes recuperar una salida de dimensiones más pequeñas si especificas el parámetro
output_dimensionality.OCR de documentos: Lee el OCR de las entradas de documentos.
Extracción de pistas de audio: Extrae pistas de audio de las entradas de video y entrelázalas con fotogramas de video.
Para obtener más información sobre cómo usar Gemini Embedding 2, consulta Obtener embeddings multimodales.
Probar en Agent Studio Implementar la app de ejemplo Ver los precios
| ID de modelo | gemini-embedding-2 |
|
|---|---|---|
| Modalidades |
|
|
| Límites de tokens | Cantidad máxima de tokens de entrada | 8,192 |
| Cantidad máxima de tokens de salida | N/A | |
| Dimensiones de la salida | Hasta 3,072 (con compatibilidad con MRL) | |
| Longitud máxima de la secuencia | 8,192 tokens | |
| Opciones de consumo |
|
|
| Especificaciones técnicas | Texto |
|
| Imagen |
|
|
| Video |
|
|
| Audio |
|
|
| Regiones admitidas |
|
|
| Fecha límite de conocimiento | Noviembre de 2025 | |
| Versiones |
|
|