O Gemini Embedding 2 é o modelo de geração de embeddings do Google, ideal para tarefas complexas de recuperação e análise.
O Gemini Embedding 2 aceita entradas multimodais para gerar vetores de 3.072 dimensões. Ele aceita entradas de imagens, texto, documentos, áudio e vídeo e mapeia semanticamente os vetores gerados em um espaço semântico unificado. Isso permite realizar tarefas, como pesquisar uma imagem com base em uma descrição de texto.
O Gemini Embedding 2 apresenta vários recursos para otimizar a qualidade e a flexibilidade do embedding:
Instruções de tarefas personalizadas:ao especificar instruções de tarefas (por exemplo,
task:code retrievaloutask:search result), otimize os embeddings para as relações pretendidas e recupere resultados mais precisos para a meta específica.Tamanho do resultado ajustável:o modelo gera um vetor flutuante de 3.072 dimensões por padrão. No entanto, é possível recuperar uma saída dimensional menor especificando o parâmetro
output_dimensionality.OCR de documentos:leia o OCR das entradas de documentos.
Extração de faixas de áudio:extraia faixas de áudio de entradas de vídeo e intercale-as com frames de vídeo.
Para mais informações sobre como usar o Gemini Embedding 2, consulte Usar embeddings multimodais.
Testar no Agent Studio Implantar app de exemplo Ver preços
| ID do modelo | gemini-embedding-2 |
|
|---|---|---|
| Modalidades |
|
|
| Limites de tokens | Máximo de tokens de entrada | 8.192 |
| Máximo de tokens de saída | N/A | |
| Dimensões de saída | Até 3.072 (com suporte a MRL) | |
| Comprimento máximo da sequência | 8.192 tokens | |
| Opções de consumo |
|
|
| Especificações técnicas | Texto |
|
| Imagem |
|
|
| Vídeo |
|
|
| Áudio |
|
|
| Regiões compatíveis |
|
|
| Data limite de conhecimento | Novembro de 2025 | |
| Versões |
|
|