Gemini Embedding 2

Gemini Embedding 2 ist das Einbettungsgenerierungsmodell von Google, das sich ideal für komplexe Abruf- und Analyseaufgaben eignet.

Gemini Embedding 2 akzeptiert multimodale Eingaben, um 3072-dimensionale Vektoren zu generieren. Es akzeptiert Bild-, Text-, Dokument-, Audio- und Videoeingaben und ordnet die generierten Vektoren semantisch einem einheitlichen semantischen Raum zu. So können Sie beispielsweise nach einem Bild anhand einer Textbeschreibung suchen.

Gemini Embedding 2 bietet mehrere Funktionen zur Optimierung der Einbettungsqualität und -flexibilität:

  • Benutzerdefinierte Aufgabenanweisungen:Wenn Sie Aufgabenanweisungen angeben (z. B. task:code retrieval oder task:search result), werden die Einbettungen für die beabsichtigten Beziehungen optimiert und genauere Ergebnisse für das jeweilige Ziel abgerufen.

  • Anpassbare Ergebnisgröße:Das Modell generiert standardmäßig einen 3072-dimensionalen Gleitkommavektor. Sie können jedoch eine Ausgabe mit geringerer Dimensionalität abrufen, indem Sie den Parameter output_dimensionality angeben.

  • Document OCR:OCR aus Dokumenteingaben lesen.

  • Audiotrack-Extraktion: Extrahieren Sie Audiotracks aus Videoeingaben und verschachteln Sie sie mit Videoframes.

Weitere Informationen zur Verwendung von Gemini Embedding 2 finden Sie unter Multimodale Einbettungen abrufen.

In Agent Studio testen Beispiel-App bereitstellen Preise ansehen

Hinweis: Für die Bereitstellung der Beispiel-App ist ein Google Cloud-Projekt mit aktivierter Abrechnung und aktivierter Agent Platform API erforderlich.
Modell-ID gemini-embedding-2
Betriebsarten
Text Nur Eingabe
Bild Nur Eingabe
Audio Nur Eingabe
Video Nur Eingabe
Einbettungen Nur Ausgabe
Token limits Maximale Anzahl von Eingabetokens 8.192
Maximale Anzahl von Ausgabetokens
Ausgabedimensionen Bis zu 3.072 (mit MRL-Unterstützung)
Maximale Sequenzlänge 8.192 Tokens
Nutzungsoptionen
Technische Spezifikationen Text
  • Maximale Anzahl von Eingabetokens: 8.192
  • Maximale Anzahl von Dateien pro Prompt: 1
  • Maximale Anzahl von Seiten pro Datei (für PDF): 6
  • Maximale Dateigröße pro Datei: –
  • OCR für gescannte PDFs: Standardmäßig nicht verwendet
  • Unterstützte MIME-Typen:
    text/plain, application/pdf
Bild
  • Maximale Anzahl von Bildern pro Prompt: 6
  • Maximale Dateigröße pro Datei für Inline-Daten oder direkte Uploads über die Console: keine Beschränkung
  • Maximale Dateigröße pro Datei aus Google Cloud Storage: keine Beschränkung
  • Maximale Anzahl von Ausgabebildern pro Prompt: –
  • Unterstützte MIME-Typen:
    image/png, image/jpeg, image/webp, image/bmp, image/heic, image/heif, image/avif
Video
  • Maximale Videolänge (mit Audio): 80 Sekunden
  • Maximale Videolänge (ohne Audio): 120 Sekunden
  • Maximale Anzahl von Videos pro Prompt: 1
  • Unterstützte MIME-Typen:
    video/mpeg, video/mp4
Audio
  • Maximale Audiolänge pro Prompt: 180 Sekunden
  • Maximale Anzahl von Audiodateien pro Prompt: 1
  • Unterstützte MIME-Typen:
    audio/mp3, audio/wav
Unterstützte Regionen

Modellverfügbarkeit

  • Global: global
  • Multiregion USA: us
  • Multiregion Europa: eu
Wissensstichtag November 2025
Versionen
  • gemini-embedding-2
    • Einführungsphase: GA
    • Veröffentlichungsdatum: 22. April 2026
  • gemini-embedding-2-preview
    • Einführungsphase: Öffentliche Vorschau
    • Veröffentlichungsdatum: 10. März 2026