Gemini 3 Pro

Gemini 3 Pro ist unser fortschrittlichstes Gemini-Modell für logisches Schlussfolgern, das komplexe Probleme lösen kann. Mit seinem Kontextfenster mit 1 Million Tokens kann Gemini 3 Pro riesige Datensätze und schwierige Probleme aus verschiedenen Informationsquellen verstehen, darunter Text, Audio, Bilder, Videos, PDFs und sogar ganze Code-Repositories.

Qualitätsänderungen

Bei der Migration von Gemini 2.5 Pro zu Gemini 3 Pro können Sie mit erheblichen Verbesserungen in den Bereichen logisches Denken auf hoher Ebene, Befolgen komplexer Anweisungen, Toolnutzung, agentenbasierte Anwendungsfälle und bessere Fähigkeiten für lange Kontexte (einschließlich Bild- und Dokumentverständnis) rechnen. Gemini 3 Pro-Modelle sind nicht darauf ausgelegt, die Unterstützung von Anwendungsfällen für das Audioverständnis oder die Bildsegmentierung zu priorisieren. Wenn Sie in diesen Anwendungsfällen eine hohe Leistung erzielen möchten, sollten Sie Modelle verwenden, die speziell für diese Anforderungen entwickelt wurden. Bei informationsdichten oder komplizierten Grafiken, Tabellen oder Diagrammen kann das Modell manchmal Informationen falsch extrahieren oder die bereitgestellten Ressourcen falsch interpretieren. Wenn Sie wichtige Informationen so einfach wie möglich präsentieren, können Sie die gewünschte Ausgabe erzielen, wenn Sie mit Gemini 3 Pro arbeiten.

Geändertes Verhalten

Gemini 3 Pro ist auf hohe Effizienz und Action ausgelegt. Das Modell wurde so trainiert, dass es prägnante, direkte Antworten liefert und versucht, die Nutzerabsicht so schnell wie möglich zu erfüllen. Da das Modell darauf ausgelegt ist, hilfreich zu sein, kann es gelegentlich Vermutungen anstellen, wenn Informationen fehlen, oder eine zufriedenstellende Antwort gegenüber strengen Anweisungen priorisieren. Dieses Verhalten kann durch Prompts gemildert oder geändert werden. Weitere Informationen und Best Practices finden Sie unter Erste Schritte mit Gemini 3.

Neue Funktionen

Gemini 3 Pro bietet mehrere neue Funktionen zur Verbesserung von Leistung, Kontrolle und multimodaler Genauigkeit:

  • Denkstufe: Mit dem Parameter thinking_level können Sie den Umfang des internen logischen Denkens des Modells (low oder high) steuern, um die Antwortqualität, die Komplexität des logischen Denkens, die Latenz und die Kosten auszugleichen. Der Parameter thinking_level ersetzt thinking_budget für Gemini 3-Modelle.
  • Medienauflösung: Mit dem media_resolution Parameter (low, medium oder high) können Sie die Bildverarbeitung für multimodale Eingaben steuern, was sich auf die Tokennutzung und die Latenz auswirkt. Die Standardeinstellungen für die Auflösung finden Sie unter Erste Schritte mit Gemini 3.
  • Signatur der Überlegung: Eine strengere Validierung der Signatur der Überlegung verbessert die Zuverlässigkeit bei Funktionsaufrufen in mehreren Schritten.
  • Multimodale Funktionsantworten: Funktionsantworten können jetzt neben Text auch multimodale Objekte wie Bilder und PDFs enthalten.
  • Funktionsaufrufe im Streaming: Streamen Sie partielle Funktionsaufrufargumente um die Nutzerfreundlichkeit bei der Toolnutzung zu verbessern.

Weitere Informationen zur Verwendung dieser Funktionen finden Sie unter Erste Schritte mit Gemini 3.

In der Agent Platform Ansicht in Model Garden testen (Vorschau) Beispiel-App bereitstellen

Hinweis: Um die Funktion „Beispiel-App bereitstellen“ zu verwenden, benötigen Sie ein Google Cloud-Projekt mit aktivierter Abrechnung und aktivierter Agent Platform API.
Modell-ID gemini-3-pro-preview
Unterstützte Ein- und Ausgaben
  • Eingaben:
    Text, Code, Bilder, Audio, Video, PDF
  • Ausgaben:
    Text
Token limits
  • Maximale Eingabetokens: 1.048.576
  • Maximale Ausgabetokens: 65.536
Leistungsspektrum
Nutzungsoptionen
Weitere Informationen finden Sie unter Nutzungsoptionen.
Technische Spezifikationen
Bilder
  • Maximale Anzahl von Bildern pro Prompt: 3.000
  • Maximale Dateigröße pro Datei für Inline-Daten oder direkte Uploads über die Console: 7 MB
  • Maximale Dateigröße pro Datei aus Google Cloud Storage: 30 MB
  • Standard-Tokens für die Auflösung: 1.120
  • Unterstützte MIME-Typen:
    image/png, image/jpeg, image/webp, image/heic, image/heif
Dokumente
  • Maximale Anzahl von Dateien pro Prompt: 3.000
  • Maximale Anzahl von Seiten pro Datei: 3.000
  • Maximale Dateigröße pro Datei für API- oder Cloud Storage-Importe: 50 MB(application/pdf) oder 7 MB(text/plain)
  • Maximale Dateigröße pro Datei für direkte Uploads über die Console: 7 MB
  • Standard-Tokens für die Auflösung: 560
  • OCR für gescannte PDFs: Standardmäßig nicht verwendet
  • Unterstützte MIME-Typen:
    application/pdf, text/plain
Video
  • Maximale Videolänge (mit Audio): ca. 45 Minuten
  • Maximale Videolänge (ohne Audio): ca. 1 Stunde
  • Maximale Anzahl von Videos pro Prompt: 10
  • Standard-Tokens für die Auflösung pro Frame: 70
  • Unterstützte MIME-Typen:
    video/x-flv, video/quicktime, video/mpeg, video/mpegs, video/mpg, video/mp4, video/webm, video/wmv, video/3gpp
Audio
  • Maximale Audiolänge pro Prompt: ca.8, 4 Stunden oder bis zu 1 Million Tokens
  • Maximale Anzahl von Audiodateien pro Prompt: 1
  • Sprachverständnis für: Audiozusammenfassung, Transkription und Übersetzung
  • Unterstützte MIME-Typen:
    audio/x-aac, audio/flac, audio/mp3, audio/m4a, audio/mpeg, audio/mpga, audio/mp4, audio/ogg, audio/pcm, audio/wav, audio/webm
Standardwerte für Parameter
  • Temperatur: 0,0–2,0 (Standard 1,0)
  • topP: 0,0–1,0 (Standard 0,95)
  • topK: 64 (fest)
  • candidateCount: 1–8 (Standard 1)
Unterstützte Regionen

Modellverfügbarkeit

  • Global
    • global
Weitere Informationen finden Sie unter Bereitstellungen und Endpunkte.
Wissensstichtag Januar 2025
Versionen
  • gemini-3-pro-preview
    • Startphase: Öffentliche Vorschau
    • Veröffentlichungsdatum: 18. November 2025
    • Datum der Einstellung: 26. März 2026
Unterstützte Sprachen Siehe unterstützte Sprachen.
Preise Weitere Informationen finden Sie unter Preise.