Gemini unterstützt die verbesserte Bearbeitung von Bildern und die Bearbeitung in mehreren Schritten sowie aktualisierte Sicherheitsfilter, die eine flexiblere und weniger restriktive Nutzung ermöglichen.
Die folgenden Gemini-Modelle unterstützen die Bildbearbeitung:
Klicken Sie, um die unterstützten Modelle zu maximieren.
Weitere Informationen zu den Modellfunktionen finden Sie unter Gemini Modelle.
Bild bearbeiten
Console
So bearbeiten Sie Bilder:
- Öffnen Sie Agent Studio > Prompt erstellen.
- Klicken Sie auf Modell wechseln und wählen Sie eines der angezeigten Modelle aus.
- Wählen Sie im Bereich Ausgaben im Drop-down-Menü die Option Bild und Text aus.
- Klicken Sie auf Medien einfügen () und wählen Sie im Menü eine Quelle aus. Folgen Sie dann der Anleitung im Dialogfeld.
- Geben Sie im Textbereich Prompt eingeben die Änderungen ein, die Sie am Bild vornehmen möchten.
- Klicken Sie auf die Prompt () Schaltfläche.
Gemini generiert anhand Ihrer Beschreibung eine bearbeitete Version des bereitgestellten Bildes. Dieser Vorgang dauert einige Sekunden, kann aber vergleichsweise länger dauern.
Python
Installieren
pip install --upgrade google-genai
Weitere Informationen finden Sie in der SDK-Referenzdokumentation.
Legen Sie Umgebungsvariablen fest, um das Google Gen AI SDK mit Vertex AI zu verwenden:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
Informationen zum Installieren oder Aktualisieren von Java
Weitere Informationen finden Sie in der SDK-Referenzdokumentation.
Legen Sie Umgebungsvariablen fest, um das Google Gen AI SDK mit Vertex AI zu verwenden:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
Informationen zum Installieren oder Aktualisieren von Go
Weitere Informationen finden Sie in der SDK-Referenzdokumentation.
Legen Sie Umgebungsvariablen fest, um das Google Gen AI SDK mit Vertex AI zu verwenden:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
Installieren
npm install @google/genai
Weitere Informationen finden Sie in der SDK-Referenzdokumentation.
Legen Sie Umgebungsvariablen fest, um das Google Gen AI SDK mit Vertex AI zu verwenden:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
REST
Führen Sie folgenden Befehl im Terminal aus, um diese Datei in dem aktuellen Verzeichnis zu erstellen oder zu überschreiben:
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://${API_ENDPOINT}:generateContent \
-d '{
"contents": {
"role": "USER",
"parts": [
{"fileData": {
"mimeType": "image/jpg",
"fileUri": "FILE_NAME"
}
},
{"text": "Convert this photo to black and white, in a cartoonish style."},
]
},
"generationConfig": {
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "4K",
"responseModalities": ["TEXT", "IMAGE"],
"imageOutputOptions": {
"mimeType": "image/png"
},
"personGeneration": "allow_all"
},
},
"safetySettings": {
"method": "PROBABILITY",
"category": "HARM_CATEGORY_DANGEROUS_CONTENT",
"threshold": "BLOCK_MEDIUM_AND_ABOVE"
},
}' 2>/dev/null >response.json
Weitere Informationen zu den Modellfunktionen, einschließlich unterstützter Seitenverhältnisse und Ausgabegrößen, finden Sie unter Gemini Modelle.
Gemini generiert anhand Ihrer Beschreibung ein Bild. Dieser Vorgang dauert einige Sekunden, kann aber je nach Kapazität vergleichsweise länger dauern.
Bildbearbeitung in mehreren Schritten
Bei der Bearbeitung in mehreren Schritten können Sie auf die Antwort des Modells mit Änderungen reagieren, nachdem es ein bearbeitetes Bild angezeigt hat.
Die folgenden Gemini-Modelle unterstützen die Bearbeitung in mehreren Schritten:
Klicken Sie, um die unterstützten Modelle zu maximieren.
Wir empfehlen, die gesamte Dateigröße der Anfrage auf maximal 50 MB zu beschränken.
Informationen zum Testen der Bildbearbeitung im Mehrfachdialog finden Sie in den folgenden Notebooks:
Codebeispiele zum Erstellen und Bearbeiten von Bildern in mehreren Schritten mit Gemini 3 Pro Image finden Sie unter Beispiel für die Bildbearbeitung in mehreren Schritten mit Gedanken-Signaturen.
Nächste Schritte
Weitere Informationen zur Bildgenerierung mit Gemini finden Sie unter den folgenden Links: