O Gemini oferece suporte à edição aprimorada de imagens e à edição multiturno, além de filtros de segurança atualizados que proporcionam uma experiência mais flexível e menos restritiva.
Os seguintes modelos do Gemini oferecem suporte à edição de imagens:
Clique para expandir os modelos compatíveis
Para mais informações sobre os recursos do modelo, consulte Modelos do Gemini.
Editar uma imagem
Console
Para editar imagens, faça o seguinte:
- Abra o Agent Studio > Criar comando.
- Clique em Trocar modelo e selecione um dos modelos mostrados.
- No painel Saídas, selecione Imagem e texto no menu suspenso.
- Clique em Inserir mídia () e selecione uma origem no menu. Em seguida, siga as instruções da caixa de diálogo.
- Escreva as edições que você quer fazer na imagem na área de texto Escreva um comando.
- Clique no botão Comando ().
O Gemini gera uma versão editada da imagem fornecida com base em na sua descrição. Esse processo leva alguns segundos, mas pode ser comparativamente mais lento, dependendo da capacidade.
Python
Instalar
pip install --upgrade google-genai
Para mais informações, consulte a documentação de referência do SDK.
Defina variáveis de ambiente para usar o SDK da IA generativa com a Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
Saiba como instalar ou atualizar o Java.
Para mais informações, consulte a documentação de referência do SDK.
Defina variáveis de ambiente para usar o SDK da IA generativa com a Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
Saiba como instalar ou atualizar o Go.
Para mais informações, consulte a documentação de referência do SDK.
Defina variáveis de ambiente para usar o SDK da IA generativa com a Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
Instalar
npm install @google/genai
Para mais informações, consulte a documentação de referência do SDK.
Defina variáveis de ambiente para usar o SDK da IA generativa com a Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
REST
Execute o comando a seguir no terminal para criar ou substituir esse arquivo em o diretório atual:
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://${API_ENDPOINT}:generateContent \
-d '{
"contents": {
"role": "USER",
"parts": [
{"fileData": {
"mimeType": "image/jpg",
"fileUri": "FILE_NAME"
}
},
{"text": "Convert this photo to black and white, in a cartoonish style."},
]
},
"generationConfig": {
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "4K",
"responseModalities": ["TEXT", "IMAGE"],
"imageOutputOptions": {
"mimeType": "image/png"
},
"personGeneration": "allow_all"
},
},
"safetySettings": {
"method": "PROBABILITY",
"category": "HARM_CATEGORY_DANGEROUS_CONTENT",
"threshold": "BLOCK_MEDIUM_AND_ABOVE"
},
}' 2>/dev/null >response.json
Para mais informações sobre os recursos do modelo, incluindo proporções compatíveis e resoluções de saída, consulte Modelos do Gemini.
O Gemini gera uma imagem com base na sua descrição. Esse processo leva alguns segundos, mas pode ser comparativamente mais lento, dependendo da capacidade.
Edição de imagens multiturno
A edição multiturno permite responder ao modelo com mudanças depois que ele mostra uma resposta de imagem editada.
Os seguintes modelos do Gemini oferecem suporte à edição multiturno:
Clique para expandir os modelos compatíveis
Recomendamos limitar o tamanho total do arquivo de solicitação a 50 MB no máximo.
Para testar a edição de imagens multiturno, consulte os seguintes notebooks:
Geração de imagens do Gemini 3.1 Flash na Plataforma de Agentes
Geração de imagens do Gemini 3.1 Flash Lite na Plataforma de Agentes
Para conferir exemplos de código relacionados à criação e edição de imagens multiturno usando o Gemini 3 Pro Image, consulte Exemplo de edição de imagens multiturno usando assinaturas de pensamento.
A seguir
Consulte os links a seguir para mais informações sobre a geração de imagens do Gemini: