Pular para o conteúdo principal

Edição de imagens com Gemini: guia com 10 exemplos práticos

Aprenda a editar imagens com o Gemini 2.0 Flash com exemplos práticos e entenda seus pontos fortes e limitações.
Atualizado 17 de set. de 2026  · 10 min lido

Explorar com IA

ChatGPTClaudePerplexity

O Gemini 2.0 Flash agora consegue gerar e editar imagens direto na interface de chat. Tudo é feito por texto, sem precisar mascarar áreas da imagem para indicar o que você quer modificar.

Neste artigo, vou mostrar passo a passo como editar imagens com o Gemini 2.0 Flash e, com 10 exemplos práticos, como chegar a resultados com qualidade profissional sem precisar de conhecimento técnico avançado.

Como acessar a edição de imagens do Gemini

Para acessar as ferramentas de edição de imagens do Google, é preciso ir até o Google AI Studio. Lá, podemos usar o modelo “Gemini 2.0 Flash (Image Generation) Experimental”, disponível gratuitamente. É possível que, no futuro, isso também apareça no app principal do Gemini, mas, por enquanto, o Google AI Studio é a única opção.

Para começar, selecione esse modelo no menu de modelos no lado direito da interface:

como selecionar gemini 2.0 flash image generation no google ai studio

Depois de escolher o modelo, clique no botão "Create Prompt" à esquerda para iniciar uma nova conversa:

como usar gemini 2.0 flash image generation no google ai studio

Dá para usar para várias tarefas de geração de imagens. Por exemplo, criar paisagens vibrantes, modificar imagens existentes para dar um toque criativo ou gerar novos elementos visuais para seus projetos. Veja um exemplo:

exemplo de geração de imagem com gemini 2.0 flash

Embora o Gemini 2.0 Flash tenha recursos robustos para gerar novas imagens, neste artigo vamos focar principalmente na edição. A ideia é explorar como usar a ferramenta para refinar e valorizar visuais já existentes.

Nos meus testes com o Gemini 2.0 Flash, avaliei a ferramenta em 10 exemplos práticos. De transformar uma foto comum em um retrato profissional para currículo a criar thumbnails chamativos para YouTube, o objetivo foi entender os pontos fortes e limites do modelo para identificar onde ele realmente brilha.

1. Movendo elementos em uma foto

Neste exemplo, explorei como o modelo lida ao mover elementos dentro de uma foto. Esse recurso é útil quando queremos reposicionar partes da imagem para melhorar a composição ou ajustar o foco.

Por exemplo, se temos uma foto de grupo em que alguém está deslocado, podemos aproximar essa pessoa do centro.

Movendo elementos em uma foto com a edição de imagens do gemini

Fonte da imagem: Pexels

2. Fotografia de produto com imagens de alta qualidade

Neste cenário, imagine que somos uma marca de tênis querendo gerar uma foto de uma modelo usando o nosso último lançamento. Normalmente, produzir conteúdo promocional exige organizar um ensaio, o que pode ser caro e demorado.

Aqui, mostramos como combinar a foto de uma modelo com a foto do produto:

Combinando duas fotos de alta qualidade para mostrar o produto

Fontes das imagens: primeira imagem (Pexels), segunda imagem (Pexels).

Também tentei combinar uma pessoa e um objeto em um cenário mais complexo, pedindo ao Gemini para fazer uma pessoa de uma foto segurar um carrinho de brinquedo de outra. Funcionou muito bem:

Combinando pessoas e objetos de forma complexa

Fontes das imagens: primeira imagem (Pexels), segunda imagem (Pexels).

Nem sempre precisamos de duas imagens. Se tivermos só a foto do produto, o modelo pode gerar o restante:

Inserindo um produto em um fundo gerado por IA

Fonte da imagem: Pexels

3. Aprimorando fotografia de produto

O exemplo anterior mostra como o modelo lida ao combinar fotos de boa qualidade. Mas e quando a foto do produto é ruim e queremos elevá-la?

Aqui, usei a foto de um bolo e pedi para transformar em uma imagem utilizável em um app de delivery. Melhorar fotografia de comida é desafiador, especialmente quando buscamos visuais que deem água na boca nas plataformas online.

Desta vez, o modelo não produziu nada útil. Tentei várias vezes e os resultados continuaram fracos. Veja um exemplo:

Aprimorando uma foto de produto existente

4. Modificando poses

Depois, testei a capacidade do Gemini 2.0 Flash de alterar a pose de uma pessoa na imagem. Modificar poses é útil, principalmente em moda, onde mudanças sutis na linguagem corporal podem transformar a cena.

Primeiro, pedi para a pessoa olhar para a câmera:

Fazendo alguém encarar a câmera

Fonte da imagem: Pexels

O resultado ficou bem bom, considerando que parte do rosto não aparecia na foto original e o modelo precisou gerar esse trecho de forma consistente.

Depois, quis ver se conseguiria fazer o homem virar de costas para a câmera, e também funcionou muito bem:

Fazendo alguém ficar de costas para a câmera

Este exemplo mostra a habilidade do modelo em lidar com modificações de pose. As mudanças se misturam com os elementos existentes, garantindo um resultado coerente e profissional.

5. Modificando expressões faciais

Já vimos que o modelo é bom em mudar poses. E quanto a expressões faciais?

Mudando expressões faciais

Fonte da imagem: Pexels

Pense em uma foto de reunião de time em que todo mundo parece sério, mas você quer transmitir um clima mais leve e positivo. Com o Gemini 2.0 Flash, dá para ajustar sutilmente expressões faciais, adicionando sorrisos ou suavizando caretas e, assim, mudar o clima geral da imagem.

Este exemplo evidencia como o modelo gerencia bem mudanças de expressão, permitindo adaptar as imagens à narrativa que queremos contar.

6. Thumbnails para YouTube

No exemplo a seguir, exploramos como usar o Gemini para criar um thumbnail envolvente para YouTube, mesclando duas imagens e inserindo texto. Thumbnails são cruciais para chamar a atenção e impactam diretamente o desempenho do vídeo.

Criando thumbnails para YouTube

Fontes das imagens: primeira imagem (Pexels), segunda imagem (Pexels).

Eu não tenho experiência com o que faz um bom thumbnail, então não julgo esse aspecto do resultado, mas o modelo fez exatamente o que foi pedido e até lidou muito bem com o texto — algo em que IAs costumam tropeçar.

Tenho certeza de que quem entende de thumbnails consegue usar isso para criar opções rapidamente para seus vídeos.

7. Gerando diagramas a partir de esboços

Ao tentar criar diagramas a partir de rascunhos em papel, encontrei alguns desafios. Apesar dos recursos avançados de edição, converter esboços em diagramas polidos é uma tarefa específica que pode exigir mais refinamento.

Aprimorando um diagrama complexo

Neste caso, a IA teve dificuldade para interpretar com precisão os elementos desenhados à mão, gerando um resultado aquém do ideal.

Dei uma segunda chance com um diagrama mais simples. Dessa vez, o diagrama ficou fiel às instruções, mas com design fraco:

Aprimorando um diagrama simples

8. Transformando fotos para uso em currículo

Pense em uma foto em que a roupa está casual demais ou não passa a imagem profissional desejada. Com o Gemini 2.0 Flash, dá para trocar a vestimenta na foto para um visual mais formal, adequado a ambientes profissionais.

Deixando uma foto casual com aparência profissional

Fonte da imagem: Pexels

Isso facilita muito atualizar nossa imagem profissional e causar uma ótima primeira impressão.

9. Modificando elementos em uma foto

Digamos que temos a foto de um produto com um fundo que não combina com o restante dos materiais de marketing. Com o Gemini 2.0 Flash, dá para substituir ou ajustar o fundo para atender melhor às necessidades, sem perder a essência do produto.

Modificando elementos em uma foto

Fonte da imagem: Pexels

Esse recurso oferece uma solução prática para refinar conteúdos visuais, adaptá-los a diferentes cenários e maximizar o impacto das imagens.

10. Adicionando objetos a uma foto existente

No último exemplo, quis ver como o modelo se sai ao inserir novos elementos em uma foto.

Adicionando elementos a uma foto

Fonte da imagem: Pexels

Essa capacidade permite aprimorar fotos com flexibilidade, adaptar imagens para diferentes usos e alinhar os visuais às nossas ideias criativas.

Limitações da edição de imagens do Gemini

Recusa em gerar imagens

Durante os testes com o Gemini Flash, o modelo frequentemente se recusou a gerar a imagem:

Recusa do modelo em gerar imagens

Acredito que isso ocorra porque há um algoritmo bloqueando certas solicitações para evitar usos antiéticos. Porém, não sei exatamente por que e quando acontece, pois pareceu ocorrer de forma aleatória e até com conteúdos que, na minha visão, eram inofensivos, como no exemplo acima.

Regeneração e temperatura

Eu não escolhi a dedo os exemplos ajustando prompts até funcionar, mas precisei pedir para o Gemini tentar novamente muitas vezes.

Veja como gerar a imagem de novo:

Como rodar novamente a geração de imagem no gemini google ai studio

Um fator crítico que influencia a qualidade dos resultados é o ajuste de "temperatura". Esse controle define o quão determinístico ou aleatório será o resultado do modelo.

Na maioria dos casos, a temperatura padrão é 1, o que pode ser aleatório demais e gerar saídas que não batem com as expectativas. Valores mais altos trazem mais variação e criatividade, mas podem se distanciar do visual desejado. Já temperaturas mais baixas reduzem a aleatoriedade, deixando o resultado mais previsível e consistente.

Ajustando a temperatura de saída

Pela minha experiência, ajustar a temperatura ajuda a alinhar melhor os resultados ao que eu preciso. Se o resultado estiver imprevisível demais, reduzir a temperatura aproxima a saída da visão pretendida. Se eu quiser alternativas mais criativas ou variadas, subir um pouco a temperatura pode ser útil.

Qualidade da imagem

Um problema comum que encontrei foi a redução da resolução, principalmente ao gerar várias iterações. A cada regeneração ou edição, a imagem pode degradar, perdendo nitidez e detalhes.

Isso acontece porque cada edição ou regeneração pode introduzir pequenos artefatos ou distorções. Em várias passagens, isso se acumula e derruba a qualidade geral — como fazer uma cópia da cópia, em que cada versão fica menos nítida que a original.

Mesmo após uma única iteração, a qualidade pode cair bastante:

Degradação da qualidade da imagem

Conclusão

No geral, o Gemini 2.0 Flash se mostra uma ferramenta funcional, com vários recursos úteis, embora minha experiência não tenha sido sempre tranquila. Apesar do bom desempenho na média, houve momentos de frustração, especialmente quando os resultados exigiam múltiplas tentativas ou quando a qualidade caía após edições sucessivas.

Dito isso, achei a ferramenta particularmente competente em imagens com pessoas. Tarefas como modificar poses, combinar pessoas com objetos e alterar expressões faciais foram pontos em que o modelo se destacou. Ao ajustar a pose de alguém ou inserir um novo objeto em uma cena com uma pessoa, o Gemini 2.0 Flash cumpriu bem o papel, mantendo naturalidade.

Da mesma forma, mexer em expressões para mudar o clima da foto funcionou de forma eficiente, ajudando a criar a atmosfera desejada com facilidade.

Embora algumas tarefas exijam paciência e refinamento, os pontos fortes do modelo — especialmente ao editar imagens com pessoas — fazem dele um ótimo aliado para turbinar projetos visuais.


François Aubry's photo
Author
François Aubry
LinkedIn
Engenheiro de pilha completa e fundador da CheapGPT. Ensinar sempre foi minha paixão. Desde meus primeiros dias como estudante, eu buscava ansiosamente oportunidades para dar aulas particulares e ajudar outros alunos. Essa paixão me levou a fazer um doutorado, onde também atuei como assistente de ensino para apoiar meus esforços acadêmicos. Durante esses anos, encontrei imensa satisfação no ambiente tradicional da sala de aula, promovendo conexões e facilitando o aprendizado. Entretanto, com o advento das plataformas de aprendizagem on-line, reconheci o potencial transformador da educação digital. Na verdade, participei ativamente do desenvolvimento de uma dessas plataformas em nossa universidade. Estou profundamente comprometido com a integração dos princípios tradicionais de ensino com metodologias digitais inovadoras. Minha paixão é criar cursos que não sejam apenas envolventes e informativos, mas também acessíveis aos alunos nesta era digital.
Tópicos
Inteligência Artificial
IA generativa

Aprenda IA com estes cursos!

Programa

Fundamentos da IA

10 h
Descubra os fundamentos da IA, aprenda a usar a IA de forma eficaz no trabalho e mergulhe em modelos como o chatGPT para navegar pelo cenário dinâmico da IA.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado

blog

Os 7 melhores geradores de vídeo com IA para 2026, com vídeos de exemplo

Conheça os melhores geradores de vídeo com IA disponíveis hoje, incluindo RunwayML, Synthesia, Colossyan, Pictory, DeepBrain AI, Invideo e os super esperados Sora e Veo da DeepMind.
Dr Ana Rojo-Echeburúa's photo

Dr Ana Rojo-Echeburúa

9 min

blog

O que é IA? Um guia rápido para iniciantes

Descubra o que realmente é inteligência artificial com exemplos, opiniões de especialistas e todas as ferramentas de que você precisa para aprender mais.
Matt Crabtree's photo

Matt Crabtree

11 min

cursor ai code editor

Tutorial

AI do cursor: Um guia com 10 exemplos práticos

Saiba como instalar o Cursor AI no Windows, macOS e Linux e descubra como usá-lo em 10 casos de uso diferentes.

Tutorial

Visão GPT-4: Um guia abrangente para iniciantes

Este tutorial apresentará tudo o que você precisa saber sobre o GPT-4 Vision, desde o acesso a ele, passando por exemplos práticos do mundo real, até suas limitações.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Tutorial

Uma introdução ao uso do DALL-E 3: Dicas, exemplos e recursos

Descubra como usar o DALL-E 3 para criar imagens. Descubra o que é o DALL-E 3, seus principais recursos e como usar os prompts para obter os melhores resultados.
Kurtis Pykes 's photo

Kurtis Pykes

13 min

Tutorial

Como usar o Midjourney: Um guia abrangente para a criação de obras de arte geradas por IA

Descubra o poder do Midjourney, uma ferramenta de IA generativa para criar obras de arte impressionantes. Saiba como começar, escrever prompts eficazes e otimizar seu uso com nosso guia passo a passo.
Kurtis Pykes 's photo

Kurtis Pykes

12 min

Ver MaisVer Mais