Ir al contenido principal

Edición de imágenes con Gemini: guía con 10 ejemplos prácticos

Aprende a editar imágenes con Gemini 2.0 Flash con ejemplos prácticos y descubre sus puntos fuertes y sus limitaciones.
Actualizado 17 sept 2026  · 10 min leer

Explorar con IA

ChatGPTClaudePerplexity

Gemini 2.0 Flash ya puede generar y editar imágenes directamente desde su interfaz de chat. La interfaz es completamente de texto y no necesitas enmascarar la imagen para indicar qué partes quieres modificar.

En este artículo, te explico paso a paso cómo editar imágenes con Gemini 2.0 Flash y, a través de 10 ejemplos prácticos, cómo lograr resultados con calidad profesional sin necesidad de grandes conocimientos técnicos.

Cómo acceder a la edición de imágenes de Gemini

Para acceder a las herramientas de edición de imágenes de Google, tenemos que ir a Google AI Studio. Aquí podemos usar el modelo "Gemini 2.0 Flash (Image Generation) Experimental", que está disponible de forma gratuita. Es posible que en el futuro aparezca también en la app principal de Gemini, pero por ahora Google AI Studio es la única opción.

Para empezar, seleccionamos este modelo en el desplegable de modelos situado en la parte derecha de la interfaz:

cómo seleccionar gemini 2.0 flash image generation en google ai studio

Tras elegir el modelo, hay que hacer clic en el botón "Create Prompt" situado a la izquierda para iniciar una nueva conversación:

cómo usar gemini 2.0 flash image generation en google ai studio

Podemos usarlo para distintas tareas de generación de imágenes. Por ejemplo, crear paisajes vibrantes, modificar fotos existentes para darles un giro creativo o generar elementos visuales totalmente nuevos para nuestros proyectos. Aquí tienes un ejemplo:

ejemplo de generación de imagen con gemini 2.0 flash image generation

Aunque Gemini 2.0 Flash tiene una gran capacidad para generar imágenes nuevas, en este artículo nos centraremos sobre todo en sus funciones de edición. El objetivo es ver cómo podemos usar la herramienta para retocar y mejorar imágenes existentes.

En mi exploración de Gemini 2.0 Flash, probé la herramienta con 10 ejemplos prácticos para evaluar sus capacidades. Desde transformar una foto normal en una imagen profesional para CV hasta crear miniaturas llamativas para YouTube, la idea era entender los puntos fuertes y las limitaciones del modelo para identificar en qué puede ser más útil.

1. Mover elementos en una foto

En este ejemplo, probé cómo gestiona el modelo el desplazamiento de elementos dentro de una foto. Esta función es especialmente útil cuando queremos recolocar partes de una imagen para mejorar la composición o ajustar el foco.

Por ejemplo, si en una foto de grupo hay alguien un poco fuera de sitio, podemos usar esta herramienta para acercarlo al centro.

Mover elementos en una foto con la edición de imágenes de gemini

Fuente de la imagen: Pexels

2. Fotografía de producto con imágenes de alta calidad

En este escenario, imaginemos que somos una marca de calzado y queremos generar una foto de una modelo llevando nuestra última zapatilla. Tradicionalmente, producir contenido promocional requiere organizar una sesión de fotos, algo costoso y lento. 

Este ejemplo muestra cómo podemos combinar una foto existente de una modelo con la foto de nuestro producto:

Combinar dos fotos de alta calidad para mostrar cómo queda el producto

Fuentes de la imagen: primera imagen (Pexels), segunda imagen (Pexels).

También probé a combinar a una persona y un objeto en un caso más complejo pidiéndole a Gemini que hiciera que una persona de una foto sostuviera un coche de juguete de otra. Funciona muy bien:

Combinar personas con objetos de forma compleja

Fuentes de la imagen: primera imagen (Pexels), segunda imagen (Pexels).

No siempre necesitamos dos imágenes para este caso. Si solo tenemos la imagen del producto, también podemos dejar que el modelo genere el resto:

Colocar un producto en un fondo generado por IA

Fuente de la imagen: Pexels

3. Mejorar fotografía de producto

El ejemplo anterior muestra cómo combina fotos existentes de calidad. Pero ¿y si tenemos una mala foto del producto y queremos subir el nivel?

En este caso, tomé la foto de un pastel y pedí al modelo que la convirtiera en una imagen apta para una app de comida a domicilio. Mejorar fotografía gastronómica puede ser todo un reto, sobre todo si queremos imágenes que "entren por los ojos" en plataformas online.

Esta vez, el modelo no consiguió nada útil. Lo intenté muchas veces y los resultados seguían siendo flojos. Aquí tienes un ejemplo:

Mejorar una foto de producto existente

4. Modificar poses

Después quise ver qué tal altera Gemini 2.0 Flash la pose de una persona en una imagen. Modificar poses es muy útil, especialmente en fotografía de moda, donde pequeños cambios en el lenguaje corporal pueden transformar la escena.

Primero le pedí que hiciera que el sujeto mirara a la cámara:

Hacer que alguien mire a la cámara

Fuente de la imagen: Pexels

El resultado es bastante bueno, teniendo en cuenta que parte del rostro no era visible en la imagen original y el modelo tuvo que generarla de forma coherente.

Luego me dio curiosidad ver si podía hacer que el hombre diera la espalda a la cámara, y también funcionó muy bien:

Hacer que alguien dé la espalda a la cámara

Este ejemplo demuestra la solvencia del modelo con las modificaciones de pose. Integra los cambios con los elementos existentes de la imagen para que el resultado final sea coherente y profesional.

5. Modificar expresiones faciales

Sabemos que el modelo es bueno cambiando poses corporales. ¿Qué tal se le dan las expresiones faciales?

Cambiar expresiones faciales

Fuente de la imagen: Pexels

Imagina que tienes la foto de una reunión de equipo en la que todos salen algo serios, pero quieres transmitir un ambiente más distendido o alegre. Con Gemini 2.0 Flash, puedes ajustar sutilmente las expresiones para añadir sonrisas o suavizar ceños fruncidos y cambiar por completo el tono de la imagen.

Este ejemplo pone de relieve la capacidad del modelo para gestionar cambios de expresión con eficacia, lo que nos permite adaptar las imágenes a la narrativa que queremos contar. 

6. Miniaturas para YouTube

En el siguiente ejemplo, vemos cómo usar Gemini para crear una miniatura atractiva de YouTube combinando dos imágenes e incorporando texto. Las miniaturas son clave para captar la atención y pueden influir mucho en el rendimiento de un vídeo.

Crear miniaturas para YouTube

Fuentes de la imagen: primera imagen (Pexels), segunda imagen (Pexels).

No soy experto en qué hace buena a una miniatura, así que no juzgo ese aspecto del resultado, pero el modelo hizo exactamente lo pedido e incluso gestionó muy bien el texto, algo con lo que la IA suele tener problemas.

Estoy convencido de que alguien que sepa qué convierte una miniatura en algo irresistible podrá generar muy rápido miniaturas para sus vídeos.

7. Generar diagramas a partir de bocetos

Al intentar crear diagramas a partir de bocetos en papel, me encontré con algunas dificultades. Aunque el modelo cuenta con funciones avanzadas de edición, convertir bocetos en diagramas pulidos es una tarea específica que puede requerir más fineza.

Mejorar un diagrama complejo

En este ejemplo, a la IA le costó interpretar con precisión los elementos a mano alzada, lo que dio un resultado poco satisfactorio.

Le di una segunda oportunidad con un diagrama más simple. Esta vez, el diagrama generado siguió bien las instrucciones, pero el diseño era pobre:

Mejorar un diagrama simple

8. Transformar fotos para usarlas en el CV

Imagina que tienes una foto en la que la ropa es demasiado informal o no encaja con la imagen profesional que buscas. Con Gemini 2.0 Flash, puedes cambiar la vestimenta en la imagen para ajustarla a un look más formal propio de entornos profesionales.

Convertir una foto informal en profesional

Fuente de la imagen: Pexels

Este enfoque facilita mucho actualizar nuestra imagen profesional y nos ayuda a causar una gran primera impresión.

9. Modificar elementos en una foto

Imaginemos que tenemos una foto de producto con un fondo que no encaja bien con el resto de materiales de marketing. Con Gemini 2.0 Flash, podemos sustituir o modificar el fondo para ajustarlo a lo que necesitamos sin perder la esencia del producto.

Modificar elementos en una foto

Fuente de la imagen: Pexels

Esta función nos da una solución práctica para afinar contenido visual, adaptarlo a distintos contextos y maximizar el impacto de nuestras imágenes.

10. Añadir objetos a una foto existente

En este último ejemplo, quise ver cómo se comporta el modelo al añadir elementos nuevos a una foto. 

Añadir elementos a una foto

Fuente de la imagen: Pexels

Esta capacidad nos permite mejorar nuestras fotos con flexibilidad, adaptar imágenes a usos variados y alinear los visuales con nuestras ideas creativas.

Limitaciones de la edición de imágenes con Gemini

Negativa a generar imágenes

Durante las pruebas con Gemini Flash, el modelo a menudo se negó a generar la imagen:

Negativa del modelo a generar imágenes

Supongo que sucede porque hay algún algoritmo que bloquea ciertas peticiones para evitar usos no éticos. Sin embargo, no sé exactamente por qué ni cuándo ocurre, porque parecía bastante aleatorio e incluso afectó a contenidos que, en mi opinión, eran inofensivos, como el ejemplo anterior.

Regeneración y temperatura

No seleccioné los ejemplos afinando los prompts hasta que salieran bien, pero sí tuve que pedir a Gemini que lo intentara de nuevo con mucha frecuencia.

Así puedes volver a ejecutar la generación de imágenes:

Cómo volver a ejecutar la generación de imágenes en gemini google ai studio

Un factor clave que puede influir mucho en la calidad de los resultados de edición con Gemini 2.0 Flash es el ajuste de "temperature". Este ajuste, habitual en herramientas creativas, controla lo determinista o aleatoria que será la salida del modelo. 

En muchos casos, la temperatura por defecto es 1, lo que a veces introduce demasiada aleatoriedad y puede dar resultados que no encajen con lo esperado. Un valor más alto permite más variación y creatividad, pero puede alejarse del aspecto concreto que buscamos. Por el contrario, una temperatura más baja reduce la aleatoriedad y hace que el resultado sea más predecible y consistente.

Configurar la temperatura de salida

Por mi experiencia, ajustar la temperatura ayuda a adaptar mejor los resultados a lo que necesito. Si los resultados son demasiado impredecibles, bajar la temperatura acerca la salida a mi visión. Si busco alternativas más creativas o variadas, subirla ligeramente puede venir bien.

Calidad de imagen

Al usar el modelo, un problema frecuente fue la reducción de la resolución, sobre todo al generar múltiples iteraciones. Cada vez que regeneramos o aplicamos ediciones, la resolución puede degradarse y se pierde nitidez y detalle.

Esto ocurre porque cada edición o regeneración puede introducir pequeños artefactos o distorsiones. Con varias iteraciones, se acumulan y provocan una caída general de la calidad. Es similar a hacer una copia de otra copia: cada versión pierde claridad respecto a la original.

Incluso tras una sola iteración, la calidad se reduce de forma notable:

Degradación de la calidad de imagen

Conclusión

En conjunto, Gemini 2.0 Flash es una herramienta funcional con varias prestaciones útiles, aunque mi experiencia no siempre fue sencilla. Por lo general rinde bien, pero hubo momentos frustrantes, especialmente cuando el resultado deseado requería muchos intentos o cuando la calidad de la imagen bajaba tras ediciones sucesivas.

Dicho esto, me pareció especialmente competente trabajando con imágenes de personas. Tareas como modificar poses, combinar personas con objetos y cambiar expresiones faciales destacan como áreas en las que el modelo brilla. Al ajustar la pose de alguien o introducir un objeto nuevo en una escena con una persona, Gemini 2.0 Flash resolvió estas tareas con precisión manteniendo un aspecto natural.

De forma similar, retocar expresiones para cambiar el ánimo de una foto también lo gestionó con acierto, permitiéndonos crear la atmósfera que teníamos en mente sin esfuerzo.

Aunque algunas tareas requieran paciencia y ajustes adicionales, los puntos fuertes del modelo, especialmente en la edición de fotos con personas, lo convierten en un recurso valioso para potenciar proyectos visuales.


François Aubry's photo
Author
François Aubry
LinkedIn
Ingeniero full-stack y fundador de CheapGPT. Enseñar siempre ha sido mi pasión. Desde mis primeros días como estudiante, busqué con entusiasmo oportunidades para dar clases particulares y ayudar a otros estudiantes. Esta pasión me llevó a realizar un doctorado, en el que también trabajé como ayudante de profesor para apoyar mis esfuerzos académicos. Durante esos años, encontré una inmensa satisfacción en el entorno tradicional del aula, fomentando las conexiones y facilitando el aprendizaje. Sin embargo, con la llegada de las plataformas de aprendizaje en línea, reconocí el potencial transformador de la educación digital. De hecho, participé activamente en el desarrollo de una plataforma de este tipo en nuestra universidad. Estoy profundamente comprometida con la integración de los principios de la enseñanza tradicional con metodologías digitales innovadoras. Mi pasión es crear cursos que no sólo sean atractivos e informativos, sino también accesibles para los alumnos en esta era digital.
Temas
Inteligencia Artificial
IA Generativa

¡Aprende IA con estos cursos!

programa

Fundamentos de la IA

10 h
Descubre los fundamentos de la IA, aprende a aprovecharla de forma eficaz en el trabajo y sumérgete en modelos como chatGPT para navegar por el dinámico panorama de la IA.
Ver detallesRight Arrow
Iniciar Curso
Ver másRight Arrow
Relacionado
An AI juggles tasks

blog

Cinco proyectos que puedes crear con modelos de IA generativa (con ejemplos)

Aprende a utilizar modelos de IA generativa para crear un editor de imágenes, un chatbot similar a ChatGPT con pocos recursos y una aplicación clasificadora de aprobación de préstamos y a automatizar interacciones PDF y un asistente de voz con GPT.
Abid Ali Awan's photo

Abid Ali Awan

10 min

blog

Los 7 mejores generadores de vídeo con IA para 2026 con vídeos de ejemplo

Descubre los mejores generadores de vídeo con IA disponibles en la actualidad, entre los que se incluyen RunwayML, Synthesia, Colossyan, Pictory, DeepBrain AI, Invideo y los muy esperados Sora y Veo de DeepMind.
Dr Ana Rojo-Echeburúa's photo

Dr Ana Rojo-Echeburúa

9 min

blog

SAM 2: Primeros pasos con el modelo 2 de Segmentar cualquier cosa de Meta

El SAM 2 (Segment Anything Model 2) de Meta AI es el primer modelo unificado capaz de segmentar cualquier objeto tanto en imágenes como en vídeos en tiempo real.

Tutorial

Visión GPT-4: Guía completa para principiantes

Este tutorial le presentará todo lo que necesita saber sobre GPT-4 Vision, desde cómo acceder a él hasta ejemplos prácticos del mundo real y sus limitaciones.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

cursor ai code editor

Tutorial

Cursor AI: Una guía con 10 ejemplos prácticos

Aprende a instalar Cursor AI en Windows, macOS y Linux, y descubre cómo utilizarlo a través de 10 casos de uso diferentes.

Tutorial

Tutorial de DeepSeek-Coder-V2: Ejemplos, instalación, puntos de referencia

DeepSeek-Coder-V2 es un modelo de lenguaje de código de código abierto que rivaliza con el rendimiento de GPT-4, Gemini 1.5 Pro, Claude 3 Opus, Llama 3 70B o Codestral.
Dimitri Didmanidze's photo

Dimitri Didmanidze

8 min

Ver MásVer Más