Los datos sensibles al tiempo se tratan con una fecha de revisión: 4 de julio de 2026. Límites, menús de modelo, costes de crédito, privacidad y puertas de carga o exportación deben confirmarse en la interfaz actual antes de pagar o escalar.
Los datos sensibles al tiempo se tratan con una fecha de revisión: 4 de julio de 2026. Límites, menús de modelo, costes de crédito, privacidad y puertas de carga o exportación deben confirmarse en la interfaz actual antes de pagar o escalar.
Los datos sensibles al tiempo se tratan con una fecha de revisión: 4 de julio de 2026. Límites, menús de modelo, costes de crédito, privacidad y puertas de carga o exportación deben confirmarse en la interfaz actual antes de pagar o escalar.
Los datos sensibles al tiempo se tratan con una fecha de revisión: 4 de julio de 2026. Límites, menús de modelo, costes de crédito, privacidad y puertas de carga o exportación deben confirmarse en la interfaz actual antes de pagar o escalar.
Los datos sensibles al tiempo se tratan con una fecha de revisión: 4 de julio de 2026. Límites, menús de modelo, costes de crédito, privacidad y puertas de carga o exportación deben confirmarse en la interfaz actual antes de pagar o escalar.
Si ya tienes una imagen y no quieres generar otra desde cero sino cambiar la existente con IA, empieza por ChatGPT Images. Ahora mismo sigue siendo el mejor generador de imagen a imagen con IA para la mayoría porque el flujo es natural: subes la imagen, describes el cambio, eliges una zona si hace falta y sigues afinando dentro de la misma conversación. Pero ese default dura solo mientras no cambie lo que de verdad te importa. Si el original tiene que mantenerse muy estable, Adobe Firefly es más seguro. Si lo importante es una ruta gratis que puedas usar todos los días, Gemini es más claro. Si necesitas referencias, canvas y un flujo más de diseño, Recraft es mejor. Si la imagen final tiene que comportarse como un póster, un anuncio o una portada con texto legible, Ideogram es el specialist adecuado.
Lo que realmente hace que mucha gente elija mal es asumir que todo esto pertenece a un solo mercado. No es así. A veces necesitas un restyle conversacional. A veces lo que manda es un preserve-first editing contract. A veces buscas un editor gratis que no se agote después de dos pruebas. A veces necesitas varias imágenes de referencia y un canvas donde iterar. Y a veces el trabajo real no es solo "editar una foto", sino convertir un punto de partida en una pieza gráfica donde el texto siga funcionando.
La respuesta corta
| Si tu trabajo real se parece más a esto | Qué herramienta abrir primero | Por qué gana | Principal coste |
|---|---|---|---|
| Quieres el flujo image-to-image más natural en conjunto | ChatGPT Images | Subir, describir, seleccionar una zona y seguir iterando en un solo sitio | Se puede usar gratis, pero OpenAI no publica un número fijo de imágenes gratis |
| El original tiene que mantenerse lo más estable posible | Adobe Firefly | Editor más preserve-first para cambios precisos y visualmente coherentes | Más orientado al control que al chat ligero |
| Quieres una ruta gratis o de baja fricción para experimentar de forma recurrente | Gemini / Nano Banana | La ruta de Google encaja bien con pruebas rápidas sobre imágenes subidas | Límites, menús, región y planes pueden cambiar; confirma la cuenta actual |
| Necesitas referencias, canvas y un flujo de diseño más pesado | Recraft | Imported images, reference images, vectorization y multi-model editing en el mismo entorno | El workflow es mucho más pesado que un editor conversacional |
| Necesitas texto legible y resultados tipo póster | Ideogram | Canvas, Magic Fill, Extend y una posición mucho más fuerte en texto y layout | La edición sobre imágenes subidas vive en planes de pago |
Dicho en una frase: ChatGPT Images es el default más sólido no porque gane todos los trabajos, sino porque hace que la edición image-to-image se sienta natural. Pero en cuanto mandan más la conservación del original, el uso gratis diario, las referencias o el texto, otra herramienta pasa delante.
Por qué esta categoría es más compleja de lo que parece
La edición conversacional es un tipo de trabajo.
La mayor parte de la imagen ya te sirve. Solo quieres decir "pon la chaqueta en negro", "limpia el fondo" o "haz que esto parezca una escena al atardecer" y seguir avanzando. En ese contexto, importa menos el nombre del modelo y más si el producto está pensado para continuar corrigiendo sin romper el ritmo. Ahí es donde ChatGPT Images encaja mejor como punto de partida.
La edición preserve-first es otro trabajo distinto.
Si se trata de una foto de producto, un asset de cliente o un retrato que no puedes dejar que la IA reinterpreté demasiado, la pregunta deja de ser "qué modelo es más potente" y pasa a ser "qué herramienta tiene menos tendencia a rehacer el original". Por eso Firefly merece una categoría aparte. Su shell actual está claramente construido alrededor de subir una imagen y hacer cambios localizados con coherencia visual.
El uso gratis diario es su propia categoría.
Herramientas que te dejan "probar" hay muchas. Herramientas que publican un contrato gratis repetible y relativamente legible hay muchas menos. Gemini importa justo por eso. La ruta de Google permite subir una imagen, pedir cambios en lenguaje natural y compararla con ChatGPT, pero límites, menús y acceso deben comprobarse en la cuenta actual.
El trabajo con referencias y canvas vuelve a cambiar la elección.
Recraft no es el default para todo el mundo, pero se vuelve mucho más interesante cuando la tarea incluye reference images, consistencia de marca, vectorization, mockups o iteración estructurada dentro de un canvas.
Los resultados con texto son otra especialidad.
Muchos artículos los meten dentro de "edición de imágenes" como si fueran lo mismo, y no lo son. Si el resultado final tiene que actuar como póster, portada, miniatura o anuncio con texto legible, el eje de decisión cambia por completo. Por eso Ideogram no debería aparecer como "otra alternativa más".
La idea más útil para elegir es esta: en image-to-image, el shell importa tanto como el modelo. Un modelo más potente dentro del flujo equivocado puede ser peor elección que un modelo menos llamativo dentro del contrato de edición correcto.
Por qué ChatGPT Images sigue siendo el mejor default para la mayoría
La ayuda actual de OpenAI deja bastante claro el contrato del producto. Puedes subir una imagen existente y describir los cambios que quieres. Si necesitas una corrección más exacta, el Select tool te deja trabajar sobre una zona concreta. Parece un detalle pequeño, pero no lo es. Muchas herramientas image-to-image siguen pareciendo un modelo de text-to-image al que después le pegaron una función de edición. En ChatGPT Images la edición se siente como el centro del producto.
Ese es el motivo de su posición por defecto. La mayoría de la gente que busca un generador de imagen a imagen con IA no está construyendo una pipeline compleja de diseño. Lo que quiere es cambiar el ambiente, limpiar un fondo, probar otra estética, tocar una parte que salió mal y seguir iterando sin cambiar de interfaz cada dos minutos. ChatGPT Images resuelve especialmente bien ese tipo de trabajo mixto porque todo vive dentro del mismo loop conversacional.
También gana por accesibilidad. ChatGPT Images existe hoy en Free, Go, Plus, Edu y Pro, y la app de Images reúne las salidas en un solo lugar. Eso no significa que el Free plan sea el contrato gratis más transparente del mercado. OpenAI sigue sin publicar un conteo fijo de imágenes gratis y la creación de imágenes en Free tiene límites más estrictos. Aun así, como puerta de entrada general y como flujo al que resulta fácil volver, sigue siendo el mejor default.
Su debilidad también es clara: si tu trabajo no es "quiero retocar esto hablando" sino "esta foto no puede desviarse casi nada del original", ChatGPT no siempre es el shell más seguro. Ahí entra Firefly.
Las herramientas que superan a ChatGPT cuando cambia el contrato

Adobe Firefly es la mejor opción preserve-first.
El editor actual de Firefly define muy bien su trabajo: subir una imagen, usar texto para añadir, quitar o modificar objetos y fondos, y conseguir cambios más precisos y visualmente coherentes. Eso vale mucho más que las promesas vagas de "transforma tu imagen". Si lo que tienes entre manos es una foto de producto, un retrato o un asset de marca que debe seguir pareciendo el mismo después de la edición, Firefly ofrece más tranquilidad.
Además, Firefly ya no es solo una caja con un único modelo. Adobe te deja elegir entre modelos propios y partner models dentro del editor. Por eso sigo insistiendo en que el shell importa. En este tipo de tarea, lo que decide la experiencia real no es solo el nombre del modelo, sino cómo se combinan upload, resolución, relación de aspecto, consistencia y edición localizada.
Gemini es la ruta gratis diaria más clara.
La ruta de Google merece estar separada, pero no debe escribirse como una promesa estable de cuota gratis. Gemini / Nano Banana aporta valor porque permite subir una imagen, pedir cambios en lenguaje natural, hacer pruebas de concepto y compararlo con ChatGPT sin montar un canvas de diseño ni una API. A la vez, los límites de la app, model menus y accesos dependen de cuenta, región, plan y capacidad. La formulación responsable es tratar Gemini como una ruta fuerte para probar, y comprobar cualquier cifra en la cuenta actual.
No lo pongo como default absoluto porque la experiencia de Google sigue fragmentada: Gemini Apps, AI Mode, AI Studio y APIs cuentan historias distintas. Pero si eres free-first y lo de image-to-image es una necesidad recurrente, hoy es la ruta gratis más honesta.
Recraft es el mejor power-user canvas cuando importan las referencias y el control.
Es fácil infravalorar Recraft si lo miras solo como "otro generador". Su fuerza real es que las imágenes importadas pueden reutilizarse para vectorization, prompt-based editing, outpainting, mockups y workflows de estilo. Además, su capa de natural-language editing admite reference images opcionales y varios external models dentro del mismo entorno. Eso hace que sea especialmente fuerte cuando no estás editando una sola imagen una vez, sino construyendo un flujo de diseño repetible alrededor de ella.
No es una recomendación por defecto para un usuario casual. El workflow es más pesado y los créditos importan. Pero si la tarea incluye varias referencias, consistencia de marca, activos reutilizables o una iteración más estructurada, Recraft gana peso muy deprisa.
Ideogram es el specialist para resultados con texto legible.
Ideogram merece un carril propio porque el trabajo con texto dentro de la imagen sigue rompiendo a muchas herramientas. Su Canvas actual deja subir imágenes, usar Magic Fill y Extend y trabajar de forma iterativa. Pero lo más importante es que Ideogram sigue posicionando el producto alrededor de advanced text rendering y graphic design. Eso cambia por completo su valor en pósters, anuncios, menús, portadas y miniaturas.
La desventaja también hay que decirla sin maquillaje: no es la ruta gratuita más amable. La edición sobre imágenes subidas cae en planes de pago y Free no incluye private generation. Aun así, si tu frase real es "quiero convertir esta imagen de partida en una pieza visual con texto que siga funcionando", Ideogram es el specialist más lógico.
Si lo que en realidad quieres no es un image-to-image general sino ampliar el encuadre hacia fuera, el siguiente paso correcto es nuestra guía para expandir imágenes con IA. Se solapan, pero no son el mismo problema.
Los tradeoffs que muchas páginas image-to-image siguen saltándose

El primer tradeoff que suele omitirse es conversation vs control. ChatGPT gana porque se deja conversar. Firefly gana cuando el original necesita una correa más corta. Recraft gana cuando quieres un canvas y una pila de referencias más completa. No son diferencias cosméticas; cambian por completo si la herramienta te resulta natural o frustrante.
El segundo tradeoff es free access vs real free contract. ChatGPT Free crea imágenes, pero OpenAI no publica una cifra estable. Gemini sirve para experimentar rápido, pero sus límites y accesos pueden cambiar. Ideogram es fuerte, pero la edición sobre imágenes subidas no es un asunto del free tier. Si no dejas esto claro desde el principio, el lector sigue sin saber qué pestaña abrir.
El tercer tradeoff es restyling vs preservation. Hay quien quiere que el modelo reinterprete la imagen con libertad y quien quiere que el modelo vaya con correa corta. Firefly es mejor en lo segundo. ChatGPT y Recraft suelen ser más fuertes en lo primero. Muchas decepciones con herramientas image-to-image nacen de usar un producto pensado para restyle donde la tarea real exigía preservar.
El cuarto tradeoff es graphic layout vs ordinary photo editing. Ideogram no es solo otro editor con fill. Importa porque el texto legible y el layout siguen siendo una habilidad aparte. Si el resultado final debe comportarse como un póster o una creatividad publicitaria, no tiene sentido medir todas las herramientas con el mismo eje de edición fotográfica general.
El quinto tradeoff, y el más infravalorado, es el shell alrededor del modelo. Todo el mundo habla de model names, pero la experiencia real de uploaded-image editing la definen selection tools, masking behavior, references, canvas workflow, calidad de exportación y la capacidad de seguir iterando sin perder contexto.
Si ya no te importa partir de una imagen existente y lo que quieres es una decisión más amplia sobre qué generador escoger en general, entonces el siguiente texto correcto es nuestra guía general sobre generadores de imágenes con IA.
Cómo elegir en 30 segundos
Empieza por ChatGPT Images si quieres la forma más sencilla de subir una imagen, describir el cambio y seguir iterando en el mismo sitio.
Pásate a Adobe Firefly si el original importa más que la velocidad y necesitas un shell más preserve-first.
Pásate a Gemini si tu pregunta principal es "qué puedo seguir usando gratis cada día" y no "qué editor es el más pulido en general".
Pásate a Recraft si necesitas referencias, activos reutilizables, vectorization o un canvas más pesado que un simple chat loop.
Pásate a Ideogram si tu imagen de partida es el comienzo de un póster, una miniatura, una portada o cualquier resultado donde el texto tenga que leerse bien.
La respuesta útil aquí no es un ganador universal, sino el contrato de edición que mejor encaja con tu imagen.
Frontera de rutas: app, wrapper, API y abierto/local
No todas las alternativas a ChatGPT pertenecen a la misma clase. ChatGPT Images, Gemini y Firefly son rutas de producto para usuarios. OpenArt y Felo son más bien wrapper routes: ofrecen una superficie tipo chat y menús de modelos, pero no son propietarios de todos los modelos que exponen. OpenAI API, Recraft API y otras image APIs sirven para workflows programables. FLUX Kontext, Qwen-Image-Edit y rutas abiertas/locales exigen setup, revisión de licencia, hardware o inferencia alojada.

Esa frontera cambia lo que debes verificar. En una app mira upload, edición, selección o máscara, exportación y plan. En un wrapper mira el modelo real, créditos, privacidad, borrado y marca de agua. En una API mira input image, masks, logs, retries, coste y revisión. En abierto/local mira licencia, hardware, formato de prompt, velocidad y evaluación de calidad.
| Ruta | Qué verificar primero | Qué no deberías asumir |
|---|---|---|
| App product | Upload, edición local, plan, export | Que el acceso gratis seguirá igual |
| Wrapper | Modelo real, créditos, privacidad, borrado | Que el wrapper es dueño del modelo |
| API | Input, masks, batching, logs, coste | Que la experiencia manual sirve como producción |
| Abierto/local | Licencia, hardware, inferencia, evaluación | Que una demo bonita equivale a pipeline fiable |
Prueba con la misma imagen
Antes de pagar o migrar, pasa la misma imagen subida por las rutas candidatas. No compares demos distintas ni empieces con una transformación enorme. La prueba útil es: una imagen fuente, un cambio pequeño, una regla de puntuación.
- Elige una imagen fuente nítida y con detalles reales.
- Pide un cambio pequeño: fondo, color, eliminación de objeto o ajuste local.
- Mira primero identidad, forma del producto, etiqueta, logo, texto y composición.
- Después mira si el prompt se cumplió o solo salió una imagen bonita.
- Repite con un cambio algo más difícil.
- Escala solo si conservación, cumplimiento, coste y exportación siguen estables.
| Puntuación | Qué inspeccionar | Señal de fallo |
|---|---|---|
| Conservación | Cara, producto, logo, etiqueta, composición | El sujeto parece reinterpretado |
| Cumplimiento | Objeto, color, fondo o ambiente solicitado | La imagen es bonita pero no hace el trabajo |
| Texto | Etiquetas, palabras de póster, texto tipo UI | Letras falsas, errores o layout roto |
| Coste de ruta | Créditos, plan, exportación, privacidad | Tres reintentos vuelven la ruta cara o frágil |
Patrones de prompt que viajan bien
Para edición preserve-first:
textEdit only the needed area in the uploaded image. Change [specific object or background]. Keep the person's identity, expression, clothing shape, product label, lighting direction and camera angle unchanged. If the face or label cannot stay stable, make a smaller edit instead of replacing the image.
Para restyle:
textUse the uploaded image as the starting composition. Transform the mood into [style or setting]. Keep the main subject recognizable, but allow lighting, background, texture and color palette to change. Do not add text unless requested.
Para texto o póster:
textTurn the uploaded image into a clean [poster/banner/card] layout. Preserve the main subject. Add only this exact text: "[short text]". Keep the text large, readable and spelled exactly. Leave empty margin for cropping.
Dónde falla cada ruta
ChatGPT Images suele fallar cuando la conservación es rígida. Si una cara, etiqueta, forma de producto o layout exacto se desplaza, no sigas pidiendo cinco reintentos al mismo chat; cambia a una ruta preserve-first o con máscara. Gemini falla de otra forma: limit, model menu o app access pueden cambiar durante el proyecto. Es una ruta fuerte para experimentar, pero conviene registrar el estado vivo de la cuenta antes de usarla de forma recurrente.
OpenArt, Felo y wrappers parecidos fallan en la capa contractual: modelo real, créditos, privacidad o exportación pueden no ser lo que esperabas. Firefly puede sentirse pesado si la tarea es un restyle salvaje o un juego creativo rápido. Recraft e Ideogram son fuertes en diseño, referencias, texto y canvas, pero pueden ser excesivos para una corrección simple. API y open/local routes fallan cuando el coste de setup supera el valor de automatización, privacidad o repetibilidad.
Qué comprobar antes de pagar o escalar
| Ruta | Comprobación antes de escalar |
|---|---|
| ChatGPT Images | Ayuda de OpenAI, límites de cuenta, Select tool, exportación |
| OpenAI API | Image API edits, masks, references, logs, coste |
| Gemini / Nano Banana | Límites de Gemini app, docs de generación de imagen, acceso de cuenta |
| Adobe Firefly | Upload editing, AI Markup, plan y créditos |
| OpenArt / Felo | Model menu, créditos, privacidad, borrado, exportación |
| Recraft / Ideogram | Imported images, Canvas, texto, referencias, plan gates |
| FLUX / Qwen | Licencia, hardware o inferencia alojada, evaluación de workflow |
Preguntas frecuentes
¿Cuál es la mejor alternativa a ChatGPT para editar imágenes con IA?
No hay un único ganador. Para cambios conversacionales simples, empieza por ChatGPT Images. Para trabajos preserve-first, abre Adobe Firefly. Para pruebas rápidas de la ruta Google, prueba Gemini / Nano Banana. Para explorar wrappers, usa OpenArt o Felo. Para diseño, texto y canvas, mira Recraft o Ideogram. Para automatización, considera API o modelos abiertos/locales.
¿Cuál es la alternativa gratis más práctica?
Prueba primero Gemini / Nano Banana y ChatGPT Images, pero no conviertas ningún límite gratis en contrato permanente. Límites, menús de modelo, regiones y planes cambian. Antes de trabajar de verdad, mira la cuenta actual y ejecuta una prueba pequeña con la misma imagen.
¿Qué ruta sirve mejor para edición realista de fotos?
Si realista significa un cambio pequeño y creíble conservando identidad, producto o etiqueta, empieza por Firefly u otro editor preserve-first. Si realista significa variación fotorealista creativa, ChatGPT, Gemini, Recraft o Flux/Qwen pueden entrar en la prueba con la misma imagen.
¿Qué ruta conviene si la imagen incluye texto?
Empieza por una ruta de diseño sensible al texto. Ideogram encaja bien con layouts tipo póster y palabras legibles. Recraft también sirve cuando la imagen forma parte de un canvas más amplio. En el prompt exige texto exacto, ortografía y margen.
¿OpenArt y Felo son alternativas reales o solo wrappers?
Son rutas de acceso reales, pero wrapper routes. Ayudan a comparar modelos y hacer exploración creativa, aunque antes de usarlas con activos importantes debes verificar modelo seleccionado, créditos, privacidad, borrado y exportación.
¿Cuándo usar OpenAI API en vez de ChatGPT?
Cuando necesitas workflow programable, logs, retries, cost tracking, batch, UI propia o revisión. Para una o dos ediciones manuales, el setup de API suele ser mayor que la tarea.
¿Merece la pena correr FLUX Kontext o Qwen en local?
Solo si control local, investigación, privacidad o evaluación propia justifican el setup. Las rutas abiertas/locales requieren revisión de licencia, hardware o inferencia alojada, workflow específico y control de calidad.
¿Cuándo ChatGPT sigue siendo la mejor opción?
Cuando la edición es simple, de bajo riesgo y conversacional: limpiar fondo, cambiar ambiente, quitar un objeto pequeño, restyle de borrador o iteración rápida. Cambia de ruta cuando conservación, texto, API, estabilidad de plan o control local importen más que la comodidad.



