Nano Banana 2.1 vs Pro vs GPT Image 2.5: mismo prompt, 9 pruebas
Con el mismo prompt a 1K, Nano Banana Pro y GPT Image 2.5 copiaron literal el texto que 2.1 alteró; 2.1 cuesta la mitad o menos que Pro. Una tirada por modelo.
En esta página

Si el texto de la imagen tiene que salir exactamente como lo escribes, empieza por Nano Banana Pro o por GPT Image 2.5. Si generas mucho volumen y puedes revisar cada imagen, Nano Banana 2.1 da un resultado muy parecido por la mitad o menos de lo que cuesta Pro. Es lo que mostró una prueba del 8 de octubre de 2026 con los mismos 8 prompts y una misma edición en los tres modelos, a 1K: Pro y GPT Image 2.5 reprodujeron tal cual el cartel y el letrero japonés, y respetaron todas las palabras y precios de la carta china, aunque en chino los tres modelos escribieron 单 como 単; Nano Banana 2.1 cambió algo del texto en los tres casos. En foto de producto, retrato, recuento de objetos, infografía y cambio de color, los tres cumplieron.
Dos límites pesan sobre todo lo que sigue. Cada modelo generó una sola imagen por prompt, sin repetir ni elegir la mejor, así que un fallo o un acierto aislado no convierte a nadie en «siempre mejor». Y GPT Image 2.5 no se llamó a través de la API de OpenAI, sino de la ruta VIP de pago por llamada de LaoZhang API (gpt-image-2.5-sunburst-vip): su salida y sus tiempos pueden no coincidir con los de OpenAI directo.
Qué modelo usar primero según la tarea
La columna de la derecha resume lo que pasó en la prueba; es una muestra por tarea, no una media.
| Tarea | Empieza por | Qué pasó con el mismo prompt |
|---|---|---|
| Carteles, letreros y menús con texto literal | Nano Banana Pro o GPT Image 2.5 | Ambos respetaron cada palabra y precio en inglés, japonés y chino (en chino, los tres escribieron 单 como 単); 2.1 alteró el texto en los tres |
| Pantallas de app con etiquetas fijas | GPT Image 2.5 | Los tres pusieron bien las etiquetas; Pro y 2.1 inventaron campos que nadie pidió |
| Infografías con pasos o datos | Cualquiera de los tres | Los tres ordenaron bien los 5 pasos; GPT Image 2.5 añadió un eslogan no pedido |
| Foto de producto y retrato | Nano Banana 2.1 por precio; GPT Image 2.5 si buscas acabado publicitario | Los tres, realistas; GPT Image 2.5 dio el aspecto más estilizado |
| Cambiar el color de un objeto en una foto | Cualquiera, diciendo qué piezas cambian | Los tres conservaron encuadre y luz; interpretaron distinto el interior de la tapa |
| Mucho volumen al menor coste | Nano Banana 2.1 en Google o GPT Image 2.5 VIP | 0,0336 $ por imagen 1K más razonamiento en Google; 0,03 $ por llamada en la ruta VIP |
| Respuesta rápida | Nano Banana 2.1 o Pro | 17–33 s y 18–23 s, frente a 58–76 s de GPT Image 2.5 VIP |
Si solo vas a usar uno y tus imágenes llevan texto que alguien leerá, Pro es la opción más segura de las dos de Google. Si casi nunca lleva texto, 2.1 hace lo mismo más barato.
Cómo se hizo la prueba: 8 prompts y 1 edición, una tirada por modelo a 1K
El equipo de LaoZhang AI, que publica este blog y también opera LaoZhang API, lanzó las 27 llamadas el 8 de octubre de 2026, todas a través de LaoZhang API:
- Nano Banana 2.1 (
gemini-nano-banana-2.1) y Nano Banana Pro (gemini-3-pro-image) por la ruta nativa de Gemini (generateContent), formato 1:1, tamaño 1K y razonamiento por defecto. - GPT Image 2.5 Sunburst por la ruta VIP de pago por llamada (
gpt-image-2.5-sunburst-vip), con/v1/images/generationsy/v1/images/edits, tamaño 1024×1024 y calidadhigh.
Los 8 prompts de generación cubrían un cartel con título y línea de fecha, una infografía sobre cómo se aprueba una ley en EE. UU., una foto de producto (un estuche negro de auriculares sobre piedra), un letrero de ramen en japonés, una carta de té en chino, un recuento espacial (tres tazas rojas a la izquierda y dos azules a la derecha), un retrato de un pescador y una pantalla de app del tiempo con etiquetas exactas. La edición fue la misma para los tres: tomar la foto del estuche que había generado 2.1 y pedir «cambia el estuche a blanco brillante y deja todo lo demás exactamente igual».
Por qué la ruta VIP: la ruta de LaoZhang API que reenvía a OpenAI (gpt-image-2.5-sunburst) exige que la clave esté en el grupo Sora2Official. Con una clave del grupo default devolvió un 503 «no available channels», sin cobro. La ruta VIP cuesta 0,03 $ por llamada según la documentación de GPT Image 2.5 en LaoZhang API (en inglés), pero no es la API de OpenAI.
Lo que esta prueba no mide: calidad a 2K o 4K, el modo Batch, varias imágenes de referencia, coherencia de personajes, la búsqueda de Google como fuente, ni la velocidad llamando a Google u OpenAI directamente. Los textos del cartel, el letrero, la carta y la pantalla se compararon carácter a carácter; el resto son valoraciones a ojo de las imágenes.
Resultados de las 9 pruebas, prompt a prompt
| Prueba | Nano Banana 2.1 | Nano Banana Pro | GPT Image 2.5 (VIP) |
|---|---|---|---|
| Cartel «MIDNIGHT TRAIN» | Palabras correctas, pero la línea de fecha en mayúsculas y con rayas largas en lugar de guiones | Texto exacto | Texto exacto; la composición más trabajada (vías de tren) |
| Infografía de 5 pasos | 5 pasos correctos, con iconos claros | 5 pasos correctos; une la votación de ambas cámaras y añade el comité de conferencia | 5 pasos correctos con descripciones; añade el eslogan «A LAW FOR A STRONGER TOMORROW» |
| Foto de producto | Limpia y realista | Limpia y realista | Realista, con el aspecto más «premium» |
Letrero japonés 本日のおすすめ ラーメン 980円 + OPEN | Todo lo pedido, más una línea en katakana que no estaba en el prompt | Texto exacto | Texto exacto; añade otros letreros verosímiles al fondo |
Carta china 今日茶单 con 3 precios | Escribe 38元 como 三十八元 | Precios exactos | Precios exactos |
| 3 tazas rojas a la izquierda, 2 azules a la derecha | Correcto | Correcto | Correcto |
| Retrato de pescador | Natural | Natural | Realista, con un etalonaje más dramático |
| App del tiempo: Lisbon 23 °C y 5 días | Etiquetas correctas; añade calidad del aire, humedad y viento | Etiquetas correctas; añade sensación térmica, UV, máximas y mínimas, previsión por horas y más | Etiquetas correctas, casi sin añadidos |
| Edición: estuche a blanco | Hecho; conserva encuadre, auriculares, piedra y luz; el interior de la tapa también pasa a blanco | Igual que 2.1 | Hecho; conserva todo y deja oscuro el interior de la tapa |
Un fallo que compartieron los tres: en el título de la carta, 今日茶单, escribieron el carácter simplificado 单 con su forma japonesa 単. Si generas texto en chino simplificado con cualquiera de ellos, revisa ese tipo de sustituciones.
¿Quién escribe mejor el texto: Nano Banana 2.1, Pro o GPT Image 2.5?
En esta prueba, Pro y GPT Image 2.5 empataron: copiaron literalmente el cartel y el letrero japonés, y en la carta china pusieron todas las palabras y precios pedidos, con la salvedad del 単 que compartieron los tres modelos. Nano Banana 2.1 no falló ninguna palabra en inglés, pero se tomó libertades en los tres casos:
- Cartel: el prompt pedía «Live at Hall 7 - Nov 14, 2026 - Doors 19:30». 2.1 lo pasó a mayúsculas y cambió los guiones por rayas largas. Para un diseñador puede parecer una mejora; para quien necesita el texto tal cual, es un error.
- Letrero japonés: puso todo lo pedido, pero añadió una línea extra en katakana que nadie pidió y que no forma ninguna palabra con sentido en el letrero.
- Carta china: escribió el precio del té Longjing en letras chinas (三十八元) en vez de en cifras (38元). Un cliente lo entiende, pero ya no es el texto que diste.

Llama la atención que 2.1 fuera el que más razonó justo en esos prompts: entre 1.209 y 1.704 tokens de razonamiento en el cartel, la infografía, el letrero y la carta, frente a 122–252 tokens de Pro en cualquier prompt. Más razonamiento no se tradujo en copia más fiel. Google reconoce en la ficha técnica de Nano Banana 2.1 de Google DeepMind que a 1K el texto pequeño puede salir borroso; los cambios de esta prueba, sin embargo, no fueron de nitidez sino de redacción, y la prueba no comprobó si a 2K desaparecen.
En la pantalla de la app del tiempo, los tres acertaron todas las etiquetas y temperaturas. La diferencia estuvo en lo que añadieron por su cuenta: 2.1 metió calidad del aire, humedad y viento; Pro rellenó la pantalla con media docena de bloques inventados en letra pequeña (sensación térmica, índice UV, previsión por horas, calidad del aire, viento y presión); GPT Image 2.5 se limitó a lo pedido. Si vas a usar la imagen como maqueta de una interfaz real, esos campos inventados son lo que más trabajo da después.
Foto de producto, retrato y edición: los tres cumplen, cambia el estilo
En las imágenes sin texto la distancia se reduce. La foto del estuche de auriculares salió limpia y creíble en los tres; GPT Image 2.5 le dio un acabado de anuncio, con un bloque de piedra desenfocado al fondo y sombras más marcadas. El retrato del pescador fue natural en 2.1 y en Pro, y algo más dramático de color en GPT Image 2.5. El recuento de tazas fue correcto en los tres, y eso que Google cita la confusión entre izquierda y derecha como una limitación conocida de 2.1: una sola imagen correcta no demuestra que el problema no exista.
La edición es la prueba más útil para quien retoca fotos de catálogo. Los tres cambiaron el estuche a blanco y mantuvieron encuadre, auriculares, textura de la piedra y sombra. Solo difirieron en el interior de la tapa: 2.1 y Pro lo pintaron de blanco; GPT Image 2.5 lo dejó oscuro y solo cambió el exterior. Ninguna versión contradice el prompt, que hablaba del «estuche» sin más; si te importa esa pieza, nómbrala.
Nano Banana 2.1 o Nano Banana Pro: diferencias además del precio
2.1 es el modelo nuevo y barato de Google; Pro, el caro, pero el más literal con el texto en esta prueba. Fuera de la calidad, la documentación de Google marca estas diferencias:
| Nano Banana 2.1 | Nano Banana Pro | |
|---|---|---|
| Tamaños | 1K, 2K y 4K (sin 0,5K); 14 proporciones, incluidas 1:8 y 8:1 | 1K, 2K y 4K |
| Imágenes de referencia | Hasta 14 (fidelidad de 10 objetos y parecido de 4 personajes) | 6 objetos y 5 personajes |
| Búsqueda de Google como fuente | Búsqueda web y de imágenes | Búsqueda web |
| Precio en la API de Gemini | 0,0336 $ (1K), 0,0504 $ (2K), 0,113 $ (4K) | 0,134 $ (1K y 2K), 0,24 $ (4K) |
| Tiempo en la prueba (1K) | 17–33 s | 18–23 s |
GPT Image 2.5 juega en otra liga de formatos: admite tamaños a medida de hasta 3840×2160 o 2880×2880 y niveles de calidad de low a max, que cambian mucho el precio por imagen.
En la app Gemini la elección la hace tu plan: 2.1 está reservado a Google AI Pro, Plus y Ultra; las cuentas gratuitas usan Nano Banana 2, y los suscriptores pueden rehacer una imagen con Pro desde la propia app, según la página de generación de imágenes de Gemini.
Para el lanzamiento, los cambios de 2.1 respecto a Nano Banana 2 y la migración del ID, está la guía Nano Banana 2.1: novedades, precio y prueba real por API.
¿Cuál es más barato? Coste por imagen a 1K en Google, OpenAI y LaoZhang API
En LaoZhang API la llamada más barata es la ruta VIP de GPT Image 2.5; con precio directo de Google u OpenAI, Nano Banana 2.1. Pro es el más caro en ambos casos. Precios a 8 de octubre de 2026:
| Modelo | Google / OpenAI directo (1K) | LaoZhang API (por llamada) | 1.000 imágenes en LaoZhang API |
|---|---|---|---|
| Nano Banana 2.1 | 0,0336 $ + razonamiento ≈ 0,036–0,046 $ | 0,045 $ | 45 $ |
| Nano Banana Pro | 0,134 $ + razonamiento | 0,09 $ | 90 $ |
| GPT Image 2.5 Sunburst | ≈ 0,053 $ de salida + entrada (calidad high) | 0,03 $ (ruta VIP) | 30 $ |
Cómo salen esas cifras:
- Nano Banana 2.1 en Google: la página de precios de la API de Gemini cobra 0,0336 $ por imagen 1K (0,0504 $ a 2K y 0,113 $ a 4K), y aparte el razonamiento a 7,50 $ por millón de tokens. Con lo que razonó en la prueba: 0,0336 + 336 × 7,50 / 1.000.000 ≈ 0,036 $ en la foto de producto, y 0,0336 + 1.704 × 7,50 / 1.000.000 ≈ 0,046 $ en la infografía. En prompts con mucho texto, el precio directo se acerca a los 0,045 $ fijos de LaoZhang API.
- Nano Banana Pro en Google: 0,134 $ por imagen a 1K y a 2K, 0,24 $ a 4K, más su propio razonamiento.
- GPT Image 2.5 en OpenAI: la página de precios de la API de OpenAI cobra la imagen de salida a 30 $ por millón de tokens y estima entre 0,0059 $ (calidad baja) y 0,2107 $ (máxima) por imagen de 1024×1024. Cada respuesta de la ruta VIP informó de 1.756 tokens de imagen en calidad
high; si OpenAI contara lo mismo, serían 1.756 × 30 / 1.000.000 ≈ 0,053 $ más la entrada. Es una estimación, no una factura. - Modo Batch de Google: si no necesitas la imagen al momento, Google cobra la mitad por la imagen de 2.1 y de Pro.
Las 27 llamadas de la prueba costaron 1,485 $ a precio de lista de LaoZhang API: 9 × (0,045 + 0,09 + 0,03). Hubo además dos intentos fallidos de GPT Image 2.5 VIP; no se pudo determinar si se cobraron, porque otra sesión usaba la misma clave a la vez.
Si vienes de Nano Banana 2, que cuesta 0,067 $ a 1K en Google, el detalle está en Nano Banana 2 API: precio por imagen y cuánto ahorras con 2.1. Para planes y suscripción de Pro, en ¿Cuánto cuesta Nano Banana Pro? API, suscripción y coste real por imagen.
Velocidad: unos 20 s en Nano Banana, más de un minuto en GPT Image 2.5
Medido desde el equipo que lanzó las llamadas, con la pasarela de LaoZhang API y la red incluidas:
- Nano Banana 2.1: 17–33 s por imagen; las 9 llamadas salieron a la primera. La más lenta fue la carta china (33 s).
- Nano Banana Pro: 18–23 s; 9 de 9 a la primera.
- GPT Image 2.5 Sunburst VIP: 58–76 s; 2 de 11 intentos devolvieron un 503 «Upstream model service error» y funcionaron al reintentar.

Para un flujo interactivo, en el que alguien espera la imagen delante de la pantalla, el minuto largo de la ruta VIP pesa más que los 0,015 $ que ahorra frente a 2.1. Para lotes nocturnos da igual, siempre que tu código reintente los 503. Estos tiempos no son los de Google u OpenAI directos.
Arena y las evaluaciones de Google: qué miden y por qué no coinciden
Las clasificaciones públicas cuentan una historia algo distinta, porque miden otra cosa.
En la clasificación texto a imagen de Arena, actualizada el 6 de octubre de 2026, GPT Image 2.5 Sunburst es primero (1425 ± 7) y Flare segundo (1398 ± 7), ambos con puntuación preliminar; Nano Banana 2.1 es quinto (1328 ± 9, preliminar, 5.312 votos) y Pro a 2K, decimosexto (1248 ± 3). Arena recoge votos a ciegas sobre qué imagen gusta más: no comprueba si el texto es literal, ni mide coste o edición.
Google, en la ficha de 2.1, publica sus propias evaluaciones humanas de 2.1 con razonamiento frente a Pro: preferencia general 1050 frente a 935, factualidad en infografías 0,521 frente a 0,265, edición general 1026 frente a 939 y coherencia con varios personajes 1106 frente a 1011. Son mediciones del propio fabricante, no independientes. En la misma ficha, Google admite que 2.1 sigue solo en parte las instrucciones en ediciones con máscara.
Las tres fuentes encajan si separas qué miden: GPT Image 2.5 gana en gusto a ciegas, 2.1 supera a Pro en las pruebas de Google, y Pro fue más literal con el texto en esta muestra. Si tu criterio es «que diga exactamente lo que escribí», la última es la que más se parece a tu caso, con la salvedad de una sola tirada.
Si dudas entre las dos variantes de OpenAI, compara GPT Image 2.5 Sunburst vs Flare: cuál elegir y cuánto difieren; si aún usas el modelo anterior, GPT Image 2.5 frente a GPT Image 2: cuál usar y cómo migrar.
Preguntas frecuentes sobre Nano Banana 2.1, Pro y GPT Image 2.5
¿Qué modelo de Nano Banana es mejor, 2.1 o Pro?
Depende de si tu imagen lleva texto. En esta prueba, Pro copió el texto pedido sin cambios y 2.1 alteró el del cartel, el letrero y la carta; en fotos y ediciones sin texto quedaron a la par. 2.1 cuesta 0,0336 $ por imagen 1K en Google frente a 0,134 $ de Pro, y en las evaluaciones del propio Google sale por delante.
¿Nano Banana 2.1 o GPT Image 2.5 para imágenes con texto?
GPT Image 2.5, si el texto debe ser literal: en esta prueba respetó cada palabra y precio en inglés, japonés y chino (salvo el 单 escrito como 単, que hicieron los tres modelos), y añadió menos datos inventados en la pantalla de app. A cambio, por la ruta VIP de LaoZhang API tardó 58–76 s por imagen, frente a 17–33 s de 2.1.
¿Los resultados de GPT Image 2.5 serían iguales con la API de OpenAI?
No necesariamente. Las imágenes de GPT Image 2.5 de esta prueba salieron de la ruta VIP por llamada de LaoZhang API, no de OpenAI directo, así que la calidad, los tiempos y los fallos pueden cambiar en la API de OpenAI.
¿Puedo usar Nano Banana 2.1 gratis en la app Gemini?
No. En la app Gemini, 2.1 está reservado a los planes Google AI Pro, Plus y Ultra; con una cuenta gratuita generas con Nano Banana 2. Por la API de Gemini, 2.1 no tiene nivel gratuito.
Fuentes5
Páginas externas que cita esta guía, en el orden en que aparecen. Última actualización: 8 oct 2026.
Fuentes5
Páginas externas que cita esta guía, en el orden en que aparecen. Última actualización: 8 oct 2026.
- 1.ficha técnica de Nano Banana 2.1 de Google DeepMinddeepmind.google/models/model-cards/nano-banana-2-1
- 2.página de generación de imágenes de Geminigemini.google/overview/image-generation
- 3.página de precios de la API de Geminiai.google.dev/gemini-api/docs/pricing
- 4.página de precios de la API de OpenAIdevelopers.openai.com/api/docs/pricing
- 5.clasificación texto a imagen de Arenaarena.ai/leaderboard/text-to-image





