# ¿Nano Banana crea vídeos? De su imagen a vídeo con Gemini Omni

> Ningún modelo Nano Banana genera vídeo. Su imagen se convierte en clip con Gemini Omni (app de Gemini y API) o con Veo 3.1, con una restricción para España.

- URL: https://blog.laozhang.ai/es/posts/can-nano-banana-make-videos
- Published: 2026-06-28
- Updated: 2026-09-22
- Author: LaoZhang AI Team (https://blog.laozhang.ai/es/about)
- Category: Generación de vídeo con IA
- Tags: Nano Banana, Nano Banana 2, Gemini Omni, Veo 3.1, imagen a vídeo, Gemini API

---
Nano Banana no crea vídeos. Ninguna de sus versiones lo hace: Nano Banana 2 Lite, Nano Banana 2, Nano Banana Pro y el Nano Banana original son modelos de generación y edición de imágenes. Lo que sí puedes hacer es tomar la imagen que te dio Nano Banana y convertirla en un vídeo con otro modelo de Google.

A 22 de septiembre de 2026, esa ruta tiene un nombre: **Gemini Omni**. Google lo describe literalmente como «Nano Banana, pero para vídeo». En la app de Gemini está en **Menú → Vídeos**, admite hasta 5 imágenes de referencia y genera clips de 10 segundos con una suscripción a un plan de IA de Google. En la API se llama `gemini-omni-1.1-flash`, y **Veo 3.1** sigue existiendo para quien necesita fijar el primer y el último fotograma o extender escenas.

Si estás en España hay una condición que conviene conocer antes de empezar: en el Espacio Económico Europeo no se puede editar ni extender un vídeo que subas tú, ni en la app ni en la API. Generar un vídeo nuevo a partir de tu imagen sí funciona. El resto del artículo explica cada paso con esa condición a la vista.

## Lo que Nano Banana hace y lo que no

La documentación de la Gemini API lista cuatro modelos bajo el nombre Nano Banana, todos de imagen ([ai.google.dev, image generation](https://ai.google.dev/gemini-api/docs/image-generation), consultado el 22 de septiembre de 2026):

| Nombre comercial | ID de modelo | Para qué lo describe Google |
| --- | --- | --- |
| Nano Banana 2 Lite | `gemini-3.1-flash-lite-image` | El más rápido y barato |
| Nano Banana 2 | `gemini-3.1-flash-image` | Modelo generalista para el día a día |
| Nano Banana Pro | `gemini-3-pro-image` | Tareas visuales más complejas |
| Nano Banana (original) | `gemini-2.5-flash-image` | Versión anterior, aún disponible |

La única función que relaciona estos modelos con vídeo va en sentido contrario: los modelos 3.1 aceptan un vídeo como referencia para generar una imagen nueva. No existe ninguna opción de «animar esta imagen» dentro de Nano Banana.

Eso no convierte a Nano Banana en un paso inútil. En un proyecto de vídeo, Nano Banana resuelve la parte que más suele fallar: el primer fotograma. Un personaje con rostro y ropa fijados, un producto con logo y material correctos o un fondo limpio son cosas que se controlan mejor en imagen que pidiendo todo con texto a un modelo de vídeo. Si aún no dominas esa parte, la [guía de prompts para Nano Banana](https://blog.laozhang.ai/es/posts/how-to-prompt-nano-banana) cubre cómo fijar identidad y composición.

## En la app de Gemini: de tu imagen a un vídeo con Gemini Omni

Esta es la ruta para quien no quiere tocar código. La página de ayuda de Google en español ([Generar vídeos con las aplicaciones de Gemini](https://support.google.com/gemini/answer/16126339?hl=es)) describe los pasos así:

1. Abre gemini.google.com o la app móvil de Gemini con tu cuenta personal.
2. Arriba a la izquierda, toca **Menú** y luego **Vídeos**.
3. Elige una plantilla si quieres, o pasa directamente al cuadro de texto.
4. Usa **Añadir imagen** para subir la imagen de Nano Banana (puedes subir hasta 5 imágenes y 1 vídeo).
5. Escribe qué debe ocurrir: movimiento de cámara, acción, ambiente y, si lo quieres, el audio.
6. Toca **Enviar**. Google avisa de que el vídeo puede tardar unos minutos.

El resultado se puede guardar en el dispositivo, exportar o compartir en YouTube. Si algo no encaja, puedes seguir la conversación y pedir cambios concretos (quitar un objeto, cambiar un personaje, otro ángulo de cámara) sin volver a empezar.

Las condiciones que Google indica en sus propias páginas:

- **Plan de IA de Google.** Con cuenta personal, la función requiere suscripción. El nivel gratuito incluye generación y edición de imágenes, no vídeo.
- **Mayores de 18 años.** «De momento, esta función no está disponible para usuarios menores de 18 años.»
- **10 segundos por vídeo.** Es la duración que anuncia la página de producto en español.
- **Derechos sobre las fotos.** «Sube solo fotos que tengas derecho a usar.»
- **Marca de agua SynthID.** Todos los vídeos generados en la app incluyen esta marca invisible.
- **Sin cuota diaria publicada.** Google dice que los límites de uso de la app son «basados en cómputo» y que pueden aplicarse límites de frecuencia; no hay una cifra de vídeos al día.

Google también afirma, en la misma página de producto, que Gemini Omni sustituye a Veo 3.1 dentro de la app de Gemini. Eso habla de la app: la instrucción «pulsa el botón Vídeo y usa Veo 3», que circula desde 2025, corresponde a una interfaz que ya no es la actual. En la API, como verás a continuación, Veo 3.1 sigue documentado.

## Por API: Gemini Omni por defecto, Veo 3.1 cuando necesitas controlar fotogramas

La página de resumen de vídeo de la Gemini API es explícita: usa Gemini Omni Flash como modelo por defecto y recurre a Veo 3.1 solo para necesidades concretas como extender escenas o controlar fotogramas específicos ([ai.google.dev, video](https://ai.google.dev/gemini-api/docs/video)). Ambas rutas aceptan la imagen de Nano Banana como entrada; cambia el mecanismo.

### Con `gemini-omni-1.1-flash`

Omni usa la API de interacciones. La imagen se pasa como una parte más de la entrada y el texto describe qué debe pasar con ella:

```python
import base64
from google import genai

client = genai.Client()

with open("primer-fotograma.jpg", "rb") as f:
    imagen = base64.b64encode(f.read()).decode()

resultado = client.interactions.create(
    model="gemini-omni-1.1-flash",
    input=[
        {"type": "image", "data": imagen, "mime_type": "image/jpeg"},
        {"type": "text", "text": "Convierte esta imagen en metraje realista: "
                                 "travelling lento hacia el producto, luz de tarde, "
                                 "sonido ambiente de calle."},
    ],
    response_format={"type": "video", "aspect_ratio": "16:9", "resolution": "720p"},
)

with open("clip.mp4", "wb") as f:
    f.write(base64.b64decode(resultado.output_video.data))
```

Si quieres fijar inicio y final, envías dos imágenes y las etiquetas en el prompt con los marcadores `<FIRST_FRAME>` y `<LAST_FRAME>`, describiendo la transición entre ambas. Las imágenes también pueden actuar como referencias de personaje o de objeto. Resoluciones 360p, 720p (por defecto), 1080p y 4K (estas dos por escalado); formatos 16:9 y 9:16; el audio se genera por defecto. La extensión va en tramos de 10 segundos hasta 40 en total, y los vídeos subidos para editar o extender deben durar 10 segundos o menos. Los detalles de acceso, versión Cloud y límites están en la [guía de Gemini Omni 1.1 Flash para España](https://blog.laozhang.ai/es/posts/gemini-omni-api).

### Con `veo-3.1-generate-preview`

La documentación de Veo trae exactamente el flujo que buscas, con este orden en sus comentarios: «Step 1: Generate an image with Nano Banana 2. Step 2: Generate video with Veo 3.1 using the image.»

```python
import time
from google import genai

client = genai.Client()
prompt = "Plano general con paneo de un gato dormido al sol"

# Paso 1: imagen con Nano Banana 2
imagen = client.models.generate_content(
    model="gemini-3.1-flash-image",
    contents=prompt,
    config={"response_modalities": ["IMAGE"]},
)

# Paso 2: vídeo con Veo 3.1 a partir de esa imagen
operacion = client.models.generate_videos(
    model="veo-3.1-generate-preview",
    prompt=prompt,
    image=imagen.parts[0].as_image(),
)

while not operacion.done:
    time.sleep(10)
    operacion = client.operations.get(operacion)

video = operacion.response.generated_videos[0]
client.files.download(file=video.video, destination="veo-desde-nano-banana.mp4")
```

Veo 3.1 genera 4, 6 u 8 segundos (8 obligatorios para 1080p, 4K o cuando usas imágenes de referencia), admite hasta 3 imágenes de referencia, interpolación entre primer y último fotograma, audio nativo y extensión de 7 segundos hasta 20 veces sobre vídeos generados por el propio Veo (solo a 720p, y no en la variante Lite). Hay tres IDs: `veo-3.1-generate-preview`, `veo-3.1-fast-generate-preview` y `veo-3.1-lite-generate-preview`. Son modelos en vista previa y los IDs pueden cambiar.

### Cuál elegir

| Necesitas | Ruta | Motivo |
| --- | --- | --- |
| Animar una imagen y poder corregir por conversación | Gemini Omni | Es el modelo por defecto que recomienda Google; edición por turnos de conversación y extensión hasta 40 s |
| Fijar exactamente primer y último fotograma | Cualquiera de las dos | Omni con marcadores `<FIRST_FRAME>` / `<LAST_FRAME>`; Veo con interpolación |
| Clip corto y barato para probar | Veo 3.1 Lite o Fast | Precio por segundo más bajo (ver más abajo) |
| Extender un vídeo generado hasta 40 s | Gemini Omni | Omni extiende en tramos de 10 s hasta 40 s; Veo extiende en tramos de 7 s y solo a 720p |
| Rehacer el primer fotograma muchas veces antes de gastar en vídeo | Nano Banana primero | Un fotograma cuesta céntimos; un clip cuesta dólares |

Sobre el idioma del prompt: Google indica que el inglés está totalmente evaluado en Omni y que otros idiomas «pueden funcionar, pero los resultados pueden variar». Si el clip en español sale raro, prueba el mismo prompt en inglés antes de cambiar de modelo.

![Dos rutas de API para convertir la imagen de Nano Banana en vídeo: Gemini Omni y Veo 3.1, con sus parámetros clave](https://blog.laozhang.ai/posts/es/can-nano-banana-make-videos/img/rutas-api-omni-veo.webp)

## Cuánto cuesta en 2026

Precios de la página oficial de la Gemini API ([pricing](https://ai.google.dev/gemini-api/docs/pricing)), capa de pago, en dólares estadounidenses, a 22 de septiembre de 2026. **Ninguno de estos modelos tiene nivel gratuito en la API.**

| Modelo | Precio | Equivalente aproximado según Google |
| --- | --- | --- |
| `gemini-omni-1.1-flash` (salida de vídeo) | 17,50 USD por millón de tokens | ≈ 0,10 USD por segundo a 720p |
| Veo 3.1 estándar, con audio | 0,40 USD/s (720p y 1080p) · 0,60 USD/s (4K) | — |
| Veo 3.1 Fast, con audio | 0,10 USD/s (720p) hasta 0,30 USD/s (4K) | — |
| Veo 3.1 Lite, con audio | 0,05 USD/s (720p) · 0,08 USD/s (1080p) | — |
| Nano Banana 2 (`gemini-3.1-flash-image`) | 60 USD por millón de tokens | ≈ 0,067 USD por imagen 1K |
| Nano Banana Pro (`gemini-3-pro-image`) | 120 USD por millón de tokens | ≈ 0,134 USD por imagen 1K/2K |

Un cálculo orientativo con esas cifras: una imagen de Nano Banana 2 más un clip de 10 segundos a 720p en Omni ronda 0,07 + 1,00 = **1,07 USD**. El mismo fotograma con Veo 3.1 estándar a 8 segundos sale por 0,07 + 3,20 = **3,27 USD**; con Veo 3.1 Lite a 720p, 0,07 + 0,40 = **0,47 USD**. Son estimaciones a partir de las equivalencias que publica Google, no facturas reales; Google no da un precio por segundo de Omni a 1080p ni 4K. Para un desglose de Veo con créditos de Flow y Cloud, está la [guía de precios de Veo 3](https://blog.laozhang.ai/es/posts/veo-3-price).

Para la app de Gemini, lo que pagas es el plan. Como referencia, la página de planes de Google para Estados Unidos ([gemini.google/subscriptions](https://gemini.google/subscriptions/?hl=en)) muestra a 22 de septiembre de 2026: Free 0 USD con generación y edición de imágenes; Google AI Plus 4,99 USD/mes con 200 créditos de Flow y acceso a Gemini Omni Flash; Google AI Pro 19,99 USD/mes con 1.000 créditos; Google AI Ultra desde 99,99 USD/mes con 10.000 créditos y «primer acceso» a funciones como la generación con Veo 3.1. Google advierte de que los precios y funciones varían por país, así que no conviertas estas cifras a euros: mira la página de planes desde tu cuenta en España antes de suscribirte. Los precios en euros de Plus, Pro y Ultra y lo que cambia cada plan están en [Precio de Nano Banana 2: qué plan de Google AI pagas en España](https://blog.laozhang.ai/es/posts/nano-banana-2-subscription-price).

## Lo que cambia si estás en España

- **No puedes editar ni extender un vídeo que subas.** La documentación de Omni lo dice tal cual: «Editing or extending uploaded videos is not currently available for users in the European Economic Area (EEA), Switzerland, and the United Kingdom». La ayuda de la app en español repite la restricción: «La subida de vídeos para usarlos en ediciones de vídeo no está disponible en el EEE, el Reino Unido, Suiza y algunos estados de EE. UU.» Si tu plan era grabar un clip con el móvil y pedir a Gemini que lo alargue, en España hoy no es posible.
- **Generar desde imagen sí está disponible.** La restricción afecta a vídeos subidos, no a imágenes subidas ni a vídeos generados por el propio modelo. Convertir la imagen de Nano Banana en un clip nuevo y luego pedir cambios sobre ese clip generado es un flujo distinto del bloqueado.
- **Extender un vídeo generado por Omni** es un caso aparte del vídeo subido y está contemplado en la documentación; verifica con tu cuenta, porque los despliegues por región y por plan no son simultáneos.
- **Funciones por nivel y región.** La página de producto en español dice que las funciones «varían según el nivel y la región». Lo que ves en un vídeo de YouTube grabado desde Latinoamérica o Estados Unidos puede no coincidir con tu menú.

![Condiciones de Gemini Omni para usuarios en España: qué funciona y qué está bloqueado en el EEE](https://blog.laozhang.ai/posts/es/can-nano-banana-make-videos/img/condiciones-espana-eee.webp)

## Cómo leer una web «Nano Banana video generator»

Las webs que se presentan como «Nano Banana video generator» son servicios de terceros con nombres parecidos al del modelo. No son de Google y, en general, no ocultan que usan otros motores, pero hay que saber dónde mirar.

nanobanana.io/text-to-video, consultado el 22 de septiembre de 2026, se presenta como «un modelo de vídeo de IA de nueva generación», y su selector de modelos lista Veo 3.1, Sora 2 y Sora 2 Pro, Kling 2.6 y 3.0, Seedance 2.0 y 2.5, Pixverse V6 y Minimax H3. Cobra 5 créditos por generación, ofrece de 480p a 4K y 6 segundos por defecto. El logo de Google aparece solo para iniciar sesión. Otras webs del mismo tipo listan Gemini Omni, Seedance, Wan, Veo, Kling o Grok Imagine como motores seleccionables.

Es decir, «Nano Banana video» en esas webs significa «te dejamos elegir un modelo de vídeo y, quizá, generar la imagen previa con Nano Banana». Antes de pagar créditos, comprueba tres cosas:

1. **Qué motor genera el vídeo.** Si el selector lo dice, ya sabes qué límites y qué calidad esperar; si no lo dice, pídelo al soporte.
2. **Qué te llevas.** Duración, resolución real, marca de agua propia además de la del modelo, y si el uso comercial está incluido en el plan.
3. **Si te compensa frente a la ruta oficial.** Con los precios de arriba puedes comparar lo que te cuestan los créditos de esa web con lo que costaría el mismo clip en la API o con un plan de IA de Google.

Para una comparación de herramientas de imagen a vídeo hecha con ese criterio, consulta [los mejores generadores de imagen a vídeo](https://blog.laozhang.ai/es/posts/best-ai-image-to-video-generator) o, si buscas empezar sin pagar, [IA gratis de foto a vídeo](https://blog.laozhang.ai/es/posts/best-free-image-to-video-ai).

## Si vas a producir muchos fotogramas antes del vídeo

La parte de vídeo tiene sentido hacerla en las rutas oficiales de Google descritas arriba. La parte de imagen, en cambio, admite otra opción cuando generas decenas de primeros fotogramas y quieres una sola clave: laozhang.ai publica los cuatro IDs de Nano Banana con precio por imagen (según su documentación, `gemini-3.1-flash-image` 0,055 USD, `gemini-3-pro-image` 0,09 USD, `gemini-3.1-flash-lite-image` y `gemini-2.5-flash-image` 0,025 USD), con base `https://api2.laozhang.ai` y dos formatos de llamada: `/v1/chat/completions` compatible con OpenAI y el nativo de Google `/v1beta/models/gemini-3-pro-image:generateContent`. Para vídeo, sus páginas documentan Seedance con imagen como `first_frame` o `last_frame`, Sora 2 y Wan 2.7 mediante tareas asíncronas; para Veo 3.1 y Gemini Omni su documentación no publica precio ni página, así que para esos dos modelos usa la API de Google directamente. Cómo montar la llamada de imagen está en la [guía de la API de Nano Banana Pro](https://blog.laozhang.ai/es/posts/nano-banana-pro-api-guide).

## Preguntas frecuentes

### ¿Nano Banana puede crear vídeos por sí solo?

No. Los cuatro modelos Nano Banana (`gemini-3.1-flash-lite-image`, `gemini-3.1-flash-image`, `gemini-3-pro-image` y `gemini-2.5-flash-image`) generan y editan imágenes. Para obtener un vídeo hay que pasar la imagen a Gemini Omni o a Veo 3.1.

### ¿Puedo usar mi propia foto en lugar de una imagen generada?

Sí. En la app de Gemini, **Añadir imagen** admite hasta 5 imágenes, y en la API la imagen se envía como parte de la entrada igual que una generada. Google pide que subas solo fotos sobre las que tengas derechos.

### ¿Por qué no puedo editar el clip que subí desde España?

Porque la edición y extensión de vídeos subidos no está disponible en el EEE, Suiza y Reino Unido, tanto en la app como en la API. Generar un vídeo nuevo a partir de una imagen sí funciona.

### ¿Veo 3.1 ha desaparecido?

No. Google dice que Gemini Omni sustituye a Veo dentro de la app de Gemini, pero la Gemini API mantiene documentados `veo-3.1-generate-preview`, `veo-3.1-fast-generate-preview` y `veo-3.1-lite-generate-preview`, y el plan Ultra de Estados Unidos sigue citando la generación con Veo 3.1.

### ¿Se puede crear un vídeo con Nano Banana gratis?

En la app de Gemini, el vídeo requiere un plan de IA de Google de pago; la capa gratuita cubre imágenes. En la API, ni Omni ni Veo 3.1 tienen nivel gratuito. Lo que sí incluye el nivel gratuito de la API está en [Gemini API free tier](https://blog.laozhang.ai/es/posts/gemini-api-free-tier). Las webs que prometen «Nano Banana video gratis» suelen dar unos créditos iniciales de otro motor, no acceso a Google sin coste.

### ¿Cuánto dura un vídeo generado a partir de una imagen de Nano Banana?

En la app de Gemini, 10 segundos. En la API, Omni genera clips que se pueden extender en tramos de 10 segundos hasta 40, y Veo 3.1 genera 4, 6 u 8 segundos, extensibles a 720p sobre vídeos generados por el propio Veo.
