# Gemini API de pago con free_tier_requests limit 0: cómo recuperar las llamadas

> Detén los reintentos si el límite aplicado es 0. Comprueba qué clave y proyecto usa la petición, resuelve el requisito de facturación pendiente y valida el mismo modelo desde el proceso que fallaba.

- URL: https://blog.laozhang.ai/es/posts/paid-tier-getting-free-tier-requests-limit-0
- Published: 2026-10-05
- Updated: 2026-10-05
- Author: LaoZhang AI Team (https://blog.laozhang.ai/es/about)
- Category: Guías de API
- Tags: Gemini API, Google AI Studio, Facturación, 429, Cuotas

---
Pagar por Gemini API no basta si la petición sale con una clave de otro proyecto o si la configuración de facturación sigue pendiente. **Ante `free_tier_requests` y `limit: 0`, pausa los reintentos automáticos y comprueba la clave que utiliza el proceso que falla, su proyecto y el modelo exacto.** Si detectas un desajuste, corrige esa configuración; si AI Studio pide completar la facturación, atiende ese requisito en la cuenta correspondiente. Después valida una llamada pequeña desde el mismo proceso, antes de recuperar toda la cola.

Si la clave pertenece al proyecto correcto, la facturación está operativa y AI Studio muestra cuota positiva para ese modelo, conserva la discrepancia y solicita ayuda. Un retraso de reintento no convierte un límite de 0 en capacidad disponible. Esta guía se basa en la documentación pública consultada el **5 de octubre de 2026**; las comprobaciones de tu cuenta y la llamada de validación las debes realizar en tu entorno.

| Lo que encuentras | Qué hacer ahora | Qué confirma la recuperación |
| --- | --- | --- |
| El proceso usa una clave de otro proyecto | Seleccionar la credencial del proyecto previsto y reiniciar el proceso que la carga | La misma operación funciona y el uso aparece en el proyecto esperado |
| El proyecto muestra `Set up billing`, `Set up Prepay` o `No credits` | Resolver el requisito que indica AI Studio con el responsable de facturación | Desaparece el requisito, el estado permite servir peticiones y existe cuota para el modelo |
| Se acaba de confirmar el pago o un cambio de nivel | Esperar el procesamiento y volver a consultar estado y cuota | El proyecto refleja el cambio y la petición del modelo funciona |
| Proyecto, facturación y modelo coinciden, pero persiste el límite gratuito 0 | Detener el bucle y preparar un caso con el error completo, sin secretos | Se explica o corrige la discrepancia y pasa la misma prueba |
| El límite activo es positivo y se ha agotado una ventana de uso | Reducir carga o esperar la ventana que corresponda a la métrica | Vuelve a haber margen y las peticiones terminan sin recrear el pico |

## Qué significa el 0 y qué debes conservar del error

La combinación de una métrica gratuita y `limit: 0` identifica el límite que la respuesta dice estar aplicando. **No demuestra por sí sola por qué se aplicó, cuánto has consumido ni que Google haya rebajado tu cuenta de pago.** Un proyecto con cuota positiva agotada y un modelo al que se aplica una cuota de cero necesitan acciones distintas.

Guarda el cuerpo completo de la respuesta, además del HTTP `429` y `RESOURCE_EXHAUSTED`. Cuando estén presentes, busca `quotaMetric`, `quotaId`, `quotaDimensions`, el modelo y la ubicación. Esos campos permiten relacionar el fallo con la vista de cuota. No conviertas un campo llamado `quotaValue` en un contador de consumo sin conocer el formato concreto que devuelve tu servicio.

Anota también la hora y zona horaria, el endpoint, la versión de API, el método, la versión del cliente y el identificador de petición si existe. Un mensaje abreviado de un framework puede esconder la dimensión que explica el rechazo. Conserva los datos de diagnóstico sin la clave, cabeceras de autenticación ni contenido privado del usuario.

Si la respuesta incluye `RetryInfo` o un retraso sugerido, léelo junto a las cuotas infringidas: el tiempo indica cuándo podría intentarse otra petición; **no acredita que, pasado ese tiempo, se conceda una cuota que ahora vale cero**. La [guía oficial de solución de problemas](https://ai.google.dev/gemini-api/docs/troubleshooting) recomienda reintentos acotados para errores transitorios y distingue los errores que requieren corregir configuración o pago.

## Comprueba la clave que usa la aplicación, no solo la que ves en AI Studio

Abre [API keys de Google AI Studio](https://aistudio.google.com/api-keys) y localiza el proyecto asociado a la credencial que debería usar tu aplicación. Cada clave pertenece a un proyecto; no tiene una facturación independiente. Las claves heredan el nivel y el estado de facturación de su proyecto, según la [documentación de facturación](https://ai.google.dev/gemini-api/docs/billing).

Ahora comprueba el origen de la credencial en el **proceso que recibió el 429**. Puede ser una variable de entorno, una clave pasada explícitamente al cliente, un gestor de secretos o la configuración de un framework. Un terminal nuevo y un servidor que lleva horas ejecutándose pueden leer valores distintos.

![Diagrama para seguir la credencial que carga el proceso hasta su proyecto, distinguiendo variables de entorno y configuración explícita.](https://blog.laozhang.ai/posts/es/paid-tier-getting-free-tier-requests-limit-0/img/runtime-key-project.webp)

En las bibliotecas que detectan las variables de Google, **`GOOGLE_API_KEY` tiene prioridad sobre `GEMINI_API_KEY` si ambas están configuradas**. Si actualizas solo la segunda, la primera puede seguir seleccionando la credencial anterior. Google documenta esa prioridad en su [guía de claves](https://ai.google.dev/gemini-api/docs/api-key).

Este pequeño diagnóstico de Python usa únicamente la biblioteca estándar y no realiza llamadas. Puedes ejecutarlo dentro del entorno del servidor o incorporar sus comprobaciones al inicio del proceso para comparar la configuración sin imprimir el secreto:

```python
import hashlib
import os

names = ("GOOGLE_API_KEY", "GEMINI_API_KEY")
for name in names:
    value = os.environ.get(name)
    print(f"{name}: {'configurada' if value else 'ausente'}")

selected = next((name for name in names if os.environ.get(name)), None)
if selected:
    value = os.environ[selected]
    fingerprint = hashlib.sha256(value.encode()).hexdigest()[:12]
    print(f"Selección por variables: {selected}; huella: {fingerprint}")
else:
    print("No hay clave en estas variables; revisa la configuración del cliente.")
```

La huella permite comparar dos entornos; **no revela el proyecto ni detecta una clave que se pasa explícitamente al cliente**. Si el framework utiliza otra configuración, comprueba esa fuente. Mantén la huella en tus registros internos y coteja la credencial mediante el gestor de secretos o la consola, sin publicarla.

Si confirmas que el servicio carga una clave equivocada, actualiza su configuración con la credencial del proyecto previsto. Reinicia o vuelve a desplegar ese servicio para que lea el cambio; en Windows, las variables persistentes requieren abrir una sesión de terminal nueva. No borres una variable ni revoques una clave que comparten otros servicios sin revisar sus dependencias.

Crear otra clave dentro del mismo proyecto no concede un cupo de pago adicional. Google aplica los [límites por proyecto, no por clave](https://ai.google.dev/gemini-api/docs/rate-limits). La sustitución de una clave corresponde a un problema de credencial demostrado, por ejemplo una filtración o un bloqueo, no al simple hecho de recibir este 429.

### ¿La llamada pertenece realmente a Gemini Developer API?

Comprueba el hostname o la configuración del proveedor. La ruta directa de Developer API utiliza `generativelanguage.googleapis.com`; una llamada a `aiplatform.googleapis.com` pertenece a la ruta de Google Cloud y necesita su propio diagnóstico de proyecto, identidad y capacidad. Si utilizas un intermediario, su clave tampoco identifica automáticamente un proyecto tuyo de AI Studio.

Para resolver una confusión entre servicios, consulta la [comparación de Gemini Developer API y Vertex AI](https://blog.laozhang.ai/es/posts/gemini-api-vs-vertex-api). Cambiar de servicio exige comprobar el destino y no garantiza que desaparezca el problema de capacidad.

## Revisa Billing Tier y Status en el proyecto correcto

En [Projects de AI Studio](https://aistudio.google.com/projects), selecciona el proyecto que posee la clave real. Consulta las columnas `Billing Tier` y `Status`; después abre [Billing](https://aistudio.google.com/billing) para revisar la cuenta vinculada y el plan asignado. Estas entradas y etiquetas están descritas en la [guía oficial de facturación](https://ai.google.dev/gemini-api/docs/billing); el flujo disponible depende de tu cuenta.

| Estado o aviso | Significado documentado | Acción que afecta al requisito |
| --- | --- | --- |
| `Set up billing` | El proyecto no tiene una cuenta de facturación vinculada | El responsable debe completar la vinculación de ese proyecto |
| `Set up Prepay` | Existe una cuenta vinculada, pero falta configurar el plan Prepay exigido | Completar el flujo pendiente en la cuenta correspondiente |
| `No credits` | Falta preparar el pago anticipado o se ha agotado el saldo | Revisar el plan y el saldo; añadir créditos si esa es la condición pendiente |
| Cuenta inactiva o no admitida | El tipo o estado de la cuenta impide acceder al nivel de pago | Revisar el aviso y el estado en Cloud Billing con su responsable |
| Saldo positivo pero servicio detenido | Puede existir un tope de gasto o un problema de la cuenta de Cloud | Identificar el control concreto antes de pagar más o elevar límites |

No confundas una tarjeta guardada, una suscripción de consumo de Google o un pago en otra cuenta con la facturación del proyecto que llama a Developer API. El vínculo entre **clave, proyecto y cuenta de facturación** es lo que debes acreditar.

En una cuenta asignada a Prepay, Google exige saldo utilizable para servir peticiones. **Al llegar a cero, la suspensión documentada produce HTTP `402 Payment Required`; los proyectos no vuelven automáticamente al nivel gratuito.** Por tanto, no atribuyas un `free_tier_requests limit: 0` al saldo agotado sin contrastar ambos estados. Si aparece un 402, corrige la condición de pago indicada y detén los reintentos mientras siga pendiente. [Comportamiento de Prepay y saldo cero](https://ai.google.dev/gemini-api/docs/billing).

Si comenzaste una transición a Prepay y la abandonaste tras confirmar el cambio, la documentación indica que la cuenta puede quedar sin posibilidad de cobrar. Las opciones son completar el flujo o contactar con soporte de Cloud Billing; cerrar el diálogo no revierte automáticamente el estado. Evita desvincular y volver a vincular proyectos como arreglo genérico.

### Cuándo tiene sentido esperar después de pagar

Espera cuando hay un cambio real pendiente de procesamiento. La guía de facturación describe actualizaciones de nivel que suelen reflejarse en unos diez minutos **después de un pago confirmado o de cumplir los requisitos**. Algunos pagos, como transferencias bancarias, pueden tardar días en confirmarse; los gráficos de costes también pueden actualizarse con retraso. Son tiempos de procesamiento documentados, no una garantía de recuperación a los cinco o diez minutos. [Tiempos de procesamiento](https://ai.google.dev/gemini-api/docs/billing).

Durante esa espera, revisa el estado y la cuota en vez de mantener una cola de llamadas fallidas. Si el cambio ya está confirmado y sigue habiendo una contradicción entre el panel y la petición, pasa a la comprobación del modelo y al caso de soporte.

## Si el texto funciona pero las imágenes fallan, comprueba el modelo

Que un modelo de texto responda demuestra que esa operación tiene acceso; no acredita la capacidad del modelo de imágenes. Copia el **ID exacto** que utiliza tu código y comprueba su disponibilidad, la modalidad y la versión de API.

A 5 de octubre de 2026, las tablas oficiales de `gemini-3.1-flash-image`, `gemini-3.1-flash-lite-image` y `gemini-3-pro-image` muestran **“Not available” en Free Tier para entrada y salida**. Si la petición de imagen se evalúa en el nivel gratuito, no puedes resolver esa ausencia esperando al siguiente día: debes corregir el acceso de pago que corresponda. Consulta las fichas de [Flash Image](https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-image), [Flash Lite Image](https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite-image) y [Pro Image](https://ai.google.dev/gemini-api/docs/pricing#gemini-3-pro-image).

Revisa también ejemplos antiguos. La documentación de `gemini-2.5-flash-image` fijó su retirada para el **2 de octubre de 2026** y señala Flash Image y Flash Lite Image como destinos de migración. Esa fecha documentada no prueba que la retirada explique tu 429 concreto; sí impide tratar ese ejemplo antiguo como una selección actual sin comprobar la ruta. [Aviso de retirada](https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-image).

Finalmente, abre los [límites activos de AI Studio](https://aistudio.google.com/rate-limit) para **el mismo proyecto y modelo**. Revisa peticiones por minuto, tokens de entrada por minuto, peticiones por día y las dimensiones específicas que aparezcan. La [documentación oficial de límites](https://ai.google.dev/gemini-api/docs/rate-limits) advierte de que la capacidad indicada no está garantizada. Una tabla histórica de niveles no sustituye esta consulta.

## Detén el bucle de reintentos si falta capacidad aplicable

![Decisiones de recuperación según el estado de facturación, el modelo y la cuota activa, con validación antes de recuperar la cola.](https://blog.laozhang.ai/posts/es/paid-tier-getting-free-tier-requests-limit-0/img/billing-model-recovery.webp)

Usa el error y el estado activo para decidir qué puede cambiar con el tiempo:

- **Límite 0 sin resolver:** detén el bucle. Corrige credencial, proyecto, requisito de facturación o acceso al modelo; si todo coincide, conserva la discrepancia para soporte.
- **Cuota positiva agotada por un pico:** reduce concurrencia y aplica espera exponencial acotada con variación aleatoria. Comprueba que no estás sumando reintentos del SDK y del framework a otro bucle externo.
- **Peticiones diarias agotadas:** espera el reinicio documentado a medianoche del Pacífico, si esa es la métrica infringida. El reinicio de un contador no crea acceso gratuito a un modelo que no lo ofrece.
- **Límite de gasto en ventana móvil:** reduce la frecuencia de peticiones costosas y deja transcurrir la ventana correspondiente. Este control es distinto del saldo Prepay y del tope mensual.
- **402, 403 o una configuración inválida:** resuelve el requisito indicado; no añadas reintentos temporales. Para 403, sigue la [guía de permisos y credenciales de Gemini API](https://blog.laozhang.ai/es/posts/gemini-api-key-permission-denied).

Estas decisiones se apoyan en las guías de [límites](https://ai.google.dev/gemini-api/docs/rate-limits) y [reintentos](https://ai.google.dev/gemini-api/docs/troubleshooting). Si el error cambia a `503 UNAVAILABLE`, la nueva respuesta requiere evaluar indisponibilidad temporal. El cambio de código no confirma que la generación haya terminado ni que se esté usando cuota de pago.

## Cómo comprobar que puedes recuperar la cola

Después de corregir el desajuste o de que se complete el requisito pendiente, realiza **una prueba pequeña con el mismo modelo y desde el proceso que fallaba**. Puede generar cargos: elige una entrada sin datos sensibles y un resultado reducido que conserve la función afectada. Para un fallo de imágenes, una respuesta de texto no sustituye la validación de la salida de imagen.

Comprueba que llega el resultado esperado y que el uso se registra en el proyecto previsto, teniendo en cuenta los retrasos de los paneles. Recupera la cola gradualmente, con la concurrencia que permite la cuota activa y sin reenviar trabajos ya completados. Conserva el error anterior y el cambio que permitió resolverlo.

Si el panel sigue mostrando un estado operativo y cuota positiva, pero la llamada utiliza una métrica gratuita con límite cero, prepara para soporte:

- ID del proyecto, modelo exacto, endpoint, versión de API y método;
- hora del fallo y zona horaria, error completo saneado e identificador de petición;
- versión del SDK o framework y entorno donde ocurre;
- estado de facturación y cuota del mismo proyecto y modelo;
- fecha de confirmación del cambio, última llamada correcta y resultado de la prueba pequeña.

Usa el [foro de desarrolladores de Google](https://discuss.ai.google.dev/) para problemas técnicos o el soporte de Cloud Billing indicado en la [guía de facturación](https://ai.google.dev/gemini-api/docs/billing) para estados de pago. Comparte datos del proyecto por el canal apropiado; nunca envíes la clave ni un volcado completo del entorno. Mientras se investiga, puedes mantener en pausa la tarea afectada o probar otra ruta disponible cuya función, coste y cuota hayas comprobado. Ninguna alternativa garantiza continuidad sin esa validación.

## Preguntas frecuentes

### ¿Crear una clave nueva elimina free_tier_requests limit 0?

Solo si corrige un problema real de credencial o de proyecto. Las claves del mismo proyecto heredan su facturación y comparten límites; crear otra no multiplica la cuota. Primero identifica qué clave usa el proceso. [Facturación de claves y proyectos](https://ai.google.dev/gemini-api/docs/billing).

### ¿Por qué sigue apareciendo Free Tier si ya he pagado?

La aplicación puede usar una credencial de otro proyecto, faltar un paso del plan asignado o seguir pendiente el procesamiento del cambio. También puede existir una discrepancia que estas comprobaciones no expliquen. Coteja la clave del proceso con Projects, Billing y la cuota del modelo; el recibo de un pago aislado no identifica la petición.

### ¿Esperar al restablecimiento diario arregla un límite de 0?

No concede una cuota inexistente. El reinicio de RPD a medianoche del Pacífico sirve cuando has consumido una asignación diaria positiva. Si el modelo no ofrece Free Tier o la petición sigue usando el proyecto equivocado, debes resolver esa condición. [Reglas de RPD](https://ai.google.dev/gemini-api/docs/rate-limits).

### ¿Quedarse sin saldo Prepay devuelve el proyecto al nivel gratuito?

No. Google documenta una parada con HTTP 402 y aclara que no hay regreso automático al nivel gratuito. Revisa el saldo y el estado de la cuenta; un error gratuito 0 requiere además contrastar la credencial, el proyecto y el modelo. [Saldo Prepay agotado](https://ai.google.dev/gemini-api/docs/billing).
