# Precio de la API de Grok: tarifas de grok-4.7, 4.3 y Build

> grok-4.7 cuesta 2 $ por millón de tokens de entrada y 6 $ de salida; grok-4.3, 1,25 $ y 2,50 $. Desde 200K tokens de entrada, toda la solicitud paga el doble.

- URL: https://blog.laozhang.ai/es/posts/xai-grok-api-pricing
- Published: 2026-07-02
- Updated: 2026-09-26
- Author: LaoZhang AI Team (https://blog.laozhang.ai/es/about)
- Category: Precios de API
- Tags: Grok API, xAI, Precios API, Grok 4.7, Grok 4.3

---
**`grok-4.7`, el modelo insignia de xAI, cuesta 2 $ por millón de tokens de entrada, 0,50 $ por millón de entrada en caché y 6 $ por millón de salida.** Si buscas algo más barato, `grok-4.3` cobra 1,25 / 0,20 / 2,50 $ y admite hasta un millón de tokens de contexto; para agentes de programación, `grok-build-0.1` cobra 1 / 0,20 / 2 $. Son las tarifas de contexto corto de la [tabla oficial de precios de xAI](https://docs.x.ai/developers/pricing), vigentes a 26 de septiembre de 2026 (xAI la actualizó por última vez el 21 de septiembre).

El precio por millón es solo el punto de partida. Cuatro reglas pueden duplicar o recortar la factura:

- Cuando la entrada de una solicitud llega a 200.000 tokens, **toda** la solicitud se cobra a tarifa de contexto largo, que es el doble.
- `grok-4.7` no admite la API Batch. El 20 % de Batch solo se aplica a `grok-4.3` y a la familia `grok-4.20`.
- Priority multiplica por 2 el coste de los tokens y el endpoint regional de EE. UU., por 1,1.
- Las herramientas del servidor (búsqueda web, ejecución de código, colecciones) se pagan por cada 1.000 llamadas, además de los tokens.

Las páginas oficiales de la API no listan ningún nivel gratuito, y SuperGrok o X Premium son suscripciones de la app que se pagan aparte.

## Tarifas de la API de Grok por modelo

Importes en **USD por millón de tokens**, en el orden entrada / entrada en caché / salida. La columna «≥ 200K» se aplica a toda la solicitud cuando la entrada alcanza ese tamaño.

| Modelo | Uso principal | Contexto | Entrada < 200K | Entrada ≥ 200K | Batch |
|---|---|---|---|---|---|
| `grok-4.7` | Insignia: código, agentes y uso general | 500K | 2 / 0,50 / 6 | 4 / 1 / 12 | No compatible |
| `grok-build-0.1` | Programación con agentes | 256K | 1 / 0,20 / 2 | 2 / 0,40 / 4 | No compatible |
| `grok-4.3` | Modelo general más económico | 1M | 1,25 / 0,20 / 2,50 | 2,50 / 0,40 / 5 | −20 % |
| `grok-4.20-0309-reasoning` | Generación anterior | 1M | 1,25 / 0,20 / 2,50 | 2,50 / 0,40 / 5 | −20 % |
| `grok-4.20-0309-non-reasoning` | Generación anterior | 1M | 1,25 / 0,20 / 2,50 | 2,50 / 0,40 / 5 | −20 % |
| `grok-4.20-multi-agent-0309` | Generación anterior, multiagente | 1M | 1,25 / 0,20 / 2,50 | 2,50 / 0,40 / 5 | −20 % |
| `grok-4.6` | Insignia anterior | 500K | 2 / 0,50 / 6 | 4 / 1 / 12 | Sin descuento |
| `grok-4.5` | Insignia anterior | 500K | 2 / 0,30 / 6 | 4 / 0,60 / 12 | Sin descuento |

Fuente: [precios de la API de xAI](https://docs.x.ai/developers/pricing) y [catálogo de modelos](https://docs.x.ai/developers/models), a 26 de septiembre de 2026.

Cómo leer la tabla para elegir:

- **`grok-4.7`** es el modelo que xAI recomienda «para código y todo lo demás», con llamada a herramientas y razonamiento configurable. Si hoy usas `grok-4.6`, pasar a 4.7 no cambia el precio.
- **`grok-4.3`** cuesta un 37,5 % menos en entrada y un 58 % menos en salida que 4.7, tiene el doble de contexto y acepta la API Batch con un 20 % de descuento, algo que 4.7 no permite. Tiene sentido cuando el volumen pesa más que la última mejora de calidad. Los detalles del modelo están en la [Guía de API de Grok 4.3: modelo, precios, migración y pruebas](https://blog.laozhang.ai/es/posts/grok-4-3).
- **`grok-build-0.1`** es el más barato por token de toda la tabla, pero está pensado para tareas de ingeniería de software con agentes. Los identificadores antiguos `grok-code-fast-1`, `grok-code-fast` y `grok-code-fast-1-0825` son alias de este modelo según su [ficha oficial](https://docs.x.ai/developers/models/grok-build-0.1): si tu código aún los llama, ya pagas las tarifas de `grok-build-0.1`.
- **`grok-4.5`** solo es más barato que 4.7 en la entrada en caché (0,30 $ frente a 0,50 $); el resto de tarifas coincide.

Existe también Grok 4.7 Fast, el mismo modelo en infraestructura más rápida a 4 / 1 / 12 $ (6 / 1,50 / 18 $ en contexto largo). Solo se ofrece dentro de Cursor y Grok Build, no en la API pública, así que no lo uses para presupuestar llamadas directas a `api.x.ai`.

## Las reglas que cambian la factura

### Desde 200.000 tokens de entrada, toda la solicitud paga el doble

La tabla oficial lo dice sin ambigüedad: los modelos con precio de contexto largo facturan **todos los tokens** de la solicitud a esa tarifa en cuanto la entrada alcanza el umbral de 200K. No se cobra doble solo la parte que excede; se dobla la entrada, la caché y la salida de esa solicitud.

Ejemplo con una solicitud de 300.000 tokens de entrada y 10.000 de salida:

```text
grok-4.7, tarifa larga:         0,3 × 4 $    + 0,01 × 12 $ = 1,32 $
grok-4.7, tarifa corta (error): 0,3 × 2 $    + 0,01 × 6 $  = 0,66 $
grok-4.3, tarifa larga:         0,3 × 2,50 $ + 0,01 × 5 $  = 0,80 $
```

![Coste de una solicitud de 300.000 tokens de entrada y 10.000 de salida: 1,32 $ en grok-4.7 con tarifa larga, 0,66 $ si se calcula mal con la tarifa corta y 0,80 $ en grok-4.3](https://blog.laozhang.ai/posts/es/xai-grok-api-pricing/img/contexto-largo.webp)

Quien presupueste con la tarifa corta se quedará en la mitad del coste real. Ten en cuenta que la ventana de contexto y el umbral de precio son cosas distintas: `grok-4.3` acepta hasta un millón de tokens, pero también paga tarifa larga desde 200K. En `grok-build-0.1`, con 256K de ventana, el tramo caro va de 200K a 256K.

Si tu aplicación acumula historial de conversación o fragmentos de documentos, recortar la entrada para quedarte por debajo de 200.000 tokens reduce a la mitad el precio de cada solicitud afectada. Cuando las solicitudes largas son inevitables, `grok-4.3` sale más barato que 4.7 con los mismos tokens.

### Batch, Priority y el endpoint de EE. UU.

Estas tres modalidades multiplican el subtotal de tokens; no afectan a las herramientas ni al almacenamiento.

| Modalidad | Factor sobre los tokens | Dónde se aplica | Condición |
|---|---|---|---|
| Standard | × 1 | Todos | Respuesta inmediata |
| Batch | × 0,8 | `grok-4.3` y familia `grok-4.20` | Resultado normalmente en menos de 24 h |
| Priority | × 2 | Chat Completions y Responses | Solo si la respuesta confirma `"service_tier": "priority"` |
| Endpoint de EE. UU. | × 1,1 | `grok-4.7` y `grok-4.6` | Inferencia en Estados Unidos |

**Batch.** El [descuento de la API Batch](https://docs.x.ai/developers/pricing#batch-api-pricing) varía por modelo: es del 20 % para `grok-4.3` y las tres variantes `grok-4.20`, y se aplica a todos los tipos de token. «Los modelos no listados no tienen descuento Batch». En el caso de `grok-4.7` y `grok-build-0.1` la limitación es mayor: sus fichas indican que la API Batch no es compatible, de modo que esos trabajos diferidos tendrían que ir a `grok-4.3` u otro modelo de la familia 4.20. No apliques el 50 % que ofrecen otros proveedores. Las solicitudes Batch no cuentan para los límites de velocidad; las imágenes y vídeos enviados por Batch se cobran a precio estándar.

**Priority.** El procesamiento prioritario cobra el doble en entrada, caché, salida y razonamiento; el descuento de caché se aplica antes del multiplicador. Si la respuesta vuelve atendida en el nivel normal, se cobra la tarifa estándar. No está disponible para imágenes, vídeo ni Batch.

**Endpoint de EE. UU.** Las solicitudes a `https://us.api.x.ai/v1` se ejecutan en Estados Unidos y pagan un 10 % más. Para `grok-4.7` quedan en 2,20 / 0,55 / 6,60 $ por debajo de 200K y 4,40 / 1,10 / 13,20 $ por encima. Si no necesitas que la inferencia ocurra en EE. UU., el endpoint global `https://api.x.ai/v1` es más barato.

### Herramientas, almacenamiento y otros cargos

Cuando Grok usa herramientas del servidor, pagas los tokens que procesa y, además, cada invocación. El modelo decide cuántas veces llama a una herramienta, así que el coste crece con la complejidad de la consulta.

| Herramienta | Nombre en la API | Precio |
|---|---|---:|
| Búsqueda web (incluye búsqueda de imágenes) | `web_search` | 5 $ por 1.000 llamadas |
| Búsqueda en X | `x_search` | 5 $ por 1.000 posts; 10 $ por 1.000 perfiles |
| Ejecución de código | `code_execution` / `code_interpreter` | 5 $ por 1.000 llamadas |
| Búsqueda en archivos adjuntos | `attachment_search` | 10 $ por 1.000 llamadas |
| Búsqueda en colecciones (RAG) | `collections_search` / `file_search` | 2,50 $ por 1.000 llamadas |
| Herramientas MCP remotas, `view_image`, `view_x_video` | — | Solo tokens |

La búsqueda en X se cobra por elemento devuelto, no por llamada: cada post recuperado, incluidos los posts padre y citados, cuenta en la tarifa de posts. El texto que devuelven las búsquedas también entra como tokens de entrada.

El almacenamiento se factura aunque no consultes nada: 0,025 $ por GiB y día para archivos, 0,10 $ por GiB y día para colecciones, y 0,20 $ por GiB descargado. Una colección de 50 GiB durante 30 días suma 50 × 30 × 0,10 = 150 $. Si una solicitud a la API Responses se bloquea por infringir las normas de uso antes de generar, xAI cobra 0,05 $; si la infracción se detecta después, pagas la generación.

La generación de imágenes, vídeo y voz usa otras unidades (desde 0,02 $ por imagen, desde 0,05 $ por segundo de vídeo, 15 $ por millón de caracteres de texto a voz). No las estimes con la tarifa de salida de texto.

## Cuánto cuesta un mes con Grok: tres ejemplos

Los tres casos son hipotéticos, con tarifas de contexto corto, sin reintentos y sin impuestos. Sirven para ver qué parte de la factura mueve cada decisión.

### Chat de soporte con 100.000 conversaciones al mes

Cada conversación envía 1.000 tokens nuevos, reutiliza 2.000 tokens de instrucciones de sistema desde la caché y genera 400 tokens de respuesta. Al mes: 100 millones de entrada nueva, 200 millones en caché y 40 millones de salida.

```text
grok-4.7: 100 × 2 $ + 200 × 0,50 $ + 40 × 6 $ = 540 $
```

| Configuración | Coste al mes |
|---|---:|
| `grok-build-0.1` | 220 $ |
| `grok-4.3` | 265 $ |
| `grok-4.3` con Batch | 212 $ |
| `grok-4.7` | 540 $ |
| `grok-4.7` en el endpoint de EE. UU. | 594 $ |
| `grok-4.7` con Priority | 1.080 $ |

![Coste mensual de un chat de soporte con 100.000 conversaciones: de 212 $ con grok-4.3 en Batch, solo para trabajo diferido, a 1.080 $ con grok-4.7 en Priority](https://blog.laozhang.ai/posts/es/xai-grok-api-pricing/img/coste-mensual-soporte.webp)

Dos lecturas útiles. La caché hace mucho: sin ella, esos 200 millones de tokens de sistema costarían 400 $ en `grok-4.7` en lugar de 100 $. Y la fila de Batch no sirve para un chat en directo, porque el resultado puede tardar hasta 24 horas; solo aplica si el mismo volumen se procesa en diferido, por ejemplo al clasificar los tickets del día por la noche.

### Agente de investigación con búsqueda web

1.000 tareas al mes con `grok-4.7`, cada una con 60.000 tokens de entrada (incluido el texto que traen las búsquedas), 3.000 de salida y 5 búsquedas web:

```text
Tokens:    60 × 2 $ + 3 × 6 $ = 138 $
Búsquedas: 5.000 × 5 $ / 1.000 = 25 $
Total:                          163 $
```

Aquí la herramienta es el 15 % del coste. Vigila el tamaño de la entrada: si el agente arrastra historial y alguna tarea supera los 200.000 tokens, esa tarea entera pasa a la tarifa doble.

### Los mismos tokens en Grok, ChatGPT y Claude

Con 100 millones de tokens de entrada y 20 millones de salida al mes, sin caché y con contexto corto, las tarifas estándar de cada proveedor a 26 de septiembre de 2026 dan:

| Modelo | Entrada / salida (USD por millón) | Coste al mes |
|---|---|---:|
| GPT-6 Luna | 0,10 / 0,50 | 20 $ |
| `grok-build-0.1` | 1 / 2 | 140 $ |
| `grok-4.3` | 1,25 / 2,50 | 175 $ |
| `grok-4.7` | 2 / 6 | 320 $ |
| GPT-6 Sol | 2 / 10 | 400 $ |
| Claude Sonnet 5 | 2 / 10 | 400 $ |

Tarifas de [OpenAI](https://developers.openai.com/api/docs/pricing) y [Anthropic](https://platform.claude.com/docs/en/about-claude/pricing). `grok-4.7` iguala a GPT-6 Sol y Sonnet 5 en entrada, pero su salida cuesta 6 $ en lugar de 10 $, así que la ventaja crece cuanto más texto generas. La comparación supone el mismo número de tokens; cada proveedor usa su propio tokenizador, de modo que el mismo texto no produce exactamente la misma cifra, y las reglas de contexto largo tampoco coinciden. Para comparar con más proveedores, consulta la [Comparativa de precios de API de IA: qué modelo sale más barato](https://blog.laozhang.ai/es/posts/cheapest-llm-models); para Claude y OpenAI en detalle, [Precio de la API de Claude vs OpenAI: qué nivel sale más barato](https://blog.laozhang.ai/es/posts/claude-api-vs-openai-api-pricing).

## ¿Es gratis la API de Grok?

Ni la página de precios, ni el catálogo de modelos, ni la página de [límites de velocidad](https://docs.x.ai/developers/rate-limits) de xAI incluyen un crédito gratuito o una cantidad de tokens sin coste. El «Tier 0» que aparece allí es el nivel de límites con 0 $ gastados, no un uso gratuito. El acceso se paga con crédito prepago o con factura.

Tampoco hay que confundir la API con los planes de la app. Grok gratis, SuperGrok o X Premium son suscripciones para usar Grok en la web, la app o X, y se pagan aparte; ninguna página de la API indica que incluyan crédito para llamadas a `api.x.ai`. Grok Build tiene su propio plan gratuito, pero es la herramienta de programación, no la API. Si lo que ves es el aviso de saturación de la app, el problema está en el plan de consumo: [Grok está bajo mucho uso: qué significa el aviso de acceso prioritario](https://blog.laozhang.ai/es/posts/grok-heavy-usage-error).

Dos confusiones frecuentes:

- **Groq no es Grok.** Groq (groq.com) es otra empresa de inferencia sin relación con xAI; sus precios no sirven para Grok.
- **Los revendedores fijan sus propios precios.** Plataformas como OpenRouter o pasarelas regionales venden acceso a modelos Grok con su tarifa y sus condiciones; es otro contrato, y el precio oficial es el de xAI. Los criterios para valorarlos están en [Proveedor API LLM más barato: precio, calidad, latencia y riesgo de gateway](https://blog.laozhang.ai/es/posts/cheapest-llm-api-provider).

Si solo necesitas probar un modelo sin pagar, revisa [Mejores API de IA gratis: cuál elegir y cuándo empezar a pagar](https://blog.laozhang.ai/es/posts/free-ai-api-tiers-compared).

## Cómo controlar el gasto real

**Lee el coste de cada respuesta.** La API devuelve `usage.cost_in_usd_ticks` en chat, Responses, imágenes y vídeo, con el importe ya cobrado: incluye descuentos de caché, tokens e invocaciones de herramientas del servidor. La [guía de seguimiento de costes](https://docs.x.ai/developers/cost-tracking) usa esta conversión:

```text
coste_en_USD = cost_in_usd_ticks / 10.000.000.000
```

El valor es por solicitud y no se acumula entre turnos: en una conversación, súmalo tú. En streaming con el SDK de xAI, cada fragmento lleva un total acumulado y solo el último es el coste final; sumar todos los fragmentos cuenta varias veces la misma solicitud. Con el SDK de OpenAI o REST, activa `stream_options: {"include_usage": true}` y el coste llega en el fragmento final. El SDK de Vercel (`@ai-sdk/xai`) no expone este campo.

**Conoce tu nivel de límites.** El nivel depende del gasto acumulado en la API desde el 1 de enero de 2026: Tier 1 a partir de 50 $, Tier 2 desde 250 $, Tier 3 desde 1.000 $ y Tier 4 desde 5.000 $, y nunca baja. Para `grok-4.7`, los tokens por minuto pasan de 50 millones en Tier 0 a 100 millones en Tier 4. Los tokens en caché cuentan para ese límite aunque se cobren más baratos; al superarlo, la API responde con un error 429.

**Fija la versión del modelo.** En xAI, `<modelo>` apunta a la última versión estable y `<modelo>-latest` a la más reciente, así que el modelo servido (y su tarifa) puede cambiar sin tocar tu código. Si necesitas un presupuesto estable, usa el identificador con fecha y registra qué modelo te respondió en cada solicitud.

## Preguntas frecuentes

### ¿Cuánto cuesta la API de Grok en España?

Lo mismo que en cualquier otro país: xAI publica una única tabla en dólares, y `grok-4.7` cuesta 2 $ por millón de tokens de entrada y 6 $ por millón de salida en el endpoint global. La tabla no da precios por país, aunque xAI advierte de que la disponibilidad de modelos puede variar según la ubicación y la cuenta. Los planes de la app de Grok tienen su propio precio y no forman parte de la factura de la API.

### ¿Mi suscripción a SuperGrok o X Premium incluye la API?

No hay ninguna indicación de ello en la documentación de la API. Para llamar a `api.x.ai` necesitas una cuenta de desarrollador con crédito prepago o facturación, independiente de la suscripción.

### ¿Qué modelo de Grok es el más barato por la API?

Por token, `grok-build-0.1` (1 $ de entrada y 2 $ de salida por millón), pero está orientado a programación. Para uso general, `grok-4.3` (1,25 $ y 2,50 $) es el más económico y, a diferencia de `grok-4.7`, admite la API Batch con un 20 % de descuento.

### ¿Cuánto cuesta un millón de tokens con Grok 4.7?

Depende del tipo de token: 2 $ si es entrada nueva, 0,50 $ si sale de la caché y 6 $ si es salida. Si la entrada de la solicitud alcanza 200.000 tokens, las tres tarifas se duplican (4, 1 y 12 $) para toda esa solicitud.
