Saltar al contenido principal

Claude API en 2026: cómo elegir entre Fable 5, Opus 5, Sonnet 5 y Haiku 4.5

11 min de lecturaGuías de API

Sonnet 5 es el punto de partida equilibrado; Haiku 4.5 prioriza velocidad y coste, mientras Opus 5 y Fable 5 exigen justificar capacidad, precio y migración.

Cuatro carriles comparan Fable 5, Opus 5, Sonnet 5 y Haiku 4.5 desde mayor capacidad y precio hasta mayor velocidad y menor coste

La respuesta corta: empieza por Sonnet 5

A 10 de agosto de 2026, la comparación pública de Anthropic incluye Claude Fable 5, Claude Opus 5, Claude Sonnet 5 y Claude Haiku 4.5, con sus IDs para Claude API. Para la mayoría de integraciones nuevas, Sonnet 5 es el punto de partida más razonable: combina el posicionamiento de velocidad e inteligencia de Anthropic con una ventana de contexto amplia y una tarifa intermedia. Es una recomendación práctica basada en especificaciones oficiales, no el resultado de un benchmark independiente.

La regla para desviarse de ese punto de partida es sencilla:

  • elige Haiku 4.5 si el cuello de botella comprobado es el coste o la latencia en tareas breves y de gran volumen;
  • prueba Opus 5 si Sonnet falla de forma repetible en razonamiento profundo, agentes de varios pasos o programación compleja;
  • considera Fable 5 únicamente si una evaluación representativa demuestra una mejora útil frente a Opus y has revisado sus condiciones de precio y retención, además del tratamiento de los rechazos de seguridad.

No hay un ganador universal. La elección correcta es el modelo más económico y rápido que entrega un resultado aceptable para tu carga, sin introducir incompatibilidades operativas.

Antes de comparar cifras, aclara cinco conceptos

Los nombres comerciales no bastan para configurar una llamada. El ID del modelo es el valor que copias en la integración. Para la API operada por Anthropic, los IDs son claude-fable-5, claude-opus-5, claude-sonnet-5 y claude-haiku-4-5-20251001; Haiku también dispone del alias corto claude-haiku-4-5. No deduzcas a partir de ellos los identificadores de Amazon Bedrock, Google Cloud u otras plataformas: cada superficie puede usar su propia nomenclatura.

Que Fable 5, Opus 5 y Sonnet 5 no lleven una fecha en el nombre tampoco significa que sean alias que avanzan solos. La documentación de versionado de Claude explica que estos IDs sin fecha siguen apuntando a una instantánea fijada. Una actualización futura requiere una decisión explícita de migración.

MTok significa un millón de tokens facturados. Las tarifas de entrada se aplican a lo que envías; las de salida, a lo que genera el modelo. Como la salida cuesta más, dos aplicaciones con el mismo total de tokens pueden tener facturas muy distintas si cambia la proporción entre entrada y salida.

La ventana de contexto limita cuánto material puede considerar una solicitud. La salida máxima limita cuánto puede devolver de forma síncrona. Un contexto de 1 millón de tokens no implica una respuesta de 1 millón: son techos diferentes y pueden variar según la función utilizada.

Por último, Fable 5, Opus 5 y Sonnet 5 emplean pensamiento adaptativo, mientras Haiku 4.5 ofrece pensamiento extendido manual. Anthropic indica además que Opus 5 y Sonnet 5 usan esfuerzo alto de forma predeterminada en Claude API y Claude Code. Estas opciones cambian el comportamiento y el consumo, de modo que no deben tratarse como una nota secundaria de la tabla.

Comparación homogénea de los cuatro modelos

La siguiente tabla reúne el posicionamiento, los límites y la latencia relativa publicados por Anthropic con sus tarifas estándar de Claude API. «Rápida» o «más lenta» son etiquetas comparativas del proveedor, no una latencia medida ni un acuerdo de nivel de servicio.

Modelo e IDPara qué lo posiciona AnthropicEntrada / salida por MTokContextoSalida síncrona máx.Latencia relativaPensamiento
Fable 5 claude-fable-5Mayor capacidad entre los modelos de disponibilidad ampliaUS$10 / US$501M128kMás lentaAdaptativo
Opus 5 claude-opus-5Agentes de programación complejos y trabajo empresarial exigenteUS$5 / US$251M128kModeradaAdaptativo; esfuerzo alto por defecto
Sonnet 5 claude-sonnet-5Equilibrio entre velocidad e inteligenciaUS$3 / US$151M128kRápidaAdaptativo; esfuerzo alto por defecto
Haiku 4.5 claude-haiku-4-5-20251001Máxima velocidad; capacidad cercana a modelos de frontera según AnthropicUS$1 / US$5200k64kLa más rápidaExtendido manual

La tarifa de Sonnet 5 necesita una nota temporal inseparable: el precio de introducción es de US$2 de entrada y US$10 de salida por MTok hasta el 31 de agosto de 2026; el precio estándar de US$3/US$15 empieza el 1 de septiembre de 2026. Por eso, una estimación hecha durante agosto no debe convertirse en presupuesto permanente.

Elige según la deficiencia que necesitas resolver

La familia no es una escalera que obligue a comprar siempre el modelo superior. Empieza con Sonnet 5, observa dónde falla tu producto y cambia solo en la dirección que resuelva ese problema.

Árbol de decisión que parte de Sonnet 5 y deriva hacia Haiku 4.5, Opus 5 o Fable 5 según coste, latencia, complejidad y retención

La salida «mantener Sonnet 5» es una decisión válida cuando la carga ya cumple sus criterios de calidad, coste y latencia.

Haiku 4.5 para volumen, rapidez y respuestas acotadas

Haiku 4.5 encaja bien en clasificación, extracción, enrutamiento, moderación previa y respuestas breves. Un clasificador de tickets con millones de entradas pequeñas, por ejemplo, suele beneficiarse más de una tarifa baja y una respuesta rápida que de una ventana de 1M.

El intercambio es concreto: 200k de contexto, 64k de salida máxima y pensamiento extendido manual. Si el flujo necesita analizar repositorios enormes, mantener un agente durante muchos pasos o producir salidas muy largas, esos límites pueden obligarte a fragmentar el trabajo o elegir otro modelo.

Sonnet 5 como opción inicial para cargas mixtas

Sonnet 5 es la referencia útil para asistentes, automatización, programación general y tareas que mezclan razonamiento con volumen. Su ventana de 1M permite trabajar con corpus amplios y su salida máxima de 128k coincide con Opus 5 y Fable 5, sin saltar directamente a sus tarifas.

No confundas esta recomendación con una garantía de calidad. Si tu aplicación depende de formatos estrictos, llamadas a herramientas o respuestas que se aceptan sin corrección humana, mide esos resultados con tus propios datos. Sonnet solo se mantiene como elección si supera ese umbral operativo.

Opus 5 cuando Sonnet falla en complejidad sostenida

Anthropic presenta Opus 5 para razonamiento profundo y trabajo agéntico de horizonte largo. «Agéntico» significa aquí que el modelo planifica y ejecuta tareas de varios pasos, usa herramientas y conserva una estrategia durante más tiempo; no que cualquier llamada de programación necesite Opus.

Pruébalo cuando puedas localizar fallos repetibles de Sonnet: planes que pierden dependencias, investigación de un repositorio grande que se interrumpe o razonamiento que exige demasiadas correcciones. La tarifa estándar es aproximadamente el doble que la de Sonnet 5 tanto en entrada como en salida, así que la mejora debe reducir errores, supervisión o repeticiones lo suficiente para compensarla.

Fable 5 solo después de una prueba y una revisión de datos

Anthropic describe Fable 5 como su modelo de mayor capacidad con disponibilidad amplia. Eso no demuestra por sí solo que vaya a mejorar tu carga. Con US$10/US$50 por MTok, merece una evaluación frente a Opus 5 sobre los casos más difíciles, no una sustitución general de todos los modelos.

También existe Mythos 5, pero queda fuera de esta comparación porque Anthropic lo limita a clientes aprobados de Project Glasswing. No es una alternativa normal de autoservicio. Las integraciones con Fable, además, deben manejar los rechazos del clasificador de seguridad como un resultado posible, sin presentarlos como un error de red ni reintentarlos indefinidamente.

Calcula la factura con la proporción real de entrada y salida

La fórmula base, cuando se usan tarifas expresadas por MTok, es:

coste = MTok de entrada × tarifa de entrada + MTok de salida × tarifa de salida

Supón un volumen agregado de muchas solicitudes que suma 10 MTok de entrada y 1 MTok de salida. No es una sola respuesta ni un benchmark de calidad; solo muestra el efecto de la mezcla de tokens.

ModeloCálculo con tarifa estándarCoste agregado
Fable 510 × US$10 + 1 × US$50US$150
Opus 510 × US$5 + 1 × US$25US$75
Sonnet 510 × US$3 + 1 × US$15US$45
Haiku 4.510 × US$1 + 1 × US$5US$15

Durante el precio de introducción indicado, Sonnet 5 costaría US$30 para ese mismo volumen; después del 31 de agosto de 2026, el presupuesto debe usar US$45 salvo que Anthropic publique otra condición.

La cifra real puede cambiar por varias razones. La API por lotes reduce un 50 % las tarifas de entrada y salida para cargas aptas, y los aciertos de caché de prompts cuestan el 10 % de la entrada estándar; las escrituras de caché aplican multiplicadores superiores. Estas opciones requieren que la carga y la implementación sean compatibles. No son un descuento automático sobre cualquier arquitectura.

La documentación de precios de Claude API advierte que Claude 4.7 y posteriores usan un tokenizer nuevo que produce aproximadamente un 30 % más de tokens para el mismo texto que el anterior, con variación según el contenido. Es una aproximación de recuento, no un recargo fijo del 30 %. El pensamiento generado, las herramientas, la longitud de salida y los trabajos que debas repetir también influyen en el coste por resultado aceptado.

La tabla excluye herramientas, residencia de datos, impuestos, conversión a euros y precios de plataformas asociadas. Para presupuestar, registra por separado tokens de entrada, tokens de salida, solicitudes repetidas y resultados rechazados; multiplicar una tarifa por el volumen de texto original no basta.

Migrar implica más que cambiar el ID

El cambio más sencillo puede fallar si la solicitud conserva parámetros que el modelo nuevo ya no acepta. Usa estas cuatro bandas de riesgo: identidad del modelo, pensamiento y muestreo, recuento/coste y política de datos.

Mapa de riesgos de migración para Claude API: ID fijado, pensamiento y parámetros, tokenizer y coste, y retención o ZDR, con HTTP 400 ligado a configuraciones incompatibles

Un ID válido no compensa una configuración incompatible. Revisa la solicitud completa antes de interpretar un HTTP 400 como indisponibilidad del modelo.

De Sonnet 4.6 a Sonnet 5

Anthropic presenta el cambio de ID desde Sonnet 4.6 como directo, pero su guía específica de Sonnet 5 indica que el modelo rechaza el pensamiento extendido manual y valores no predeterminados de temperature, top_p o top_k. El pensamiento adaptativo está activo por defecto y el tokenizer también cambia el recuento.

En la práctica, primero retira esos parámetros incompatibles en un entorno de prueba. Después vuelve a estimar los tokens y compara las salidas que tu aplicación realmente acepta. Cambiar solo model y conservar el resto de la configuración puede producir un error aunque el ID sea correcto.

De Opus 4.8 a Fable 5

La guía de migración de Fable 5 señala tres diferencias que deben aprobarse antes del cambio: la tarifa sube a US$10/US$50 por MTok, el modelo requiere retención de datos de 30 días y una configuración incompatible con retención cero (ZDR, del inglés Zero Data Retention) puede devolver HTTP 400.

Si tu carga, contrato o política exige ZDR, no recomiendes Fable 5 hasta confirmar las condiciones aplicables a la cuenta. El error 400 no debe asociarse a todas las solicitudes ni a toda retención cero: la advertencia se refiere a configuraciones incompatibles descritas por Anthropic.

Modelos activos no significa calendarios idénticos en todas las plataformas

Según el estado de modelos de Anthropic a 10 de agosto de 2026, Fable 5, Opus 5, Sonnet 5 y Haiku 4.5 están activos en las superficies operadas por Anthropic. Opus 4.1 se retiró el 5 de agosto de 2026, y Opus 4 y Sonnet 4 se retiraron el 15 de junio de 2026.

Esta comprobación no determina el calendario de Bedrock o Google Cloud. Si tu aplicación no llama directamente a Claude API de Anthropic, verifica el catálogo, ID y fecha de retirada en la plataforma que realmente factura y sirve la solicitud.

Una prueba representativa decide mejor que el nombre del modelo

La métrica útil no es «qué modelo parece más avanzado», sino coste por resultado aceptado. Prepara una carga representativa de producción y registra al menos:

  1. si el resultado se acepta sin corrección o reintento;
  2. tokens de entrada, salida y pensamiento;
  3. latencia relevante para tu producto, no una etiqueta genérica;
  4. errores 4xx y su relación con parámetros o políticas;
  5. coste total, incluidas herramientas y repeticiones.

Para un asistente de programación que inspecciona un repositorio grande, por ejemplo, compara si Sonnet 5 completa la tarea o si Opus 5 reduce fallos de planificación. Para clasificación masiva, comprueba si Haiku 4.5 mantiene la precisión mínima y si Batch API encaja con el tiempo de entrega. Para revisión documental, recuerda que 1M de contexto sigue limitado a 128k de salida síncrona en Fable, Opus y Sonnet.

No conviertas una única petición en una clasificación universal. La muestra debe incluir casos fáciles, frecuentes y difíciles, además de los fallos que más cuestan al negocio. Si el modelo más caro solo mejora situaciones excepcionales, puede ser preferible enrutar esos casos de forma explícita en lugar de sustituir toda la carga.

Lista de comprobación antes de desplegar

  • Confirma que llamas a la API operada por Anthropic o identifica la plataforma asociada real.
  • Copia el ID exacto; para el punto de partida, usa claude-sonnet-5.
  • Retira pensamiento extendido manual y valores no predeterminados de temperature, top_p y top_k al migrar a Sonnet 5.
  • Verifica que la ventana de contexto y la salida máxima cubren tu caso sin confundir ambos límites.
  • Recalcula los tokens con el tokenizer actual y separa entrada de salida.
  • Comprueba si la caché de prompts, Batch API y las herramientas cambian la factura.
  • Si evalúas Fable 5, confirma retención de 30 días, compatibilidad ZDR y tratamiento de rechazos.
  • Ejecuta una carga representativa y despliega de forma progresiva solo si no aparecen errores o regresiones relevantes.

La siguiente acción más segura es copiar claude-sonnet-5 en un entorno de prueba, limpiar los parámetros incompatibles y medir el coste por resultado aceptado. Si la limitación observada es coste o latencia, prueba claude-haiku-4-5-20251001; si es capacidad en tareas complejas, prueba claude-opus-5. Usa claude-fable-5 solo después de revisar la guía oficial de migración y confirmar retención y ZDR.

Para verificar cambios posteriores a esta fecha, consulta directamente la lista de modelos e IDs, los precios de Claude API y el calendario de retiradas. No necesitas una pasarela o suscripción de terceros para completar esta decisión.

#Claude API#Claude Sonnet 5#Claude Opus 5#Claude Fable 5#Claude Haiku 4.5
Share: