Claude Fable 5.1 no rebaja un 75% todas las llamadas. Mantiene la entrada en $10 por millón de tokens y la salida en $50. La reducción afecta a la lectura de caché, que pasa de $1 en Fable 5 a $0,25.
La diferencia es importante para agentes que releen un prefijo grande y estable durante una sesión larga. Apenas cambia la economía de una carga cuyo prompt es nuevo en cada solicitud. Y antes de sustituir el ID del modelo hay que revisar llamadas forzadas a herramientas y el tratamiento de los bloques de pensamiento.
Los datos del proveedor se comprobaron en Claude Platform el 3 de septiembre de 2026. Precio, retención y disponibilidad son variables; conviene verificarlos de nuevo al activar tráfico real.
El precio útil es una suma, no un porcentaje
La tabla oficial de precios publica las mismas cifras para Fable 5.1 y Mythos 5.1:
| Categoría | USD por MTok |
|---|---|
| Entrada normal | $10 |
| Escritura de caché de 5 minutos | $12,50 |
| Escritura de caché de 1 hora | $20 |
| Acierto o renovación de caché | $0,25 |
| Salida | $50 |
Batch cuesta $5 para entrada y $25 para salida. La inferencia limitada a Estados Unidos con inference_geo: "us" aplica un multiplicador de 1,1 a todas las categorías. Una nube o pasarela puede añadir sus propias condiciones, por lo que estas cifras son la referencia de Anthropic, no una factura final garantizada.
El 75% compara $0,25 con el dólar que costaba la lectura en Fable 5. Frente a la entrada normal de $10, la lectura equivale al 2,5% y es un 97,5% más barata. Ambos cálculos son correctos; afirmar que “el modelo cuesta un 75% menos” no lo es, porque omite la escritura, la entrada sin caché y la salida.
Calcula cuándo se recupera la escritura
Supongamos un prefijo estable de un millón de tokens y dejemos fuera el sufijo variable y la salida.
Una escritura de 5 minutos seguida de una lectura cuesta $12,50 + $0,25 = $12,75. Procesar dos veces el mismo prefijo como entrada normal cuesta $20. Si la segunda llamada llega dentro del TTL y el prefijo coincide, la caché ya ahorra dinero.
Con una escritura de una hora, dos usos cuestan $20,25, ligeramente más que los $20 sin caché. Un segundo acierto lleva el total a $20,50, mientras que tres entradas normales cuestan $30. En este ejemplo, la opción de una hora gana en el tercer uso.
En producción conviene conservar por separado entrada normal, creación de caché, lectura y salida. Una tarifa media oculta caducidades y cambios accidentales en system o tools. Si el problema es un turno caro de Claude Code, la guía de fallos de caché trata esa investigación específica.

El effort predeterminado de la API es high
La referencia de Effort indica que no enviar el campo produce exactamente el mismo comportamiento que high. Fable 5.1 admite low, medium, high, xhigh y max. El pensamiento adaptativo está siempre activo; effort orienta el trabajo dedicado al razonamiento, texto y herramientas.
pythonresponse = client.messages.create( model="claude-fable-5-1", max_tokens=16000, output_config={"effort": "high"}, messages=[{"role": "user", "content": "Revisa este plan de migración."}], )
Es preferible escribir el valor para que la línea base quede registrada. Después, las clasificaciones o transformaciones rutinarias se pueden evaluar con medium o low; el trabajo agéntico largo puede justificar comparar high, xhigh y max. Effort es una señal de comportamiento, no un presupuesto rígido, así que hay que medir calidad, tokens, latencia y rondas de herramientas.
Fable 5.1 permite además cambiar effort por mensaje mediante una función beta que conserva el prefijo en caché. Cambiar el effort de nivel superior en la solicitud siguiente reinicia esa caché. Un diseño dinámico debe usar el encabezado beta vigente y comprobar los contadores reales.
Tres comprobaciones evitan una migración rota
La guía oficial de migración documenta incompatibilidades que no se ven al editar el ID.
La primera es el uso forzado de herramientas. Un tool_choice de tipo any o un tool con nombre devuelve 400 invalid_request_error. Fable 5.1 acepta auto y none. Para obtener datos válidos según un esquema, se puede combinar auto con strict: true o usar structured outputs.
La segunda es la dirección de los thinking blocks. Fable 5.1 puede leer bloques de modelos Claude anteriores, pero un modelo anterior no puede leer los que generó 5.1. Si un router retrocede de modelo dentro de una conversación, debe asumir que se descartarán bloques y no que el estado seguirá intacto.
La tercera es la edición del historial. Fable 5.1 puede vincular los bloques al prefijo de la conversación. Modificar un turno previo, reconstruir el mensaje system o cambiar el array de tools puede invalidar los bloques posteriores. Un cliente propio debería mantener un historial solo de anexado y preferir context editing o compaction del servidor. La aplicación gradual varía para cuentas antiguas, por lo que un canary debe observar 400 e input_transformations.
Desactivar el pensamiento no evita estas restricciones. thinking: {type: "disabled"} y el budget_tokens manual no son compatibles con Fable 5.1.

Mythos 5.1 tiene la misma capacidad, no el mismo acceso
La página de novedades de Fable 5.1 describe Fable 5.1 y Mythos 5.1 con las mismas capacidades, especificaciones y precios. Lo que cambia es quién puede ejecutarlos:
claude-fable-5-1está disponible para clientes de Claude API y en las plataformas asociadas enumeradas.claude-mythos-5-1solo se ofrece a clientes aprobados de Project Glasswing.- Ambos requieren 30 días de retención salvo autorización expresa de Anthropic.
- Ninguno admite actualmente Priority Tier.
Ver un ID en un catálogo cloud no demuestra el permiso de la cuenta. Sin aprobación escrita, el plan ejecutable debe usar Fable 5.1. La guía de acceso a Mythos explica por separado qué comprobación de cuenta hace falta.
Define de antemano cuándo ampliar y cuándo volver atrás
Duplica un conjunto representativo y no sensible de solicitudes de Fable 5. Cambia a claude-fable-5-1, elimina forced tool_choice y fija effort. Registra entrada normal, creación y lectura de caché, salida, latencia, rondas de herramientas, refusals y errores 400.
Solo amplía tráfico cuando la evaluación de la tarea siga pasando, la tasa observada de cache hit justifique el ahorro proyectado y el cliente distinga stop_reason: "refusal" de un fallo de transporte. Si falla una condición, vuelve al ID anterior y corrige la solicitud. Subir effort no arregla un contrato de herramientas incompatible.
La decisión queda así: migra de forma gradual si reutilizas prefijos y superas la prueba de compatibilidad; si casi toda la entrada es única, decide por una evaluación de capacidad, no por el 75%; y no incluyas Mythos como opción real sin aprobación de Glasswing.



