
Claude Fable 5.1: ¿más barato? Matemáticas del caché
Fable 5.1 mantiene tarifas $10/$50 pero baja lecturas de caché a $0,25. Calcula el costo real de la tarea y evita confundir suscripción con API.
Claude Fable 5.1 no es más barato que Claude Fable 5 en las tarifas de API publicadas. Ambos cuestan $10 por millón de tokens de entrada y $50 por millón de tokens de salida. El ahorro es más estrecho y potencialmente sustancial. Una lectura de caché de Fable 5.1 cuesta $0,25 por millón de tokens, bajando de $1 en Fable 5. Los costos de escritura de caché son iguales en ambos modelos.[1]
Esto no garantiza una factura más baja para cada tarea. Un trabajo con pocos aciertos de caché, salidas más largas, más turnos de herramientas o mayor esfuerzo puede costar lo mismo o más después de la migración. Tampoco significa que un medidor de uso de suscripción de Claude caiga un 75%; las asignaciones de suscripción y las facturas de tokens de API son sistemas de facturación diferentes. Usa la página actual del modelo Claude Fable 5.1 para la ruta que planeas llamar, luego calcula con el registro de uso real de esa ruta en lugar de un titular aguas arriba copiado en una hoja de cálculo.
Respuesta rápida
- Fable 5.1 mantiene las tasas $10/MTok de entrada y $50/MTok de salida de Fable 5.[1]
- El descuento medible es en lecturas de caché: $0,25/MTok en lugar de $1/MTok. Los precios de escritura de caché no cambian.
- Un acierto de caché de 500K tokens por tanto ahorra $0,375 antes de que se cuenten salida, herramientas, reintentos y trabajo rechazado.
- No traduzcas ese descuento de API en una afirmación de asignación de plan de Claude; los medidores de suscripción y las facturas de API son separados.[4]
"Más barato" puede referirse a cuatro números diferentes
La mayoría de discusiones sobre esta versión mezclan al menos dos de estos:
| Número | Qué mide | ¿Puede el corte de tarifa de caché cambiarlo? |
|---|---|---|
| Precio de lista de API | Tarifa de proveedor para cada categoría de token | Sí, pero solo la categoría de lectura de caché cambió |
| Cargo por solicitud | Cantidades de tokens multiplicadas por las tarifas aplicables | Sí, en proporción a los tokens de lectura de caché |
| Costo por tarea completada | Todas las solicitudes, reintentos, herramientas e intentos fallidos necesarios para un resultado aceptado | Posiblemente; el comportamiento y la longitud de salida también importan |
| Medidor de uso de suscripción | Asignación o créditos de uso dentro de planes de Claude y Claude Code | No a través de una simple conversión de $0,75 por MTok |
Los dos primeros se pueden calcular directamente a partir de un objeto de uso de API y tarjeta de tarifas. El tercero requiere un ID de tarea a nivel de aplicación y una regla de aceptación. El cuarto requiere las reglas oficiales del plan de Claude relevante.
Si alguien dice "Fable 5.1 es 75% más barato", pregunta qué fila significa. Solo la tarifa unitaria de lectura de caché cayó un 75%.
La tarjeta de tarifas, lado a lado
Todos los precios a continuación son tarifas de lista de API de Anthropic directas en dólares estadounidenses por millón de tokens a partir del 7 de septiembre de 2026.[1]
| Categoría de token | Claude Fable 5 | Claude Fable 5.1 | Cambio |
|---|---|---|---|
| Entrada base | $10,00 | $10,00 | Ninguno |
| Escritura de caché de 5 minutos | $12,50 | $12,50 | Ninguno |
| Escritura de caché de 1 hora | $20,00 | $20,00 | Ninguno |
| Acierto de caché o actualización | $1,00 | $0,25 | −75% |
| Salida | $50,00 | $50,00 | Ninguno |
| Entrada de lote | $5,00 | $5,00 | Ninguno |
| Salida de lote | $25,00 | $25,00 | Ninguno |
El multiplicador de lectura de caché es 0,025 veces la entrada base en Fable 5.1, en comparación con el multiplicador usual de 0,1 en Fable 5. Una escritura de cinco minutos es 1,25 veces la entrada base; una escritura de una hora es dos veces la entrada base. Anthropic dice que estos modificadores de caché pueden apilar con otros modificadores como Batch y residencia de datos.[1]
Por ejemplo, solicitar inferencia solo para EE.UU. añade un multiplicador de 1.1 a entrada, salida, escrituras de caché y lecturas de caché en modelos Claude recientes soportados. Los servicios en la nube operados por socios tienen su propio precio regional. Una hoja de cálculo de costos debe por lo tanto registrar proveedor y región de inferencia, no solo el nombre del modelo.[1]
La fórmula que pertenece al informe de costos
Que cada recuento de token se mida en millones:
U = tokens de entrada sin caché / 1.000.000
W5 = tokens escritos en caché de 5 minutos / 1.000.000
W60 = tokens escritos en caché de 1 hora / 1.000.000
R = tokens de lectura de caché / 1.000.000
O = tokens de salida / 1.000.000A tarifas de lista directa, una solicitud de Fable 5.1 es:
request_cost_5_1 = 10U + 12.5W5 + 20W60 + 0.25R + 50OPara Fable 5, solo cambia el término de lectura de caché:
request_cost_5 = 10U + 12.5W5 + 20W60 + 1.00R + 50OSi las cantidades de token permanecen idénticas, el ahorro es por lo tanto:
saving = 0.75REn lenguaje plano, cada millón de tokens de lectura de caché ahorra $0,75. La fórmula es deliberadamente condicional. El comportamiento del modelo puede cambiar U, R y O, así como el número de solicitudes necesarias para terminar la tarea.
Una sesión trabajada con un prefijo de 500K en caché
Considera una sesión de codificación hipotética de diez solicitudes. Cada solicitud ve el mismo prefijo de repositorio de 500.000 tokens, agrega 20.000 tokens de entrada sin caché y produce 5.000 tokens de salida. La primera solicitud crea una entrada de caché de cinco minutos; las nueve siguiente la golpean. Esto es una ilustración de precios, no un punto de referencia de modelo medido.
Primera solicitud: costo idéntico
Escritura de caché de 500K = 0,5 × $12,50 = $6,25
Entrada nueva de 20K = 0,02 × $10 = $0,20
Salida de 5K = 0,005 × $50 = $0,25
primera solicitud $6,70Ambas versiones cuestan $6,70 porque sus escrituras, entrada sin caché y tarifas de salida coinciden.
Cada acierto de caché posterior
| Rubro | Fable 5 | Fable 5.1 |
|---|---|---|
| Lectura de caché de 500K | $0,500 | $0,125 |
| Entrada sin caché de 20K | $0,200 | $0,200 |
| Salida de 5K | $0,250 | $0,250 |
| Total de solicitud | $0,950 | $0,575 |
A través de los nueve aciertos:
Fable 5 total = $6,70 + (9 × $0,950) = $15,250
Fable 5.1 total = $6,70 + (9 × $0,575) = $11,875
ahorro $3,375La reducción es de aproximadamente el 22,1% para esta sesión construida, aunque la tarifa de lectura de caché cayó un 75%. La escritura de caché sin cambios, entrada nueva y salida diluyen el ahorro. Una sesión con una mayor parte de lecturas de caché ahorraría un porcentaje mayor; una sin aciertos de caché no ahorraría nada con cantidades de token idénticas.
¿Cuándo vale la pena escribir el caché?
Compara el almacenamiento en caché con enviar repetidamente los mismos tokens como entrada ordinaria.
Para un caché de 5 minutos de Fable 5.1, la primera escritura cuesta 1,25 veces la tarifa de entrada normal y un acierto cuesta 0,025 veces. A través de una solicitud inicial y una reutilización, el prefijo estable cuesta unidades de tarifa de entrada de 1,25 + 0,025 = 1,275 en lugar de 2,0 sin caché. Vale la pena después de una lectura de caché.
Para una entrada de una hora, la primera escritura cuesta 2,0 unidades. Agregar una lectura produce 2,025, ligeramente más que dos envíos sin caché. Agregar una segunda lectura produce 2,05, en comparación con 3,0 sin caché. La guía de precios de Anthropic en consecuencia dice que la duración de cinco minutos vale la pena después de una lectura de caché y la duración de una hora después de dos.[1]
Esa aritmética asume un acierto. Un prefijo cambiante puede convertir lecturas esperadas en nuevas escrituras. Coloca el contenido estable primero, coloca instrucciones volátiles después y monitorea recuentos de creación de caché y lectura en lugar de asumir que el aviso está en caché. La documentación de la API de Fable 5.1 cubre la forma de solicitud específica de ruta; la confirmación de facturación sigue viniendo de los campos de uso devueltos e factura.
Por qué un caché más barato puede producir aún una tarea más cara
El precio de caché es un término en un trabajo de múltiples solicitudes. Rastrea estas fuentes de movimiento después de la migración:
Longitud de salida
La salida cuesta cinco veces más por token que la entrada base en las tarifas publicadas. 10.000 tokens de salida adicionales cuestan $0,50. En el ejemplo anterior, eso equivale a más de un ahorro de lectura de caché de 500K de $0,375. Establece límites de salida y califica la finalización útil en lugar de recompensar la longitud.
Turnos de herramientas
Anthropic señala que Fable 5.1 puede emitir una llamada de herramienta por turno en situaciones en las que Fable 5 podría procesar llamadas independientes. Los viajes de ida y vuelta adicionales pueden reproducir contexto en caché de forma económica, pero también pueden agregar instrucciones nuevas, resultados de herramientas, salidas y latencia.[3] Cuenta todo el bucle.
Esfuerzo
Fable 5.1 admite cinco niveles de esfuerzo y por defecto high. Una tarea movida de una configuración anterior más baja a xhigh o max puede consumir más razonamiento y tiempo incluso si el almacenamiento en caché mejora. Compara configuraciones en resultados aceptados en lugar de tratar el nombre del modelo como la única variable.[3]
Invalidación de caché
Cambiar un prefijo en caché, definición de herramienta o historial de conversación puede reducir la reutilización. Fable 5.1 también vincula el pensamiento preservado al prefijo que lo produjo; las ediciones descuidadas de historial pueden soltar razonamiento y reiniciar trabajo. La lista de verificación de migración de Fable 5.1 cubre esas reglas de compatibilidad.
Ejecuciones fallidas y rechazadas
Un cargo más bajo por solicitud no ayuda si más ejecuciones necesitan corrección humana. Define una tarea aceptada —las pruebas pasan, el esquema es válido, fuentes compatibles, sin archivos prohibidos cambiados— y divide el gasto total por tareas aceptadas en lugar de solicitudes en bruto.
cost_per_accepted_task = total_cost_for_task_cohort / accepted_tasksCómo leer las estimaciones de 25% y 45% de Anthropic
Anthropic dice que Fable 5.1 cuesta aproximadamente 25% menos que Fable 5 para cargas de trabajo típicas facturadas por tokens y puede ahorrar hasta aproximadamente 45% para trabajo altamente agéntico.[2] Sus notas de lanzamiento explican que la comparación utilizó cuatro semanas de uso de agosto de 2026 con esfuerzo predeterminado; la mezcla "típica" cubrió Claude Enterprise, Claude Code y tráfico de API, mientras que la mezcla agéntica era pesada en contexto y pesada en herramientas.
Esas cifras son antecedentes útiles de planificación, no sustitutos de un modelo de factura. Tu participación de lectura de caché puede ser más baja. El nuevo modelo puede tomar un número diferente de turnos. Una puerta de enlace también puede tener una tarjeta de tarifas diferente de la API directa de Anthropic. Etiqueta las estimaciones como reportado por proveedores siempre que aparezcan en una propuesta de presupuesto.
Si el cálculo de API cae pero el medidor de uso de Claude Code no, compárralos como sistemas de facturación separados antes de investigar el comportamiento de caché. El medidor puede estar aplicando reglas de asignación de plan o créditos de uso en lugar de exponer una factura de token de API directo.
La facturación de API no es el medidor de suscripción de Claude
El Centro de Ayuda de Anthropic dice que Fable 5 y Fable 5.1 funcionan de la misma manera en planes de Claude de pago.[4]
- En planes Max, asientos de equipo premium y asientos premium en planes Enterprise basados en asientos heredados, el uso de Fable se incluye hasta el 50% del límite de uso semanal. Se extrae de ese límite más rápido que otros modelos Claude; después del límite de Fable, un usuario puede cambiar de modelo o continuar con créditos de uso.
- En planes Pro y asientos de equipo estándar, Fable 5 y 5.1 utilizan créditos de uso de pago por uso en lugar del uso incluido del plan.
- Los asientos estándar en Enterprise basado en asientos necesitan créditos de uso habilitados por organización.
- Enterprise basado en uso y la API Claude se facturan a tarifas de API estándar.
Una promoción anterior permitía algo de uso de Fable 5 dentro de límites semanales, terminó el 19 de julio de 2026 y nunca se aplicó a Fable 5.1. Las publicaciones y capturas de pantalla anteriores pueden por lo tanto describir reglas que ya no se aplican.[4]
La distinción práctica es simple: una factura de API expone categorías de tokens que se pueden multiplicar por una tarjeta de tarifas. Un medidor de plan de Claude o Claude Code representa política de plan y asignación de uso. No hagas ingeniería inversa de una a partir de la otra a menos que Anthropic publique la conversión exacta para esa cuenta y superficie.
FAQ
¿Claude Fable 5.1 es 75% más barato que Fable 5?
Solo su tarifa unitaria de lectura de caché es 75% más baja. La entrada base, las escrituras de caché y la salida retienen las mismas tarifas. El ahorro total equivale a la reducción de lectura de caché después de contabilizar cada rubro sin cambios y cualquier cambio en el comportamiento del modelo.
¿Ahorraré dinero si no uso almacenamiento en caché de aviso?
No de la reducción de tarifa publicada cuando los recuentos de token son iguales. Fable 5.1 aún podría cambiar el costo de la tarea a través de longitud de salida, turnos de herramientas, esfuerzo, reintentos o tasa de aceptación, pero esos son resultados de carga de trabajo en lugar de reducciones de precio de lista.
¿El almacenamiento en caché automático de aviso es gratis?
No. La creación de caché, lecturas de caché y entrada ordinaria tienen cargos separados. El almacenamiento automático en caché cambia cómo se administran los puntos de quiebre; no elimina el cargo de escritura de caché.[1]
¿Una actualización de caché usa la tarifa de Fable 5.1 más baja?
La tabla de Anthropic agrupa aciertos de caché y actualizaciones a $0,25 por millón de tokens para Fable 5.1. Confirma los campos de uso relevantes en la respuesta e informe de facturación en lugar de estimar actualizaciones solo a partir del recuento de solicitudes.
¿Hace Batch mitad de precio Fable 5.1?
Anthropic enumera entrada y salida de Batch al 50% por debajo de las tarifas estándar para ambas versiones de Fable. El caché y otros modificadores pueden apilar, así que calcula cada categoría de token en lugar de dividir una factura mixta completa entre dos.[1]
¿Por qué mi uso de Claude Code no cayó después de cambiar?
El medidor de plan no es simplemente el rubro de lectura de caché de API. Primero identifica si la sesión utilizaba asignación de plan incluida o créditos de uso, luego compara sesiones similares. También verifica salida, esfuerzo, turnos de herramientas, aciertos de caché y si el prefijo de aviso se mantuvo estable.
La prueba de factura a ejecutar antes de cambiar el valor predeterminado
Exporta al menos un ciclo de facturación normal y agrupa solicitudes por ID de tarea de aplicación. Para cada modelo, totaliza entrada sin caché, escrituras de cinco minutos, escrituras de una hora, lecturas de caché, salida, reintentos y tareas aceptadas. Reprecio las cantidades de token antiguas con la nueva tarjeta de tarifas para aislar el descuento de caché; luego compara esa estimación con cantidades reales de Fable 5.1 para exponer cambios de comportamiento.
Si la estimación repreciada es más baja pero el costo de tarea observado es más alto, el descuento de caché está funcionando —la forma de carga de trabajo cambió. Ese hallazgo es mucho más práctico que discutir sobre la palabra "más barato": apunta directamente al crecimiento de salida, aciertos de caché perdidos, turnos adicionales o trabajo fallido.
References
- Anthropic, API pricing, accessed September 7, 2026.
- Anthropic, Introducing Claude Fable 5.1 and Mythos 5.1, September 1, 2026.
- Anthropic, Migrating to Claude Fable 5.1 and Claude Mythos 5.1, accessed September 7, 2026.
- Anthropic Help Center, Claude Fable models on your plan, accessed September 7, 2026.
Autor

Categorías
Más publicaciones

Créditos de Seedance y cuotas: por qué se agota el saldo
Coste por clip según resolución, duración e entrada. La facturación por segundo responde con multiplicación exacta, sin tipo de cambio variable.


DeepSeek V4 Flash Oficial: Mejoras en Agentes y Codex 0731
DeepSeek V4 Flash 0731 en beta pública con benchmarks de agentes mejorados, soporte nativo de API de Respuestas, Codex y el mismo ID de modelo.


Gemini Omni API: especificaciones, precios y límites
Guía de la vista previa de Gemini Omni: ID de modelo, API de Interacciones, 720p, precios, límites de entrada, edición multiturno y diferencias con reAPI.
