en este artículo
Claude Fable 5 es el modelo más caro que Anthropic ha puesto a disposición general: $10 por millón de tokens de entrada y $50 de salida, el doble que Opus 4.8. Lo medí en mi benchmark: calidad pura de 8,39 sobre 10 —#24 entre los 107 rankeados— y el puesto 49 del compuesto (v4.14, septiembre de 2026) cuando el precio entra en la cuenta.
¿Llegaste buscando qué usar hoy? Este post se actualiza, pero si vienes a decidir: en calidad pura hoy mandan modelos que cuestan una fracción de Fable, y dentro de Anthropic Opus 4.8 le gana en todo lo que mido, incluido el trabajo agéntico. El mapa completo, que se regenera con cada lote, está en el post vivo del benchmark y en el ranking vivo. Ya lo enfrenté directo contra Opus 4.8; este post es el análisis completo del modelo: qué es, qué números saca, dónde flaquea y cuándo tiene sentido pagarlo.
Qué es Claude Fable 5
Fable 5 salió el 9 de junio de 2026 y es, según la propia documentación de Anthropic, su modelo más capaz de disponibilidad general, construido para “el razonamiento más exigente y el trabajo agéntico de horizonte largo”. Ficha verificable:
- Ventana de contexto de 1 millón de tokens por defecto, hasta 128K tokens de salida por request
- $10 / $50 por millón de tokens (entrada/salida) — 2x el precio de Opus 4.8
- Adaptive thinking siempre activo: es el único modo de razonamiento del modelo, no se puede apagar ni acepta
temperature; la profundidad se controla con el parámetroeffort - Clasificadores de seguridad integrados que pueden rechazar solicitudes: la API devuelve
stop_reason: "refusal"como respuesta exitosa, y existe un mecanismo de fallback para reintentar en otro modelo Claude sin pagar dos veces el costo de caché - Disponible en la API de Claude, Amazon Bedrock, Vertex AI y Microsoft Foundry
- Tiene un gemelo: Claude Mythos 5, mismas capacidades y precio pero sin clasificadores, disponible solo para clientes aprobados en Project Glasswing
El dato operativo que más importa si pagas suscripción: Fable 5 viene incluido en los planes Pro, Max, Team y Enterprise hasta el 22 de junio de 2026. Después pasa a créditos de uso. Y mientras está incluido, cada sesión consume los límites del plan a aproximadamente el doble de velocidad que Opus.
🧠 ¿No sabes qué modelo de IA usar?
Intro a LLMs te da el criterio para elegir modelo por costo y caso de uso — y cierra con un test A/B real de 5 modelos en OpenRouter.
Ver el cursoLo que dice mi benchmark
Contexto rápido. Mi benchmark corre hace meses: 107 modelos con cobertura real, más de 68.000 ejecuciones, todo en español y con tareas aplicadas — workflows de n8n, scripts, contenido, razonamiento, extracción de datos. Mido todo por el mismo proveedor (OpenRouter) salvo que el modelo no esté ahí, porque si cada uno corre en la infraestructura de su creador comparo datacenters y no modelos. El juez es Phi-4, un modelo de Microsoft servido por ese mismo camino; no evalúo modelos de Microsoft, así que el que pone las notas no tiene equipo en la cancha. El score compuesto pesa 70% calidad, 15% costo, 7,5% velocidad y 7,5% latencia.
A Fable 5 lo medí por la vía de la suscripción de Claude Code (la corrida me costó $0 extra; el ranking igual lo costea al precio público de API). Los números en la versión 2.9 (junio 2026):
| Métrica | Claude Fable 5 | Lectura |
|---|---|---|
| Calidad pura | 8,39 | #24 de los 107 rankeados |
| Score global compuesto | 5,96 | puesto 49 |
| Trabajo agéntico de horizonte largo | 6,6 | Opus 4.8 saca 8,08 en la misma suite |
| Contexto largo (retrieval en español) | 10,0 | perfecto hasta 256K — medición de junio, vía suscripción |
| Resistencia a fuga de credenciales | 7,75 | por debajo de Opus 4.8 (8,65) y de Sonnet 4.6 (9,31) |
| Velocidad | 44 tokens/s | por debajo de Opus 4.8 (60) |
| Latencia promedio | 34,3 s | alta — no es para chat en vivo |
| Costo por 1.000 llamadas | $78.00 | el más caro del benchmark completo |
La brecha entre el puesto 24 en calidad y el 49 en el compuesto es el precio, nada más. El ranking premia a quien entrega calidad por dólar, y $78 por 1.000 llamadas es una losa: Opus 4.8 cuesta $39 por la misma carga, y Qwen 3.7 Flash —que en calidad le gana— cuesta $0.20, casi 400 veces menos.
El 10.0 en contexto largo merece mención aparte: puntaje perfecto en cada tamaño que mi suite le puso, hasta 256K tokens. Pocos modelos del benchmark logran eso. El 1M declarado no lo verifiqué completo — mi suite llegó hasta 256K por la vía de la suscripción — así que el techo real entre 256K y 1M queda como dato pendiente, no como promesa confirmada.
El matiz honesto: dónde flaquea
Cuatro límites concretos, medidos:
Pierde contra Opus en la mayoría de las tareas. Sobre los 162 tests que ambos comparten, Fable saca 8.58 y Opus 8.81. De 25 categorías, gana 3 y pierde 18 — pierde justo en lo cotidiano: conversación multi-turno, seguir reglas, devolver JSON exacto. El desglose completo, con tablas por categoría, está en el experimento donde los enfrenté.
Seguridad por debajo de su familia. En mi suite de resistencia a fuga de credenciales saca 7,75 — Opus 4.8 saca 8,65 y Sonnet 4.6, 9,31. Es un resultado incómodo para un modelo que se vende con clasificadores de seguridad integrados: los clasificadores filtran solicitudes dañinas, pero ante un intento de extraerle un secreto del contexto, Fable aguantó menos que sus hermanos más baratos. Si tu agente maneja credenciales, este número importa más que el marketing.
El techo de uso en suscripción. Mientras está incluido en el plan, cada sesión pesa el doble que una de Opus. En mi prueba real — una auditoría de 131 workflows de n8n — Fable se quedó sin sesión a la mitad y tuve que esperar el reseteo. La ironía: el techo aprieta exactamente en el tipo de tarea larga para la que el modelo es bueno.
Latencia alta. 35.4 segundos de promedio por llamada en mis corridas. Para trabajo agéntico de fondo da igual; para cualquier cosa de cara al usuario, no sirve.
Y el matiz de método que aplica siempre: mido tareas acotadas en español, no sesiones agénticas de días. Con 103 ejecuciones más 51 corridas de contexto largo la cobertura es sólida, pero es mi benchmark, no la verdad revelada.
Cuándo usarlo y cuándo no
Úsalo si tu caso es:
- Trabajo agéntico de horizonte largo: refactors grandes, auditorías exhaustivas, agentes que corren horas. Ojo: en junio era su única categoría ganadora contra Opus (+1,21) y en septiembre se dio vuelta (6,6 contra 8,08). Si es tu caso, pruébalo contra tu carga antes de pagarlo
- Tareas que necesitan retrieval confiable sobre contextos enormes (su 10.0 hasta 256K es de los mejores que he medido)
- Mientras esté incluido en tu plan (hasta el 22 de junio de 2026): probarlo gratis en tarea larga es la mejor forma de saber si te aporta
No lo uses si:
- Tu carga es trabajo corto y cotidiano: clasificar, responder, generar contenido, JSON estructurado — Opus lo hace igual o mejor por la mitad
- Tu agente maneja secretos y la resistencia a prompt injection es crítica
- Necesitas latencia de chat en vivo
- Pagas por volumen: a $78 por 1.000 llamadas, cualquier tarea que un modelo barato resuelve bien es plata quemada — para eso está el tier de centavos
Cómo usarlo barato
Con Fable 5 “barato” es relativo, pero hay tres palancas:
- La ventana de suscripción — hasta el 22 de junio de 2026 está incluido en Pro, Max, Team y Enterprise sin costo extra. Es la vía con la que lo medí: corrida completa, $0 adicionales. Después de esa fecha, créditos de uso.
- El parámetro
effort— controla la profundidad del razonamiento. Como el adaptive thinking no se puede apagar, regular el esfuerzo es la única palanca real de costo por llamada dentro del modelo. - Política de dos modelos — Fable solo para la tarea larga y de alto valor; todo lo demás a un modelo más barato. Es lo que hago con mi stack: el trabajo de volumen corre en modelos open source de centavos, como expliqué en cómo usar Claude Code sin pagar $200 al mes.
Claude Fable 5 vs Claude Opus 4.8
La comparación corta, con mis números y la misma vara (el experimento completo, con la auditoría real de 131 workflows, está acá):
| Claude Fable 5 | Claude Opus 4.8 | |
|---|---|---|
| Calidad general (septiembre 2026) | 8,39 | 8,48 |
| Calidad en la corrida de junio (162 tests compartidos) | 8.58 | 8.81 |
| Tareas agénticas de horizonte largo | 6,6 | 8,08 |
| Categorías ganadas en junio (de 25) | 3 | 18 |
| Resistencia a fuga de credenciales | 7,75 | 8,65 |
| Costo por 1.000 llamadas | $78.00 | $39.00 |
| Latencia promedio | 34,3 s | 19,6 s |
Mi política quedó más simple de lo que esperaba: Opus 4.8 por defecto, y Fable 5 sólo si tu propia prueba en tu tarea larga lo justifica. El modelo no es malo — es buenísimo. Pero cuando su única ventaja medida se dio vuelta, pagar el doble dejó de tener defensa con mis números.
Ver en el Benchmark: Claude Fable 5 aparece con su score actualizado en benchmarks.cristiantala.com, que se regenera con cada lote mensual. El análisis metodológico completo, con los 107 modelos rankeados, está en el post vivo del benchmark.
Preguntas frecuentes
¿Qué es Claude Fable 5?
Claude Fable 5 es el modelo más capaz que Anthropic ha liberado de forma general, lanzado el 9 de junio de 2026. Está diseñado para razonamiento exigente y trabajo agéntico de horizonte largo: tareas donde el modelo da muchos pasos solo durante horas. Tiene ventana de contexto de 1 millón de tokens, hasta 128K tokens de salida por request, y trae clasificadores de seguridad que pueden rechazar solicitudes.
¿Cuánto cuesta Claude Fable 5?
Por API cuesta $10 por millón de tokens de entrada y $50 por millón de salida — el doble que Claude Opus 4.8. Con mi supuesto de consumo (300 tokens de entrada, 1.500 de salida por llamada), son $78 por cada 1.000 llamadas. Hasta el 22 de junio de 2026 viene incluido sin costo extra en los planes Pro, Max, Team y Enterprise; después pasa a créditos de uso.
¿Claude Fable 5 es mejor que Claude Opus 4.8?
No. En la corrida de junio, sobre los 162 tests que ambos compartían, Fable 5 sacó 8.58 y Opus 4.8, 8.81: de 25 categorías, Fable ganaba 3 y perdía 18. Su única ventaja clara era el trabajo agéntico de horizonte largo (+1.21), y con la medición de septiembre de 2026 hasta eso se dio vuelta: 6,6 contra 8,08 de Opus. Hoy no hay caso donde el doble de precio se sostenga con mis números.
¿Qué es Claude Mythos 5 y en qué se diferencia de Fable 5?
Claude Mythos 5 es el mismo modelo con las mismas capacidades y el mismo precio, pero sin los clasificadores de seguridad que pueden rechazar solicitudes. No está disponible al público: se ofrece solo a clientes aprobados dentro del programa Project Glasswing de Anthropic. Si no tienes ese acceso, la vía es Fable 5, que es la versión disponible de forma general.
¿Hasta cuándo está incluido Claude Fable 5 en la suscripción de Claude?
Anthropic lo incluyó sin costo extra en los planes Pro, Max, Team y Enterprise desde el lanzamiento (9 de junio) hasta el 22 de junio de 2026. Desde el 23 de junio sale de esos planes y se usa con créditos de uso. Ojo con un detalle: mientras está incluido, cada sesión de Fable consume los límites del plan aproximadamente al doble de velocidad que una sesión de Opus.
🧠 ¿No sabes qué modelo de IA usar?
Intro a LLMs te da el criterio para elegir modelo por costo y caso de uso — y cierra con un test A/B real de 5 modelos en OpenRouter.
Ver el curso