Claude Fable 5: review con benchmark real (Junio 2026)
Claude Fable 5 es la nueva línea "Mythos" de Anthropic, lanzada en junio de 2026. Lo corrimos por 131 tests reales con juez neutral Phi-4: obtiene score global 3.01 (calidad 7.65 — el score compuesto carga su costo), con un precio de $10.00 / $50.00 por millón de tokens. ¿Vale la pena? La respuesta corta: solo si tu caso justifica pagar el premium de Anthropic.
¿Qué mide este benchmark?
No es un benchmark académico: es un benchmark aplicado para emprendedores hispanohablantes. Medimos qué modelo conviene poner en producción para casos reales, con lo que los benchmarks oficiales no cubren — costo en provider real, velocidad, español neutro y agentes multi-turno.
Contamos con 170 modelos catalogados, 121 testeados y 15,000+ tests reales evaluados por un LLM-as-Judge local (Phi-4, de Microsoft — sin conflicto de interés), en 4 pilares:
- Coding — generar código, JSON estructurado y debugging en tareas reales (plugins WordPress, scripts, templates de N8N).
- Contenido — blogs, copy y textos largos en español neutro (no traducción del inglés).
- Razonamiento — matemáticas, lógica formal y planificación multi-paso.
- Agentes — multi-turno largo, tool calling y flujos tipo N8N / Hermes.
El score global v3.0 es una función ponderada: calidad 70% + costo 15% + velocidad 7,5% + latencia 7,5%. Tool calling se reporta como badge de capacidad, no entra en el score. Mide valor para producción, no solo capacidad bruta. Metodología y tests completos.
Fable 5 vs alternativas directas
| # | Modelo | Score | $ in/out per M | License | Provider |
|---|---|---|---|---|---|
| 1 | Claude Fable 5 | 3.01 | $10.00 / $50.00 | Propietaria | openrouter (53 tok/s) |
| 2 | DeepSeek R1 (reasoning) | 8.37 | $0.70 / $2.50 | MIT | openrouter (22 tok/s) |
¿Qué es Claude Fable 5?
Fable 5 es un modelo de Anthropic orientado a contenido, agentes multi-turno y razonamiento. No es el flagship de la familia (Opus 4.8 sigue arriba en casi todo), sino una apuesta intermedia con velocidad similar a Opus (~60 tok/s) y un precio que lo acerca más a Opus que a Sonnet.
- Score global: 3.01 — hundido por el costo más caro del catálogo y los bloqueos de política en API.
- Calidad por pilar: Contenido 6.93, Agentes 5.84, Coding 5.51, Razonamiento 6.79.
- Costo: $10.00 input / $50.00 output por millón.
- Velocidad: ~60 tok/s en suscripción Anthropic.
- Licencia: Propietaria (suscripción Claude / Anthropic API).
Veredicto: ¿cuándo conviene Fable 5?
No conviene como modelo único. Por el mismo ecosistema, Sonnet 4.6 entrega mejor score global (7.80) a la mitad de costo, y Opus 4.8 es más fuerte en todos los pilares (7.88) por $5/$25. Fable 5 queda en una zona incómoda: más caro que Sonnet, peor que Opus.
Sí tiene sentido si ya pagás suscripción Claude Pro/Max y querés un modelo con tono más creativo/narrativo para contenido largo o brainstorming, sin salir del stack Anthropic. Pero para producción con volumen, MiniMax M3 (7.92, $0.30/$1.20) o DeepSeek R1 (8.33, $0.70/$2.50) entregan mucho más valor por dólar.
Fable 5 por tipo de trabajo
- Coding: 5.51/10. Por debajo de Sonnet 4.6 (—/10) y muy por debajo de modelos open-source baratos como Ministral 14B. No lo elegiría para code-generation en producción.
- Contenido: 6.93/10. Bueno, pero Opus 4.8 (—/10) y Sonnet 4.6 (—/10) rinden similar o mejor por menos.
- Razonamiento: 6.79/10. Sólido, pero DeepSeek R1 lidera este grupo (7.06/10).
- Agentes: 5.84/10. Competitivo, aunque Sonnet 4.6 (6.96/10) lo supera.
Comparaciones detalladas
Si querés ver el enfrentamiento pilar por pilar, tenemos comparaciones automáticas generadas a partir de los mismos datos:
Preguntas frecuentes
¿Claude Fable 5 es mejor que Opus 4.8?
No para uso por API: Opus 4.8 supera a Fable 5 en score global y cuesta la mitad ($5/$25 vs $10/$50 por millón). Vía suscripción de Claude Code la historia se invierte: ahí Fable lidera entre los Claude a costo marginal cero.
¿Vale la pena pagar por Claude Fable 5?
Solo si ya estás en el ecosistema Anthropic y preferís su tono para contenido creativo. Para producción con volumen, MiniMax M3 y DeepSeek R1 ofrecen mejor relación calidad/precio.
¿Fable 5 es bueno para programar?
No es su fuerte: 6.67/10 en Coding, por debajo de Sonnet 4.6, Opus 4.8 y modelos open-source especializados como Ministral 14B o Qwen3-Coder.
¿Qué significa 'Mythos' en Claude Fable 5?
Es la marca interna/línea de lanzamiento de Anthropic para esta variante de junio 2026, posicionada entre Sonnet y Opus en precio pero no en rendimiento.
Probá la calculadora con tu caso real
Filtrá por presupuesto mensual, calidad mínima, velocidad requerida y tipo de tarea. En 30 segundos encontrás el mejor para vos.
Ir a la calculadora →