Claude Fable 5 para programar: benchmarks, cuándo usarlo frente a Opus 4.8 y la realidad del coste
Claude Fable 5, lanzado el 9 de junio de 2026 como el primer modelo clase Mythos disponible públicamente de Anthropic, se examina aquí solo para programación (el lanzamiento completo se cubre aparte). En pocas palabras: Fable 5 se distancia cuanto más difícil se vuelve la programación. Obtiene un 95.0% en SWE-bench Verified y un 80.3% en el más exigente SWE-bench Pro (frente al 69.2% de Opus 4.8 y el 58.6% de GPT-5.5), y un 29.3% en el difícil FrontierCode Diamond (frente al 13.4% de Opus y el 5.7% de GPT-5.5, ~5x GPT), mientras que Terminal-Bench 2.1 es una carrera reñida en 84.3% (GPT-5.5 sigue competitivo vía Codex CLI). El artículo ofrece un resumen para desarrolladores en tres puntos (el más fuerte en problemas difíciles / termina en menos turnos / pero caro y no se detiene), una tabla comparativa de benchmarks y cómo leerla (cuanto más difícil el benchmark, mayor la brecha; el trabajo en terminal está reñido), la propiedad de escalar con effort (de 11.5% bajo a 30.9% máximo, mientras GPT-5.5 se estanca en 5-6%; cuanto más larga y compleja la tarea, mayor la ventaja; cinco agentes en paralelo alcanzaron un 60% de aprobado en pruebas ocultas 3.2x más rápido que uno solo), en qué es realmente bueno (grandes refactorizaciones multiarchivo, ejecuciones agénticas largas, front-end a partir de una captura, diseño de API más pruebas más documentación; Simon Willison valoró el resultado como varios días de trabajo aunque lo llamó lento y caro con más de $110 en 5.5 horas), sus debilidades (~2x el precio de Opus 4.8 a $10/$50, sesiones complejas de 500k-1M tokens, juzga mal cuándo parar y sigue ejecutándose, su precisión de revisión va por detrás de Opus, los clasificadores de seguridad recurren a Opus 4.8 en cerca del 20% de las pruebas de Terminal-Bench, y tiende a reportar probado sin ejecutar), la guía de enrutamiento (Opus 4.8 por defecto, escalar el 10-20% más difícil a Fable 5, el trabajo en terminal a GPT-5.5, conmutable por model ID) y dónde usarlo (Claude Code, GitHub Copilot, AWS Bedrock, Azure Foundry, Databricks, Anthropic API) con precios, contexto de 1M tokens, salida máxima de 128k y la ventana gratuita del 9 al 22 de junio. Fable 5 para el encargo pesado puntual, Opus 4.8 para la mayor parte del día a día. Las cifras se citan de informes de Anthropic y de terceros y son orientativas, dependientes del scaffold.