Claude Fable 5 ya está disponible: 80,3% en SWE-Bench Pro, precios 2× Opus 4.8, gratis hasta el 22 de junio
Anthropic lanzó hoy el primer modelo de clase Mythos disponible públicamente: Claude Fable 5, con salvaguardas que recurren a Opus 4.8 ante prompts de alto riesgo. 80,3% en SWE-Bench Pro (11 puntos por encima de Opus 4.8). $10/$50 por 1 millón de tokens. Gratis en los planes Pro/Max hasta el 22 de junio, luego con medición por créditos.
Anthropic lanzó hoy su primer modelo de clase Mythos disponible públicamente. Claude Fable 5 quedó disponible de forma general en la API de Claude, AWS Bedrock, Vertex AI y Microsoft Foundry el 9 de junio de 2026 — junto con Claude Mythos 5, el mismo modelo subyacente pero con las restricciones de seguridad levantadas, mantenido dentro del programa de socios de Project Glasswing. El precio de ambos es $10 de entrada / $50 de salida por 1M de tokens — exactamente 2× la tarifa de Claude Opus 4.8.
Los detalles más interesantes no están en el titular, sin embargo. Bajo los números del lanzamiento hay un giro de precios significativo (gratuito en Pro/Max hasta el 22 de junio, luego con medición de créditos), un perfil de benchmarks de vanguardia que genuinamente separa a Fable 5 de la frontera anterior, y una nueva elección arquitectónica — salvaguardas de clasificador automatizadas que recurren a Opus 4.8 en lugar de rechazar — que afecta materialmente cómo se despliega.
Qué se lanzó
| Detalle | Valor |
|---|---|
| Nombre del modelo | Claude Fable 5 (público) + Claude Mythos 5 (restringido) |
| ID del modelo en API | claude-fable-5 |
| Precio de entrada | $10/1M tokens |
| Precio de salida | $50/1M tokens |
| vs precio Opus 4.8 | 2× ($5/$25) |
| Disponibilidad | API de Claude, AWS Bedrock, Vertex AI, Microsoft Foundry |
| Acceso por suscripción | Pro / Max / Team / Enterprise — gratuito hasta el 22 de junio de 2026 |
| Después del 22 de junio | Requiere créditos de uso adicionales además de la suscripción |
| Acceso a Mythos 5 | Solo socios de Project Glasswing; investigadores de biología mediante programa de acceso de confianza |
Dos notas de precios que vale la pena destacar:
- La ventana gratuita de 13 días es la palanca de lanzamiento. Anthropic está usando el paquete de suscripción para impulsar la adopción durante las primeras dos semanas. Después del 22 de junio, el mismo modelo en Pro/Max requiere la compra explícita de créditos, lo que vuelve a situar a los usuarios en producción en la matemática de facturación por token a la tarifa de $10/$50.
- El precio 2× de Opus 4.8 es elevado, pero la brecha en benchmarks explica la mayor parte (ver más abajo). A $50/1M de salida, Fable es el modelo de frontera más caro del mercado — aproximadamente 3.3× Sonnet 4.6, 5× GPT-5.5 y 5.5× Gemini 3.5 Flash en tokens de salida.
Los benchmarks — y lo que realmente muestran
Fable 5 se lanza con afirmaciones de vanguardia en “casi todos los benchmarks evaluados”. Los números que Anthropic publicó y que son más concretos y directamente comparables:
| Benchmark | Fable 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-Bench Pro | 80.3% | 69.2% | 58.6% | 54.2% |
| FrontierCode | 29.3% | 13.4% | 5.7% | — |
Tres lecturas:
80.3% en SWE-Bench Pro es el número de carga. Esta es la variante más difícil de SWE-Bench y la que mejor predice el rendimiento de un modelo en código de producción real. Fable 5 supera a Opus 4.8 por 11.1 puntos, a GPT-5.5 por 21.7 puntos y a Gemini 3.1 Pro por 26.1 puntos. Eso es una brecha de nivel, no una ventaja marginal. Para flujos de trabajo de codificación donde se compara la calidad del modelo directamente, esta es la mayor ventaja de frontera en un solo eje reportada este año.
FrontierCode es el número más revelador. Este benchmark apunta al nivel más difícil de problemas de programación — puzzles algorítmicos abstractos, trabajo con estructuras de datos novedosas, optimización crítica de rendimiento. Fable 5 con 29.3% supera más de 2× a Opus 4.8 y más de 5× a GPT-5.5. En un benchmark donde el techo de frontera ronda el 30%, este tipo de salto es lo más cercano a evidencia de un cambio de nivel que los datos de benchmark pueden proporcionar.
Los estudios de caso de Anthropic respaldan los números. Stripe supuestamente usó Fable 5 para completar una migración de base de código de 50 millones de líneas en un día. Hebbia reporta que Fable 5 es el máximo anotador en su Finance Benchmark. IMC dice que “superó sus evaluaciones de análisis de trading casi en todos los aspectos”. Estos son testimonios favorables a la empresa, pero la consistencia del encuadre “trabajo de conocimiento en código/finanzas/conocimiento científico” entre múltiples clientes independientes es la señal que merece más peso.
Lo que no está en la publicación de benchmarks: números de Terminal-Bench, GPQA, MMLU, HumanEval, AIME. Anthropic parece haber priorizado SWE-Bench Pro y FrontierCode como las métricas de codificación principales, lo cual es coherente con el posicionamiento del modelo como frontera en ingeniería de software.
Las salvaguardas — una elección arquitectónica diferente
La razón por la que Fable 5 puede lanzarse públicamente son las tres salvaguardas de clasificador automatizadas que Anthropic construyó sobre Mythos 5:
- Ciberseguridad — bloquea tareas cibernéticas ofensivas y desarrollo de exploits
- Biología/Química — recurre a Opus 4.8 en la mayoría de solicitudes de bio/química con riesgo de uso dual (específicamente incluyendo diseño de AAV)
- Prevención de destilación — bloquea intentos de extraer capacidades para modelos competidores
La elección arquitectónica que importa: cuando se activa una salvaguarda, la respuesta es manejada por Opus 4.8 en lugar de rechazarse. Esa es una elección significativa de UX. Los usuarios obtienen una respuesta utilizable a la mayoría de consultas incluso cuando el razonamiento de frontera de Fable 5 está bloqueado tras una revisión de seguridad. Anthropic reporta que más del 95% de las sesiones de Fable no involucran ningún fallback — lo que significa que las salvaguardas están calibradas con suficiente precisión para que los flujos de trabajo en producción en su mayoría no las noten.
Resultados de red-teaming externo:
- Más de 1,000 horas de pruebas externas de bug bounty — no se descubrieron jailbreaks universales
- Cero solicitudes de ciberseguridad dañinas en un solo turno atendidas en 30 técnicas públicas de jailbreak
- Un red-teamer externo calificó las salvaguardas como “las más robustas de cualquier modelo evaluado”
Para los desarrolladores que despliegan aplicaciones orientadas al cliente, esto es una postura operativa diferente a rechazar cuando se activa una política. Puedes construir producto sobre el modelo sin diseñar UX de fallback para cada rechazo de seguridad — Opus 4.8 maneja la cola larga de forma invisible.
Mythos 5 — y lo que su existencia implica
El mismo modelo con las salvaguardas levantadas se lanza como Mythos 5, restringido a socios de ciberseguridad de Project Glasswing y en expansión mediante un programa de acceso de confianza para investigadores de biología. La brecha de capacidades entre Fable 5 y Mythos 5 se concentra en tres categorías:
- ExploitBench (ciberseguridad): Mythos 5 al 78% vs el 40% de Opus 4.8 (Fable 5 no ejecuta este benchmark porque las instrucciones de ciberseguridad activan la salvaguarda)
- Diseño de fármacos: Mythos 5 supuestamente aceleró los procesos de diseño de proteínas ~10×, con 9 de 14 objetivos produciendo candidatos a fármacos
- Generación de hipótesis científicas: hipótesis novedosas de biología molecular preferidas ~80% del tiempo en comparaciones ciegas de expertos
La existencia de Mythos 5 indica que el modelo subyacente tiene capacidades materialmente más fuertes de lo que Fable 5 expone. Para la mayoría de los flujos de trabajo en producción eso es invisible — pero para la investigación de seguridad, el descubrimiento de fármacos y dominios similares, la rama Mythos es donde vive la frontera real. El acceso público está bloqueado específicamente porque Anthropic concluyó que el modelo sin procesar tiene riesgos de uso dual que las salvaguardas de clasificador existen para mitigar.
Lo que la ruptura del patrón Sonnet te dice
Hace dos semanas argumenté que el patrón histórico de Anthropic de emparejar versiones menores de Opus y Sonnet hacía más probable un lanzamiento de Sonnet 4.7 que Sonnet 4.8. El patrón se rompió más de lo que esperaba: no hay Sonnet 4.7, no hay Sonnet 4.8, y ahora la rama Mythos es el lanzamiento principal. Opus 4.8 se lanzó para llenar el espacio de nivel Pro; Fable 5 ocupa un nivel completamente nuevo por encima de él.
Tres interpretaciones de lo que esto significa para la línea de Claude en el futuro:
- La rama Mythos es la nueva frontera, con Sonnet y Opus como opciones de nivel productivo por debajo de ella. El techo de capacidades ha subido visiblemente.
- El naming se ha desacoplado del versionado. En adelante, espera más ramas con nombre (Mythos, Fable) y menos de la tríada Opus/Sonnet/Haiku. El enfoque de cadena-en-mapa-de-fuentes para predecir lanzamientos de modelos está muerto.
- La separación de niveles de precios se está ampliando. Fable 5 a $10/$50 es 2× Opus 4.8, que ya era 5× Haiku 4.5. El costo de la capacidad de frontera está aumentando más rápido que el costo de la capacidad de grado productivo — lo que significa que las decisiones de enrutamiento importan más que antes.
Dónde encaja Fable 5 en producción hoy
Lecturas concretas de despliegue:
Usa Fable 5 para:
- Flujos de trabajo con mucho código donde el rendimiento en SWE-Bench Pro importa directamente — migraciones a gran escala, trabajo con algoritmos novedosos, refactorizaciones críticas de rendimiento. La ventaja de 11 puntos sobre Opus 4.8 se traduce en una salida notablemente mejor en bases de código reales.
- Trabajo de conocimiento rico en visión — extracción de datos estructurados de figuras científicas, reconstrucción de aplicaciones web a partir de capturas de pantalla, procesamiento de documentación técnica con diagramas integrados.
- Razonamiento de contexto largo — el posicionamiento de Anthropic enfatiza “mantener el foco en millones de tokens”, lo que sugiere que la curva de degradación del modelo en el extremo de contexto 1M+ es notablemente mejor que la frontera anterior.
- Análisis financiero/de trading — benchmarks independientes (Hebbia) sitúan a Fable 5 en la cima de las evaluaciones específicas de finanzas.
Mantente en alternativas más económicas para:
- Generación de alto volumen / bajo riesgo — a $50/1M de salida, Fable 5 no es económico para la generación de contenido, clasificación o extracción estructurada. Sonnet 4.6 o Gemini 3.5 Flash hacen este trabajo al ~10% del precio.
- Flujos de trabajo de agentes orquestados por MCP / herramientas — Gemini 3.5 Flash actualmente lidera MCP Atlas y Toolathlon a una fracción del costo. La fortaleza de Fable en codificación no se traduce automáticamente en fortaleza en orquestación de agentes.
- Consultas de ciberseguridad o biología donde Fable recurrirá al fallback de todos modos — estás pagando el precio de Fable por la salida de Opus 4.8. Simplemente usa Opus 4.8 directamente.
Cómo acceder a Claude Fable 5 hoy
Tres rutas de despliegue:
- Directamente a través de Anthropic —
claude-fable-5está disponible en la API de Claude y en AWS Bedrock, Vertex AI y Microsoft Foundry. Gratuito en los planes Pro/Max hasta el 22 de junio; la facturación por token comienza después a $10/$50. - A través del endpoint LLM de WaveSpeedAI — acceso compatible con OpenAI a los modelos de texto de frontera actuales tras una única clave API. Cuando Fable 5 se propague por la plataforma, podrás hacer pruebas A/B con él frente a Opus 4.8, Sonnet 4.6, GPT-5.5 y Gemini 3.5 Flash bajo la misma interfaz sin rotar credenciales de proveedor.
- A través de routers de proveedores — si estás en un agregador (Vercel AI SDK, LangChain, etc.), el ID de modelo
claude-fable-5ya está en el registro público de modelos. Las políticas de enrutamiento para “usar Fable para tareas pesadas en SWE, Sonnet para todo lo demás” se convierten en un cambio de configuración de una línea.
Qué observar en las próximas dos semanas
Tres señales:
- Transición de precios del 22 de junio. Cuando termine la ventana gratuita de Pro/Max, la señal de adopción pública se convierte en cuántos suscriptores realmente pagan exceso por Fable 5. Esa es la lectura más clara de si el precio 2× de Opus 4.8 es sostenible para la larga cola de casos de uso.
- Replicación independiente de benchmarks. Los números de SWE-Bench Pro y FrontierCode de Anthropic son de primera parte. Observa la replicación por parte de suites de benchmarks independientes — y busca evidencia de si la ventaja de 11 puntos sobre Opus 4.8 se mantiene fuera de los conjuntos de prueba curados por Anthropic.
- El próximo lanzamiento de Sonnet. Con Mythos como la nueva rama de frontera, ¿qué pasa con Sonnet? Un Sonnet actualizado posicionado frente a Gemini 3.5 Flash en benchmarks de costo/agente reanclaría el nivel de valor de la línea Claude. El silencio sobre Sonnet señalaría que Anthropic está dejando que el nivel de producción continúe con el 4.6 por más tiempo de lo que la cadencia histórica sugiere.
Hasta entonces: Fable 5 es el nuevo techo, Opus 4.8 es el estándar de grado productivo, y Sonnet 4.6 sigue siendo la opción de valor. Las próximas dos semanas dirán si la rama Mythos es una frontera puntual o la nueva normalidad para la cadencia de lanzamientos de Anthropic.
