Claude Fable 5.1 ya está disponible: el modelo más potente de Anthropic (y qué cambia realmente)
El 1 de septiembre de 2026 Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1. Sobre el papel, Fable 5.1 es hoy el modelo más capaz que existe públicamente: encabeza el índice de inteligencia de Artificial Analysis y duplica a su predecesor en investigación científica agéntica.
Dicho eso, y para no vender humo: no es un salto generacional. Es una actualización de mantenimiento con una mejora enorme en un solo eje (ciencia), mejoras moderadas en código, y una historia de precios que es más complicada de lo que dice el marketing.
Vamos por partes.
Qué son Fable 5.1 y Mythos 5.1
Lo primero que confunde a todo el mundo: son el mismo modelo. Los pesos son idénticos. Lo único que los diferencia es la capa de salvaguardas que Anthropic pone encima.
- Claude Fable 5.1 — disponible para cualquiera con cuenta de API o plan pago. Tiene clasificadores de seguridad activos: si le preguntas algo sobre ciberofensiva o biología peligrosa, la petición se redirige a un modelo Opus.
- Claude Mythos 5.1 — el mismo modelo con esas salvaguardas relajadas. No es público. Está restringido a organizaciones estadounidenses verificadas dentro de dos programas: el Cyber Verification Program (defensa en ciberseguridad) y el Life Sciences Verification Program (investigación biológica, desarrollado junto al gobierno de EE.UU.). Anthropic dice que planea abrirlo a socios internacionales, sin fecha.
La jerarquía de Anthropic queda así, de menor a mayor: Haiku → Sonnet → Opus → clase Mythos (donde viven Fable y Mythos).
Nota de contexto: esta línea ya tiene historia. Fable 5 salió el 9 de junio de 2026 y el 12 de junio el Departamento de Comercio de EE.UU. obligó a Anthropic a bloquear el acceso a extranjeros, tras que investigadores de Amazon lograran saltar el filtro de ciberseguridad. Los modelos estuvieron apagados globalmente cerca de 19 días y volvieron el 30 de junio.
Especificaciones técnicas de Claude Fable 5.1
| Especificación | Claude Fable 5.1 |
|---|---|
| ID de API | claude-fable-5-1 |
| Ventana de contexto | 1 millón de tokens |
| Salida máxima | 128.000 tokens |
| Thinking | Adaptativo, siempre activo (no se puede desactivar) |
| Niveles de esfuerzo | low, medium, high, xhigh, max |
| Corte de conocimiento | Junio 2026 |
| Precio | $10 por millón de tokens de entrada / $50 de salida |
| Lectura de caché | $0,25 por millón (antes $1,00) |
| Disponible en | Claude API, Claude Code, claude.ai, Claude Cowork, Amazon Bedrock, Google Cloud, Microsoft Foundry |
Documentación oficial: platform.claude.com — Fable 5.1
Los benchmarks: dónde mejoró de verdad
Estos son los números que publicó Anthropic. Recuerda que son benchmarks del propio fabricante, con un error estándar reportado de entre 3,5 y 4,5 puntos según el modelo.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Investigación científica agéntica (Terminal-Bench-Science 0.1) | 52,6 % | 24,7 % | 29,0 % | 22,4 % |
| Código agéntico (Terminal-Bench 4.0) | 55,8 % (Mythos: 60,9 %) | 42,0 % | 52,3 % | 37,3 % |
| Trabajo de conocimiento (GDPval-AA v2) | 1853 | 1723 | 1824 | 1711 |
| Uso de computadora (OSWorld 2.0, parcial) | 77,9 % | 72,9 % | 75,4 % | — |
| Razonamiento multidisciplinario (HLE, sin herramientas) | 60,9 % | 57,8 % | 56,6 % | — |
| Flujos de negocio (AutomationBench) | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| Código agéntico (CursorBench 3.2.0) | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
Cómo leer esta tabla
El salto está en un solo lugar: ciencia. Terminal-Bench-Science 0.1 pasó de 24,7 % a 52,6 %, más del doble. Ese benchmark cubre 70 flujos de trabajo aportados por científicos reales (ciencias de la vida, físicas, de la Tierra, matemáticas e ingeniería), donde el agente trabaja en una terminal aislada y entrega artefactos que se evalúan contra tests ocultos.
En código la mejora es real pero moderada: +13,8 puntos en Terminal-Bench 4.0, y apenas +2,9 en CursorBench. Si tu uso principal es programar, esto no cambia tu vida.
En razonamiento general casi no se movió: +3,1 puntos en Humanity's Last Exam. AutomationBench sí casi se duplicó, que es probablemente el dato más interesante para quien construye agentes de negocio.
En el índice de inteligencia de Artificial Analysis —un tercero que aplica las mismas pruebas a todos los modelos— Fable 5.1 puntúa 66, por delante de Opus 5 (63) y GPT-5.6 Sol (61).
Precios: la parte donde el marketing y la realidad no coinciden
Anthropic redujo el costo de lectura de caché de $1,00 a $0,25 por millón de tokens: un recorte del 75 %. Con eso, la empresa afirma:
- ~25 % menos costo en cargas de trabajo típicas
- Hasta 45 % menos en cargas altamente agénticas (ejecuciones largas con muchas llamadas a herramientas)
El precio base no bajó: sigue en $10 / $50 por millón de tokens. Para comparar, Opus 5 cuesta la mitad ($5 / $25).
El asterisco importante
Artificial Analysis, que participó en las pruebas previas al lanzamiento, cuestionó públicamente esa cifra de ahorro. Su medición: aunque el recorte de caché ahorra alrededor de $1,40 por tarea agéntica, Fable 5.1 en esfuerzo máximo consume cerca de 1,7 veces más tokens de salida que Fable 5, y termina costando un 20 % más por tarea.
En números concretos: a esfuerzo máximo, Fable 5.1 sale en $3,76 por tarea del Intelligence Index, frente a $2,34 de Opus 5, que puntúa solo tres puntos menos. En esfuerzo extra-high, Fable 5.1 baja a $2,72 y puntúa 65, pero sigue costando más que Opus 5.
Traducción práctica: si estás pagando por token, para la mayoría de tareas Opus 5 es la mejor relación precio/rendimiento. Fable 5.1 solo se justifica donde ese margen de puntos importa de verdad.
Los niveles de esfuerzo son la palanca real aquí. En esfuerzo bajo o medio, Fable 5.1 iguala los resultados de Fable 5 a un costo bastante menor.
Seguridad: qué se abrió y qué sigue cerrado
Este es el bloque con más cambios y el más malinterpretado.
Ciberseguridad: se abrió parcialmente
Fable 5.1 ya puede usarse para descubrir vulnerabilidades de software, algo que su predecesor redirigía automáticamente. Lo que sigue bloqueado es el desarrollo de exploits y el pentesting ofensivo: esas peticiones se siguen enrutando a modelos Opus.
Anthropic reporta 60 % menos falsos positivos en los clasificadores de ciberseguridad. Este era el reclamo número uno con Fable 5, que llegó a bloquear peticiones tan inocuas como editar un currículum de arquitecto de seguridad.
Biología: sigue restringida
Las capacidades avanzadas de biología siguen cerradas en Fable 5.1. Para acceder a ellas hay que entrar al Life Sciences Verification Program con Mythos 5.1, que por ahora es solo para organizaciones de EE.UU. verificadas.
Lo que sí mejoró: los filtros disparan 85 % menos en preguntas inofensivas de biología y medicina básica. En su system card, Anthropic reconoce que el modelo tiene capacidades de nivel CB-1, es decir, que podría bajar la barrera técnica para sintetizar armas biológicas o químicas. Por eso el candado.
Seguridad agéntica y prompt injection
Anthropic describe a Fable 5.1 como su modelo más robusto hasta la fecha frente a un benchmark externo de prompt injection, y dice que es notablemente menos propenso que Mythos 5 a intentar accesos no autorizados a recursos durante tareas agénticas.
Esto importa mucho si usas skills, MCP o agentes que leen contenido de terceros: si una herramienta trae una inyección escondida, el modelo debería negarse a ejecutarla.
Anti-destilación: el cambio que puede romperte código
Este es el cambio técnico más silencioso y el que más te puede afectar si construyes sobre la API.
Las cuentas de API nuevas ya no pueden editar el contexto alrededor de un bloque de thinking en una conversación multi-turno. La API ahora verifica que el bloque de thinking se devuelva con el mismo system prompt, las mismas herramientas y los mismos mensajes que lo produjeron. Si no coinciden, devuelve error.
Acciones que ahora rompen la cadena:
- Editar, reordenar o eliminar un turno anterior conservando los posteriores
- Inyectar texto por petición en un turno anterior que luego se borra
- Reconstruir el system prompt o el array de herramientas entre peticiones
Anthropic lo hace para cerrar una técnica de destilación pública y documentada. El problema: muchos harnesses de agentes compactan o reescriben el historial justo así. Las cuentas existentes todavía no están afectadas, pero la restricción se extenderá a todos en lanzamientos futuros.
Detalles oficiales: Preserved thinking — Claude Support
Otros dos cambios que casi nadie mencionó
Marca de agua invisible. Fable 5.1 y Mythos 5.1 son los primeros modelos de Claude que salen con marca de agua estadística en sus salidas, para cumplir con el AI Act europeo. No altera el texto ni contiene datos del usuario. Hay una API de detección en preview privado para reguladores, medios, verificadores de datos e instituciones de investigación.
No soporta forced tool use. Si tu integración usa tool_choice con valor any o con una herramienta nombrada, vas a recibir un error de petición inválida. Solo funcionan auto y none. Revisa esto antes de migrar.
Enterprise Frontier Safeguards (EFS)
Aquí hay que precisar algo, porque circula mal explicado. EFS no borra tus datos al terminar de procesarlos. Lo que hace es permitir a clientes empresariales elegibles desplegar los modelos manteniendo sus datos en su propia infraestructura de nube, con retención cero donde aplique.
Por defecto, Fable 5.1 es un Covered Model: eso implica retención obligatoria de 30 días y posibilidad de revisión humana para trabajo de seguridad. EFS es la excepción, no la norma, y su despliegue es por fases a partir del otoño de 2026.
Verificación: tres cosas que conviene precisar
Como este lanzamiento generó mucha cobertura rápida, vale la pena aclarar tres afirmaciones que circularon en las primeras horas:
1. "Los tres modelos más potentes del mundo son de Anthropic." Según el índice de Artificial Analysis, Anthropic tiene el primer y segundo puesto (Fable 5.1 con 66 y Opus 5 con 63). El tercero es GPT-5.6 Sol con 61. Es un liderazgo claro, pero no un barrido del podio.
2. "Fable 5.1 consume muchos menos tokens." Es al revés en esfuerzo máximo: la medición de Artificial Analysis indica ~1,7x más tokens de salida que Fable 5. El ahorro viene del caché, no del consumo.
3. "En ciberseguridad sigue igual que el modelo anterior." No. Este es justamente uno de los cambios principales: descubrimiento defensivo de vulnerabilidades ahora está permitido, y los falsos positivos bajaron 60 %. Lo que sigue bloqueado es la creación de exploits.
Cómo acceder a Claude Fable 5.1
En Claude Code: escribe /model y selecciónalo. El esfuerzo por defecto es high en la API y en Claude Code, y medium en claude.ai y Claude Cowork.
En la API: usa el ID claude-fable-5-1. En Amazon Bedrock es anthropic.claude-fable-5-1.
En planes de suscripción — ojo con esto:
- Pro ($20) y asientos Team estándar: Fable 5.1 no está incluido. Se consume con créditos de uso de pago por uso.
- Max y asientos Team premium o Enterprise: incluido dentro de los límites semanales compartidos del plan, hasta cierto porcentaje.
Si tienes Pro y esperabas usarlo libremente, esa no es la realidad. Para uso diario con suscripción, Opus 5 o Sonnet 5 siguen siendo la opción sensata.
Entonces, ¿vale la pena?
Depende bastante de qué haces:
Sí te conviene si:
- Trabajas en investigación científica computacional (diseño molecular, análisis de datos experimentales, modelado)
- Construyes agentes de largo horizonte con muchas llamadas a herramientas y aprovechas caché agresivamente
- Necesitas descubrimiento defensivo de vulnerabilidades
- Automatizas flujos de negocio complejos (el salto en AutomationBench es notable)
No te conviene si:
- Tu uso principal es escribir código del día a día — la mejora existe pero es marginal frente a Opus 5, que cuesta la mitad
- Pagas por token y el presupuesto importa
- Estás en plan Pro y no quieres gastar créditos extra
La lectura de fondo de este lanzamiento no es "más inteligencia". Es resistencia y economía: aguantar tareas largas sin perder el hilo, y hacerlas más baratas mediante caché. Que es, honestamente, lo que la mayoría de gente construyendo agentes necesitaba más que otro punto de benchmark.
Preguntas frecuentes
¿Cuál es la diferencia entre Claude Fable 5.1 y Mythos 5.1? Son el mismo modelo con distintos niveles de salvaguardas. Fable 5.1 es de disponibilidad general; Mythos 5.1 está restringido a organizaciones estadounidenses verificadas en programas de ciberseguridad y ciencias de la vida.
¿Claude Fable 5.1 está incluido en el plan Pro de $20? No. En Pro y asientos Team estándar se paga con créditos de uso. Max y asientos premium sí lo incluyen dentro de sus límites semanales.
¿Cuánto cuesta Claude Fable 5.1 en la API? $10 por millón de tokens de entrada y $50 por millón de salida. La lectura de caché bajó a $0,25 por millón.
¿Puedo usar Fable 5.1 para ciberseguridad? Para descubrimiento defensivo de vulnerabilidades, sí. Para crear exploits o pentesting ofensivo, no: esas peticiones se redirigen a modelos Opus.
¿Fable 5.1 es mejor que GPT-5.6 Sol? En los benchmarks agénticos publicados por Anthropic y en el índice de Artificial Analysis, sí. En algunas pruebas puntuales otros modelos siguen por delante, y conviene esperar mediciones independientes de las próximas semanas.
¿Qué corte de conocimiento tiene? Junio de 2026, cinco meses más reciente que Fable 5.
Fuentes
- Anuncio oficial de Anthropic — Claude Fable y Mythos 5.1
- Documentación de Claude Fable 5.1
- Preserved thinking y cambios anti-destilación
- Artificial Analysis — Claude Fable 5.1
- The Decoder — análisis del lanzamiento y disputa sobre los ahorros
- Introducing Claude Fable 5.1 on AWS
¿Ya le encontraste un uso concreto a Fable 5.1 más allá de programar? Cuéntamelo en los comentarios del video. Y si necesitas ayuda para decidir qué modelo usar en tu proyecto o cómo estructurar tus agentes sin quemar presupuesto, puedes reservar una asesoría personalizada en fazt.dev.