Anthropic presentó Claude Fable 5.1 y Mythos 5.1, dos versiones del mismo modelo con distintos niveles de protección. La compañía promete más rendimiento en programación, investigación científica y tareas autónomas, junto con reducciones de costos de hasta 45% y nuevas restricciones para biología y ciberseguridad.
Anthropic presentó Claude Fable 5.1 y Claude Mythos 5.1, una nueva generación de modelos que la compañía define como la más avanzada que desarrolló hasta ahora para programación, trabajo de conocimiento e investigación científica.
Aunque ambos modelos comparten las mismas capacidades centrales, la diferencia está en sus sistemas de protección. Fable 5.1 estará disponible de forma general, mientras que Mythos 5.1 quedará restringido a programas de acceso verificado, principalmente para especialistas en ciberseguridad y ciencias de la vida.
El lanzamiento también introduce cambios comerciales relevantes. Anthropic estima que Fable 5.1 costará alrededor de 25% menos que Fable 5 en cargas de trabajo típicas, mientras que en tareas altamente agénticas —aquellas en las que el modelo trabaja durante períodos prolongados utilizando herramientas y grandes cantidades de contexto— el ahorro podría alcanzar aproximadamente el 45%.
La reducción se explica principalmente por una caída del 75% en el precio de las lecturas de caché, que ahora cuestan U$S 0,25 por millón de tokens.
El resto de los precios se mantiene sin cambios: U$S 10 por millón de tokens de entrada y U$S 50 por millón de tokens de salida.
Un salto importante en programación y tareas autónomas
Según las evaluaciones difundidas por Anthropic, Fable 5.1 mejora significativamente en tareas complejas y de larga duración.
En Terminal-Bench-Science 0.1, orientado a investigación científica agéntica, alcanzó 52,6%, frente al 24,7% de Fable 5, el 29% de Opus 5 y el 22,4% de GPT-5.6 Sol.
En GDPval-AA v2, dedicado a trabajo de conocimiento, obtuvo una puntuación de 1.853, superior a las 1.723 unidades de Fable 5, las 1.824 de Opus 5 y las 1.711 de GPT-5.6 Sol.
También llegó a 73,4% en CursorBench 3.2.0, destinado a programación agéntica, frente al 70,5% de Fable 5, el 70% de Opus 5 y el 67,2% de GPT-5.6 Sol.
Uno de los casos más llamativos provino de la firma de inversión Millennium. Según Damien, Senior Portfolio Manager de la compañía, existía un código que sufría un fallo extraordinariamente raro, aproximadamente una vez cada un millón de ejecuciones, cuyo origen nadie había conseguido explicar durante cuatro o cinco años. “Todos los modelos que probé, incluido Fable 5, fallaron. Claude Fable 5.1 fue el primero en encontrarlo”, afirmó.
El modelo desensambló una biblioteca externa, comparó su comportamiento con un volcado de memoria e identificó un error dentro de esa biblioteca.
La compañía financiera Jane Street Capital también destacó los resultados. Craig Falls, Head of Quantitative Research, aseguró que en sus evaluaciones internas “Claude Fable 5.1 resuelve más de nuestros problemas de programación que Fable 5 u Opus 5” y mantiene resultados más comprensibles en tareas prolongadas.
Agentes que pueden trabajar durante horas
Otro punto central del lanzamiento es la capacidad del modelo para sostener tareas durante períodos considerablemente largos. MongoDB informó que Claude Fable 5.1 construyó un prototipo complejo en aproximadamente tres días, después de investigar código y documentación, diseñar una arquitectura y ejecutar durante horas procesos de implementación y verificación sin supervisión permanente.
En Ramp, el ingeniero Dwight Temple describió una ejecución autónoma de 38 horas sobre un problema de machine learning. Según explicó, el modelo identificó que un resultado previo estaba distorsionado por un problema de etiquetas, corrigió el análisis y lanzó seis experimentos paralelos durante la noche.
Mientras tanto, Browserbase aseguró que Fable 5.1 completó el 82% de las tareas en su benchmark más exigente de agentes de navegador, frente al 74% de Opus 5 y el 57% de Fable 5.
Anthropic apunta también a la investigación científica
Más allá del software, Anthropic intenta posicionar esta generación de Claude como una herramienta para acelerar descubrimientos científicos.
En diseño molecular, Claude Mythos 5.1 desarrolló moléculas capaces de unirse a determinados objetivos biológicos. En tres de ellos, las afinidades obtenidas fueron 10 veces superiores a los mejores diseños presentados en competencias de Adaptyv Bio.
El modelo alcanzó además una tasa de éxito cercana al 50% en 12 objetivos, frente a valores habituales de entre 10% y 15% en diseño de proteínas.
En otro experimento, Claude Fable 5.1 entrenó una red neuronal para producir un nuevo mapa de alta resolución de aproximadamente un tercio de Venus, utilizando imágenes de radar tomadas por la misión Magellan de la NASA hace más de 30 años.
El mapa mejora la resolución desde los anteriores 10 a 20 kilómetros hasta entre 2 y 3 kilómetros y, según Anthropic, puede estimar alturas con hasta 25% más precisión.
La compañía planea liberar el mapa bajo licencia Creative Commons antes de las futuras misiones VERITAS de NASA y EnVision de la Agencia Espacial Europea.
Claude Mythos 5.1 también optimizó siete modelos open source de deep learning utilizados en genómica y proteínas, logrando aceleraciones de hasta 2,5 veces sobre GPUs NVIDIA H100.
Anthropic estima que esas mejoras podrían reducir entre 30% y 60% los costos de GPU en análisis genómicos de gran escala.
Más capacidad también significa mayores riesgos
El aumento de autonomía obliga a Anthropic a reforzar sus controles. Mythos 5.1 posee, según la compañía, las capacidades de ciberseguridad más avanzadas que haya incorporado a uno de sus modelos. Sin embargo, Anthropic asegura que continúa dentro de una categoría de riesgo inferior según su propio Frontier Compliance Framework.
En biología y química, las pruebas mostraron que Mythos 5.1 es más capaz que su predecesor, aunque todavía no supera el siguiente nivel de riesgo definido por la política de escalamiento responsable de la compañía.
Por esa razón, el acceso a sus funciones más sensibles seguirá restringido. Anthropic desarrolló además, junto con el gobierno de Estados Unidos, un Life Sciences Verification Program, destinado a científicos y profesionales de ciencias de la vida.
También mantiene un Cyber Verification Program para especialistas en seguridad defensiva. Fable 5.1, en cambio, podrá utilizarse de forma general para identificar vulnerabilidades de software, aunque no para desarrollar exploits.
Los nuevos controles de ciberseguridad generan aproximadamente 60% menos intervenciones que los aplicados a Fable 5, mientras que en consultas básicas de biología y medicina las alertas innecesarias se redujeron un 85%.
Privacidad empresarial y competencia por el mercado corporativo
Anthropic también anunció Enterprise Frontier Safeguards (EFS), un sistema orientado a grandes compañías que busca combinar controles de seguridad con políticas equivalentes a retención cero de datos.
Con EFS, la información permanecerá en infraestructura cloud controlada por el propio cliente y no en los sistemas de Anthropic.
La compañía desarrolló esta arquitectura junto con más de 100 clientes de sectores como finanzas, salud, manufactura, telecomunicaciones, derecho, comercio minorista y sector público, además de Amazon Web Services, Google Cloud y Microsoft Azure.
Fable 5.1 estará disponible en Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Google Cloud y Microsoft Azure, entre otras plataformas.
La nueva generación muestra hacia dónde se está desplazando la competencia entre los principales laboratorios de inteligencia artificial. Ya no alcanza con responder mejores preguntas: el objetivo es crear modelos capaces de programar durante horas, investigar, operar herramientas, analizar grandes volúmenes de información y ejecutar proyectos cada vez más autónomos.
Anthropic apuesta a que Claude Fable 5.1 puede ofrecer esas capacidades a un costo menor. Y con Mythos 5.1 introduce otra estrategia que probablemente gane importancia a medida que los modelos se vuelvan más poderosos: no todas las capacidades estarán disponibles para todos los usuarios.

