Anthropic lanza Claude Fable 5.1 y Mythos 5.1 con mejoras en programación, agentes e investigación científica
Claude Fable 5.1 mejora programación y tareas de larga duración con hasta un 45% menos de coste, mientras Mythos 5.1 queda limitado a usuarios verificados.
Anthropic ha presentado Claude Fable 5.1 y Claude Mythos 5.1, dos nuevas variantes de su modelo avanzado orientadas a programación, trabajo intelectual, tareas de agentes de larga duración e investigación científica. Ambos utilizan el mismo modelo subyacente, pero se diferencian principalmente por las salvaguardas aplicadas y por quién puede acceder a ellos.
Claude Fable 5.1 está disponible de forma general y sustituye a Fable 5 como la nueva opción de Anthropic para trabajos especialmente exigentes. Mythos 5.1, en cambio, emplea controles más permisivos para determinados trabajos de ciberseguridad y ciencias de la vida, por lo que su acceso está restringido a investigadores y organizaciones previamente verificados.
Fable 5.1 mejora especialmente en programación y tareas de agentes
Anthropic posiciona Claude Fable 5.1 para problemas que requieren razonamiento prolongado, uso de herramientas y ejecución de tareas durante periodos extensos. Entre sus principales áreas de mejora se encuentran la programación agéntica, la investigación en varias etapas, el análisis de información y la creación de documentos, hojas de cálculo y presentaciones.
En Terminal-Bench-Science 0.1, una evaluación centrada en investigación científica mediante agentes, Fable 5.1 obtuvo un 52,6%, frente al 24,7% registrado por Fable 5 en las pruebas de Anthropic. En CursorBench 3.2.0, orientado a programación agéntica, alcanzó un 73,4%, mientras que Fable 5 consiguió un 70,5%.
La compañía también informa de mejoras en tareas empresariales y de uso de ordenadores. Como ocurre con cualquier benchmark publicado por un proveedor de modelos, estas cifras representan resultados obtenidos bajo configuraciones concretas y no equivalen necesariamente al rendimiento que observarán todos los usuarios en situaciones reales.
Anthropic reduce el coste de utilizar Fable 5.1
Una de las principales novedades no está relacionada directamente con la capacidad del modelo, sino con su coste operativo. Anthropic mantiene el precio base de Fable 5.1 en 10 dólares por cada millón de tokens de entrada y 50 dólares por cada millón de tokens de salida.
Sin embargo, las lecturas de caché pasan a costar 0,25 dólares por millón de tokens, una reducción del 75%. Esta modalidad resulta especialmente importante en aplicaciones que reutilizan grandes cantidades de contexto durante múltiples pasos.
Según las mediciones de Anthropic, el cambio puede reducir aproximadamente un 25% el coste total respecto a Fable 5 en cargas de trabajo habituales. En procesos complejos de programación y aplicaciones con agentes que reutilizan constantemente información anterior, la compañía calcula que el ahorro puede llegar aproximadamente al 45%.
Fable 5.1 está disponible en Claude y las principales plataformas cloud
Claude Fable 5.1 ya está disponible en las plataformas de Anthropic y para desarrolladores mediante la API con el identificador claude-fable-5-1. La compañía también ha confirmado su disponibilidad a través de Amazon Web Services, Google Cloud y Microsoft Azure.
La documentación de Anthropic especifica una ventana de contexto de hasta un millón de tokens y una salida máxima de 128.000 tokens para Fable 5.1. Estas capacidades permiten utilizar el modelo con grandes bases documentales, repositorios de código y procesos que necesitan mantener cantidades considerables de información dentro de una misma tarea.
Mythos 5.1 usa el mismo modelo, pero con salvaguardas diferentes
Claude Mythos 5.1 no es un modelo más potente construido sobre una arquitectura independiente. Anthropic explica que Fable 5.1 y Mythos 5.1 son el mismo modelo subyacente, pero aplican diferentes niveles de restricciones.
Mythos 5.1 está diseñado para profesionales que necesitan trabajar en ámbitos donde las salvaguardas convencionales pueden bloquear actividades legítimas de investigación, especialmente ciberseguridad defensiva y ciencias de la vida.
El acceso permanece limitado debido al carácter de doble uso de estas capacidades. Anthropic ofrece Mythos 5.1 a determinados especialistas mediante programas de acceso verificado y actualmente restringe su disponibilidad a un conjunto de organizaciones de Estados Unidos mientras trabaja para ampliar el programa.
Claude Security, la herramienta de Anthropic destinada a analizar bases de código, localizar vulnerabilidades y proponer correcciones para revisión humana, también utiliza ahora Mythos 5.1.
Fable 5.1 puede buscar vulnerabilidades con menos bloqueos
Anthropic también ha modificado las salvaguardas de ciberseguridad de Fable 5.1 para reducir falsos positivos. La compañía afirma que los usuarios de Claude Code deberían experimentar aproximadamente un 60% menos de intervenciones relacionadas con estas protecciones en comparación con las utilizadas anteriormente con Fable 5.
El nuevo modelo puede utilizarse para identificar vulnerabilidades de software dentro de trabajos defensivos. Sin embargo, determinadas tareas de doble uso, entre ellas la generación de exploits, algunas pruebas de penetración y el análisis de vulnerabilidades basado en binarios, continúan sujetas a mayores restricciones.
Anthropic también prueba los modelos en investigación científica
La compañía ha utilizado Fable 5.1 y Mythos 5.1 en una serie de experimentos científicos para evaluar si los modelos de IA pueden realizar trabajo más allá de las tareas convencionales de programación y asistencia.
En uno de los proyectos, Fable 5.1 utilizó imágenes de radar obtenidas por la misión Magellan de la NASA para generar un nuevo mapa de elevación de aproximadamente un tercio de Venus. Anthropic afirma que el resultado permite distinguir detalles a escalas de entre dos y tres kilómetros, frente a los 10 a 20 kilómetros de los datos de altimetría utilizados como referencia.
En biología computacional, Mythos 5.1 fue empleado para optimizar siete modelos de aprendizaje profundo de código abierto mediante kernels personalizados para GPU. Según Anthropic, las modificaciones consiguieron aceleraciones de hasta 2,5 veces manteniendo resultados idénticos.
La empresa también probó Mythos 5.1 en diseño de proteínas. En experimentos posteriormente validados por organizaciones externas, Anthropic afirma que el modelo consiguió diseñar ligandos de alta afinidad y alcanzó una tasa de resultados viables cercana al 50% en un conjunto de 12 objetivos.
Fable y Mythos dividen el acceso según el riesgo de las tareas
Con esta generación, Anthropic está separando de forma más explícita la capacidad técnica del modelo y las restricciones que determinan cómo puede utilizarse. Fable 5.1 ofrece el modelo de forma general con salvaguardas destinadas a los usuarios habituales, mientras que Mythos 5.1 abre determinadas capacidades adicionales únicamente a profesionales que superan procesos de verificación.
La estrategia permite a Anthropic ofrecer avances en programación, investigación y agentes sin proporcionar de forma general las configuraciones menos restrictivas necesarias para algunas tareas sensibles. Fable 5.1 ya está disponible para usuarios y desarrolladores, mientras que el acceso a Mythos 5.1 continuará dependiendo de los programas especializados de la compañía.