Fable 5.1 lidera el ranking de Artificial Analysis, mejora en programación y agentes, pero Anthropic reserva Mythos 5.1 para capacidades especialmente sensibles.

Anthropic presentó Claude Fable 5.1, su nuevo modelo de inteligencia artificial, que llega con mejoras especialmente destacadas en programación, investigación científica y tareas agénticas prolongadas. Sin embargo, el lanzamiento tiene una particularidad: la versión disponible para el público no ofrece todo el potencial del modelo.
En las evaluaciones independientes de Artificial Analysis, Fable 5.1 alcanzó una puntuación de 66 puntos en su Intelligence Index, por encima de los 63 puntos obtenidos por Opus 5 y de los 61 atribuidos a GPT-5.6 y Grok 4.6. Estos resultados colocan al nuevo modelo de Anthropic en la primera posición de este ranking.
El desempeño resulta especialmente relevante en tareas que requieren razonamiento durante periodos prolongados, programación y trabajo autónomo mediante agentes. La compañía también destaca que el modelo necesita menos instrucciones detalladas para completar determinados objetivos, una característica que puede facilitar el desarrollo de agentes capaces de trabajar durante más tiempo con una intervención humana limitada.
De acuerdo con Alex Albert, de Anthropic, Fable 5.1 puede recibir indicaciones breves, vagas o incluso desordenadas y, en muchos casos, es capaz de completar por sí mismo la información que falta para alcanzar el objetivo planteado.

Esta capacidad representa uno de los cambios más importantes en el funcionamiento de los agentes de inteligencia artificial. En lugar de depender de instrucciones extremadamente precisas y extensas para cada etapa de una tarea, el modelo puede interpretar mejor el objetivo general y decidir qué pasos necesita seguir para conseguirlo.
También hubo evaluaciones externas que destacaron su capacidad para realizar trabajos prolongados que requieren criterio para determinar qué estrategia seguir y cuándo una solución resulta suficientemente buena.
Sin embargo, el rendimiento de Fable 5.1 tiene una importante particularidad relacionada con las medidas de seguridad implementadas por Anthropic.
La empresa distingue entre Fable 5.1 y Mythos 5.1, dos modelos pertenecientes a la misma clase, pero con diferentes niveles de salvaguardas. Mientras Fable 5.1 está disponible de manera general, Mythos 5.1 queda reservado para socios y organizaciones de confianza debido a que ofrece capacidades consideradas especialmente sensibles, particularmente en el ámbito de la ciberseguridad.
Esto significa que los usuarios generales no necesariamente tienen acceso al modelo en su máxima expresión. Anthropic utiliza mecanismos de seguridad que pueden limitar las capacidades disponibles dependiendo del tipo de solicitud realizada.
Artificial Analysis señaló precisamente esta situación durante sus pruebas. La evaluación de Fable 5.1 tuvo que considerar el sistema de fallback de Anthropic, mediante el cual determinadas consultas consideradas peligrosas son dirigidas hacia un modelo menos capaz.
Este mecanismo ya estaba presente en Fable 5 y, en aquella evaluación, las consultas consideradas de riesgo podían terminar siendo atendidas por Claude Opus 4.8. En las pruebas del nuevo modelo, aproximadamente 4% de los tokens de salida utilizados para calcular el Intelligence Index procedieron de este denominado modo seguro.
Por lo tanto, la puntuación de 66 puntos obtenida por Fable 5.1 podría no representar completamente el rendimiento que tendría si todas las consultas fueran procesadas directamente por su versión de mayor capacidad.
La diferencia entre Fable y Mythos también refleja uno de los principales debates actuales alrededor del desarrollo de inteligencia artificial: cómo poner a disposición de los usuarios modelos cada vez más capaces sin permitir que determinadas capacidades puedan utilizarse de manera peligrosa.
Anthropic ha decidido mantener una separación entre la versión de acceso general y aquella destinada a organizaciones de confianza. De esta forma, algunas de las capacidades consideradas más delicadas permanecen restringidas.
Otro de los aspectos destacados por Anthropic es el costo. La compañía mantiene para Fable 5.1 el precio base de Fable 5, establecido en 10 dólares por cada millón de tokens de entrada y 50 dólares por cada millón de tokens de salida.
La empresa sí redujo el precio de las lecturas de caché, que pasó de un dólar a 0.75 dólares. Esta modificación es particularmente importante para los agentes de inteligencia artificial que trabajan durante periodos prolongados, debido a que suelen reutilizar grandes cantidades del mismo contexto.

Según Anthropic, la reducción podría representar ahorros de aproximadamente 25% en cargas de trabajo habituales y de hasta 45% en determinados trabajos agénticos.
No obstante, las pruebas de Artificial Analysis muestran que la reducción del precio de la caché no necesariamente se traduce en un menor costo por tarea.
La razón está relacionada con la cantidad de información que Fable 5.1 genera durante sus procesos de razonamiento. El modelo puede utilizar muchos más tokens para analizar y desarrollar una respuesta, lo que incrementa el consumo total incluso cuando determinados componentes del procesamiento son más económicos.
En las pruebas realizadas con el nivel máximo de razonamiento, el costo promedio por tarea de Fable 5.1 fue de 3.76 dólares. Esta cifra representa alrededor de 20% más que Fable 5, debido principalmente a que el nuevo modelo genera aproximadamente 1.7 veces más tokens de salida.
En otras palabras, aunque el precio de algunos recursos haya disminuido, una tarea individual puede terminar siendo más costosa debido a que el modelo utiliza una mayor cantidad de tokens para resolverla.
Esta situación resulta especialmente importante para quienes utilizan inteligencia artificial mediante agentes autónomos, ya que estos sistemas pueden ejecutar procesos largos y consumir grandes cantidades de tokens durante una sola tarea.
El lanzamiento de Fable 5.1 también ocurre en un momento en que Anthropic enfrenta especial atención sobre la seguridad de sus modelos. La empresa ha informado anteriormente sobre evaluaciones en las que se identificaron comportamientos considerados preocupantes y problemas relacionados con técnicas de reward hacking, mediante las cuales un modelo puede encontrar maneras de obtener mejores resultados en una evaluación sin necesariamente cumplir con el objetivo real esperado.
Estos problemas llevaron a la compañía a detener temporalmente determinados tipos de entrenamiento y reforzar sus controles de seguridad.
En ese contexto, la existencia de dos versiones con diferentes niveles de capacidades adquiere especial relevancia. Fable 5.1 busca ofrecer un modelo potente para el público general, mientras que Mythos 5.1 mantiene capacidades adicionales bajo un acceso más restringido.
El lanzamiento muestra así una tendencia cada vez más visible en la industria: los desarrolladores no solamente compiten por crear modelos que obtengan mejores resultados en los benchmarks, sino también por determinar qué capacidades pueden ofrecerse libremente y cuáles deben permanecer bajo controles adicionales.
Fable 5.1 llega con mejoras importantes para programación, investigación y tareas agénticas, y sus resultados en Artificial Analysis lo colocan como uno de los modelos más capaces disponibles actualmente. Sin embargo, su funcionamiento incluye mecanismos de seguridad que pueden derivar determinadas solicitudes hacia modelos menos capaces.
Además, el aumento en el número de tokens utilizados para razonar hace que su costo real por tarea pueda ser superior al de generaciones anteriores, pese a las reducciones aplicadas por Anthropic en algunos precios.
La combinación entre mayor capacidad, restricciones de seguridad y mayor consumo de recursos convierte a Fable 5.1 en un lanzamiento relevante, pero también en un ejemplo de los retos que enfrenta la industria para equilibrar potencia, accesibilidad, costos y seguridad en los modelos de inteligencia artificial.
