Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.
Mantente informado con las últimas noticias de actualidad.
Anthropic ha movido ficha con Claude Fable 5.1 y lo ha hecho en un momento incómodo, justo después de reconocer incidentes de seguridad y episodios de manipulación de recompensas que obligaron a frenar temporalmente algunos tipos de entrenamiento y a endurecer controles.
La compañía presenta Fable 5.1 como su modelo más capaz hasta la fecha. En una evaluación independiente alcanzó 66 puntos, por delante de los 63 de Opus 5 y de los 61 de GPT-5.6 Soly Grok 4.6.
Un modelo gana puntos mientras otro queda bajo llave
No toda la familia se mueve con la misma libertad. Fable 5.1 y Mythos 5.1 pertenecen a la misma clase de modelo, pero el primero queda orientado al uso general y el segundo se reserva a socios y organizaciones de confianza por sus capacidades en ciberseguridad, un reparto que ya había asomado en el acceso restringido de Mythos.
Ahí aparece una de las tensiones de fondo. La empresa empuja hacia arriba el rendimiento de su sistema más visible mientras mantiene otra variante en un circuito mucho más cerrado.
El 4 % de los tokens de salida de la evaluación procedió del modo seguro.
Ese detalle importa porque el sistema de respaldo de Anthropic redirige las consultas consideradas peligrosas a Claude Opus 4.8, un modelo menos capaz. Dicho de otro modo, la nota final de Fable 5.1 convivió con una red de seguridad activa durante la prueba.
El modelo escribe mejor cuando el trabajo exige criterio
Alex Albert, de Anthropic, describe un comportamiento que apunta menos al brillo de una respuesta aislada y más a la capacidad de ordenar el caos inicial de una tarea.
"Puede darle unas pocas frases vagas y desordenadas y Fable 5.1 suele completar por sí solo lo que falta". - Alex Albert, de Anthropic
Ethan Mollick, que tuvo acceso anticipado al modelo, sitúa la mejora en otro terreno menos fácil de medir a simple vista. A su juicio, el salto más claro aparece en trabajos largos que requieren "juicio y gusto", dos palabras que suelen pesar más cuando un texto debe mantener tono, estructura y criterio durante muchas páginas.
No es una mejora menor.
En los sistemas de lenguaje, resolver una orden breve ya casi no sorprende a nadie. Lo difícil empieza cuando la tarea exige sostener contexto, decidir qué sobra, qué falta y qué merece quedarse, una clase de trabajo que se parece bastante más a editar que a completar una frase.
El precio no sube, pero la factura real cambia
Anthropic mantiene el precio base de Fable 5 en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida. Sin embargo, el coste medio de tarea en Fable 5.1 con nivel de razonamiento máximo llega a 3,76 dólares, un 20 % más que en Fable 5, porque el modelo genera 1,7 veces más tokens de salida.
Ahora bien, la compañía también ha retocado otra pieza menos vistosa y muy práctica. El coste de las lecturas de caché baja un 75 %, de un dólar a 0,75 dólares, con ahorros del 25 % en cargas habituales y de hasta el 45 % en trabajos agénticos, una discusión cercana a la presión del coste computacional que rodea hoy a estos modelos.
Una cifra ayuda a aterrizar esa mezcla de potencia y gasto. Generar un gráfico vectorial de un pelícano en bici con esfuerzo de razonamiento máximo costó 3,3 dólares.
La escena resume bastante bien el momento de esta industria. Claude Fable 5.1 sube hasta 66 puntos, pero una parte de su salida todavía pasa por un modelo menos capaz y cada mejora en juicio o amplitud de respuesta puede traducirse en más tokens, más control y una factura más alta.