Anthropic lanza Fable 5.1 y Mythos 5.1 y recorta el precio de la caché un 75%

Anthropic lanza Fable 5.1 y Mythos 5.1 y recorta el precio de la caché un 75%
Fuente: anthropic.com

Anthropic ha lanzado Claude Fable 5.1 y Claude Mythos 5.1, y el titular no está en los benchmarks: está en la factura. Las lecturas de caché pasan a 0,25 dólares por millón de tokens, un 75% menos que antes, y la empresa calcula un ahorro del 25% en cargas de trabajo típicas y de hasta el 45% en las muy agénticas.

Puntos clave

  • Fable 5.1 está disponible desde el 1 de septiembre en la API de Anthropic y en las tres nubes. Mythos 5.1 va por programas de acceso verificado, limitado a ciberseguridad y ciencias de la vida, y por ahora solo en Estados Unidos.
  • Precio de API: 10 dólares por millón de tokens de entrada y 50 por millón de salida. Las lecturas de caché caen a 0,25 dólares.
  • Terminal-Bench 4.0 (tareas de línea de comandos): 55,8% para Fable 5.1 y 60,9% para Mythos 5.1, contra el 42,0% de Fable 5.
  • Terminal-Bench-Science 0.1: 52,6% frente al 24,7% de Fable 5. Más del doble en tres meses.
  • Humanity's Last Exam: 60,9% sin herramientas y 65,0% con ellas. CursorBench 3.2.0 sube de 70,5% a 73,4%.

Qué cambia en la factura

El precio por token de entrada y salida no se mueve. Lo que se mueve es la caché, y para cualquiera que tenga un agente en producción esa es la partida que manda.

Un agente que trabaja sobre el mismo repositorio, el mismo manual de operaciones o el mismo contexto de cliente relee ese bloque en cada turno. Con lecturas de caché a 0,25 dólares por millón, el coste de arrastrar contexto largo deja de ser el freno que era. De ahí sale el 45% de ahorro que Anthropic atribuye a las cargas "altamente agénticas": no es que el modelo piense más barato, es que recordar cuesta cuatro veces menos.

Para el resto de usos, el ahorro que la empresa declara es de en torno al 25%. Sigue siendo la referencia cara del mercado, y conviene decirlo: Anthropic no está compitiendo por precio, está quitando el argumento de que sus modelos salen prohibitivos en cuanto los pones a trabajar en bucle.

El otro cambio: menos falsos positivos

La segunda queja recurrente de los clientes eran los safeguards disparándose sobre peticiones legítimas. Anthropic da dos cifras concretas.

En biología, las activaciones sobre solicitudes benignas bajan un 85%. En ciberseguridad, las intervenciones por sesión caen alrededor de un 60% respecto a Fable 5.

Quien haya intentado montar un flujo de análisis de vulnerabilidades sobre Claude sabe de qué va esto. El modelo paraba a mitad de tarea, el equipo reescribía el prompt, volvía a parar. Un 60% menos de interrupciones por sesión cambia si ese flujo es viable o si acaba en el cajón.

La system card matiza el entusiasmo. Según el propio documento, Mythos 5.1 muestra una ligera regresión en comportamiento desalineado comparado con Opus 5, aunque mejora frente a versiones anteriores de su propia línea. Es el tipo de detalle que Anthropic publica y casi nadie lee.

Dónde viven los datos

La tercera pata del anuncio es Enterprise Frontier Safeguards, y va de retención. El programa permite que el cliente almacene sus datos en infraestructura cloud que controla él, no Anthropic, con despliegue gradual a partir del otoño de 2026. Mientras tanto hay acceso temporal a retención cero.

La empresa acompaña el anuncio con una frase que suena a respuesta a alguien: "Anthropic nunca ha entrenado con datos de empresa sin permiso explícito, y nunca lo hará".

Esto importa más de lo que parece para una empresa europea. La pregunta que bloquea proyectos en comité no suele ser cuánto cuesta el token, sino dónde acaba el documento que le das al modelo. Poder responder "en nuestra propia nube" desbloquea conversaciones que llevaban meses paradas.

Qué dicen los benchmarks

Terminal-Bench-Science 0.1 es el salto más llamativo: 52,6% frente al 24,7% de Fable 5. Más del doble en la misma familia de modelos, en una prueba de tareas científicas ejecutadas por línea de comandos.

En Terminal-Bench 4.0, la versión general de esa misma prueba, Fable 5.1 marca 55,8% y Mythos 5.1 llega a 60,9%. Fable 5 se quedaba en 42,0%. Son tareas de agente puro: abrir una terminal, entender qué hay, ejecutar comandos y comprobar el resultado.

CursorBench 3.2.0, que mide trabajo de programación real dentro de un editor, sube de 70,5% a 73,4%. Es una mejora modesta, y conviene decirlo así en vez de disfrazarla.

Humanity's Last Exam, la prueba de razonamiento general más dura que se usa hoy, da 60,9% sin herramientas y 65,0% con ellas.

La lectura conjunta es que la mejora se concentra en tareas agénticas largas, no en respuestas sueltas. Coherente con dónde han metido el recorte de precio.

El contexto: Fable 5 no había convencido a las empresas

Hace una semana publicamos que Fable 5 se había quedado en el 11% del gasto corporativo en IA dos meses después de su lanzamiento. Precio, retención de datos y safeguards demasiado celosos eran las tres razones que daban los compradores.

Fable 5.1 responde a las tres, una por una, con cifras. No es un salto de capacidad, es una operación comercial ejecutada con la nota técnica por delante.

Mythos 5.1 juega otro papel. Al quedar restringido a programas de acceso verificado en ciberseguridad y ciencias de la vida, y solo en Estados Unidos, Anthropic se guarda su modelo más capaz para los usos donde el riesgo obliga a saber quién está al otro lado. Es la misma jugada que está haciendo OpenAI con Astra, con distinta etiqueta.

Por qué importa

Si tienes agentes de Claude corriendo en producción, revisa hoy tu consumo de caché antes de mirar nada más. Ahí es donde está el 45%, y no llega solo: hay que estar usando prompt caching de verdad, con bloques de contexto estables, no reconstruyendo el prompt entero en cada llamada.

Y si tenías un proyecto parado porque legal no aceptaba la retención de datos, Enterprise Frontier Safeguards es la conversación que toca reabrir en otoño. Con una advertencia: el despliegue es gradual y la retención cero de ahora es temporal. Pregunta fechas antes de prometer nada en comité.

Fuente original: Anthropic


Relacionado