Anthropic ha reescrito el clasificador que filtra las preguntas de biología de Fable 5 y dice que los desvíos caen alrededor de un 85%. Traducido: el modelo grande ahora responde a muchas más consultas de salud y biología en vez de mandarlas a Opus 5, que es más barato pero menos capaz.
El anuncio es del 7 de agosto. Y llega el mismo día que se publica el trabajo de Arc Institute diseñando virus con IA, lo cual no parece casualidad.
Puntos clave
- La caída de desvíos no es uniforme: 67% en Claude.ai, 55% en Cowork, 17% en Claude Code, 7% en la plataforma de API.
- Anthropic reescribió la constitución del clasificador, pidió feedback a expertos internos y externos, generó datos de entrenamiento nuevos y lo reentrenó.
- Lo que sigue bloqueado: virología, toxicología y diseño molecular. Esas consultas se siguen desviando a Opus 5.
- La frase con la que Anthropic justifica el conservadurismo: "el coste de que Fable se use mal en un dominio de doble uso como la biología podría ser catastrófico".
De dónde venía el problema
Cuando Fable 5 salió, el filtro de biología estaba tan apretado que bloqueaba casi todo. Hubo investigadores a los que el modelo desvió por escribir un simple saludo dentro de una conversación marcada como biológica. No era un bug, era una decisión deliberada de Anthropic: preferir el falso positivo al falso negativo mientras el clasificador no estuviera afinado.
El coste de esa decisión lo pagaban dos grupos muy distintos. Uno, cualquiera que quisiera entender un análisis de sangre o estudiar biología de bachillerato. Dos, los investigadores de verdad. Al primero ya se le ha resuelto. Al segundo no.
Qué se puede hacer ahora y qué no
Con el clasificador nuevo, Fable 5 responde a preguntas cotidianas de salud, interpretación de analíticas, comprensión de síntomas y tareas clínicas de profesionales sanitarios.
Lo que sigue fuera es el trabajo de investigación real: virología, toxicología, diseño de moléculas. Eso va a Opus 5. Anthropic reconoce abiertamente que está dejando fuera a gente que hace ciencia legítima, y dice que irá aflojando conforme mejoren los clasificadores. Sus propias pruebas indican que el modelo puede dar ventaja a alguien que intente desarrollar un arma biológica, y esa es la razón del corte.
Merece la pena fijarse en el reparto de porcentajes. La caída del 67% en Claude.ai contra el 7% en la plataforma dice que el problema estaba sobre todo en el chat de consumo, donde entra la pregunta médica normal. En la API, donde el uso es más técnico y más especializado, el filtro se mueve poco.
Por qué importa
Si tu empresa toca salud, farmacia, laboratorio o seguros médicos, esto cambia la ecuación de coste. Antes cada consulta biológica te caía en Opus 5 sin que lo pidieras, con la calidad que eso implica. Ahora una parte grande se queda en Fable 5.
Si construyes producto sobre la API de Anthropic, revisa tus logs de fallback. El 7% de mejora en plataforma es poco, así que si tenías un porcentaje alto de desvíos, sigues teniéndolo. Esto se arregla mirando el dato, no leyendo el anuncio.
Y hay un tercer efecto, menos evidente. Anthropic ha publicado los números del recorte por superficie. Eso es una forma de decir a los clientes empresariales que el filtro es una palanca ajustable, no una pared. Para un director de operaciones que está decidiendo proveedor, saber que el vendedor mide y publica esas cifras vale más que la promesa genérica de seguridad. La cobertura previa del culebrón de Fable 5 la tienes en los recortes del modelo en los planes Max y Pro y en el contraejemplo con el que tumbó una conjetura matemática abierta desde 1939.
Relacionado


