Anthropic ha lanzado hoy, 7 de octubre, Claude Haiku 5.5, y la noticia es el precio. Cuesta un 90% menos que Haiku 4.5 en peticiones de hasta 100.000 tokens y un 50% menos por encima, según el anuncio oficial de Anthropic. Es la primera versión nueva de su modelo pequeño en casi un año.
Y no viene solo. En el mismo anuncio, Sonnet 5.5 abarata la caché a la mitad y los suscriptores de Max y Team reciben crédito mensual para usar la API.
Puntos clave del lanzamiento
- Precio de Haiku 5.5 (hasta 100.000 tokens): 0,10 $ por millón de tokens de entrada y 0,50 $ por millón de salida. Haiku 4.5 cobraba 1 $ y 5 $.
- Por encima de 100.000 tokens: 0,50 $ de entrada y 2,50 $ de salida.
- Sonnet 5.5: la lectura de caché pasa de 0,20 $ a 0,10 $ por millón de tokens.
- Crédito de API: 100 $ al mes en Max 5x, 200 $ en Max 20x y hasta 500 $ en Team, repartidos entre los usuarios.
- Disponible ya en la API de Claude (`claude-haiku-5-5`), Amazon Web Services, Google Cloud y Microsoft Azure.
¿Cuánto cuesta Claude Haiku 5.5?
Diez céntimos de dólar por cada millón de tokens que le mandas y cincuenta por cada millón que te devuelve, siempre que la petición no pase de 100.000 tokens. Un token es más o menos tres cuartos de palabra, así que 100.000 tokens dan para un documento de unas 75.000 palabras.
Por qué el corte en 100.000. Anthropic dice que el 90% de las peticiones que recibía Haiku 4.5 estaban por debajo de esa cifra. O sea, han puesto el precio más bajo justo donde está casi todo el uso real. Las peticiones largas (contratos enteros, repositorios de código, historiales de soporte de meses) pagan cinco veces más: 0,50 $ y 2,50 $.
La tabla completa por millón de tokens queda así:
| Haiku 5.5 (hasta / más de 100K) | Haiku 4.5 | Sonnet 5.5 | |
|---|---|---|---|
| Entrada | 0,10 $ / 0,50 $ | 1,00 $ | 2,00 $ |
| Salida | 0,50 $ / 2,50 $ | 5,00 $ | 10,00 $ |
| Lectura de caché | 0,01 $ / 0,05 $ | 0,10 $ | 0,10 $ |
| Escritura de caché | 0,125 $ / 0,625 $ | 1,25 $ | 2,50 $ |
Ojo con un matiz que viene en la letra pequeña. Haiku 5.5 estrena tokenizador (el mismo tipo que Sonnet 5.5 y Opus 5.5) y gasta algo más de tokens para hacer el mismo trabajo. Por eso Anthropic no promete un ahorro del 90% en tu factura. Su cálculo, mezclando peticiones cortas y largas y ese gasto extra de tokens, es que Haiku 5.5 sale un 75% más barato de media que Haiku 4.5.
Qué significa en euros (un ejemplo)
Pongamos que clasificas 100.000 correos de clientes al mes. Cada uno con su instrucción ocupa unos 1.000 tokens, y la respuesta (la categoría y un resumen de una línea) unos 100.
Con Haiku 4.5 eran 100 millones de tokens de entrada a 1 $ y 10 millones de salida a 5 $: 150 $ al mes. Con Haiku 5.5, los mismos números salen a 15 $. Aunque el tokenizador nuevo inflara la cuenta un poco, sigues muy lejos de la factura anterior.
Ese tipo de tarea (repetitiva, mucho volumen, poca dificultad) es justo para la que Anthropic diseña Haiku. Ellos mismos citan resúmenes, compactación de conversaciones, consultas a bases de datos, clasificación y atención al cliente en directo.
Qué rinde por ese precio
Lo raro del lanzamiento es que el modelo barato además mejora mucho. En OSWorld 2.1, la prueba que mide si un agente sabe manejar un ordenador real en tareas de varios pasos, Haiku 5.5 saca un 72,4%. Haiku 4.5 se quedaba en el 15,7% y GPT-6 Luna, el modelo pequeño de OpenAI, en el 48,9%.
En Terminal-Bench 4.0 (programar con agentes desde la terminal) pasa del 0% de Haiku 4.5 a un 39,2%. Sonnet 5.5 llega al 70,6%, así que para programación compleja sigue sin ser la herramienta. Anthropic lo dice claro en el anuncio: Sonnet 5.5 y Opus 5.5 siguen siendo mejor opción para tareas de código complejas, y Haiku 5.5 encaja en trabajos acotados que antes salían demasiado caros.
Dos novedades más de funcionamiento:
- Nivel de esfuerzo ajustable. Es el primer Haiku que lo trae. Puedes decidir si quieres que piense menos y cueste menos, o que piense más y acierte más.
- Velocidad. Anthropic lo presenta como su modelo más rápido a velocidad estándar (los Opus en modo rápido van más deprisa).
Los clientes que lo han probado aportan cifras propias. HubSpot dice que es la mejor nota que ha visto en su batería de tareas de CRM, un 92,8% de media en tres pasadas. Box habla de 11 puntos más que Haiku 4.5 con la mitad de latencia. Asana mide un 30% menos de tiempo para completar tareas de su agente. Son pruebas de cada empresa, no comparables entre sí, pero apuntan todas al mismo sitio.
Sonnet 5.5 también baja
La otra rebaja afecta a más gente de la que parece. La lectura de caché de Sonnet 5.5 cae de 0,20 $ a 0,10 $ por millón de tokens. La caché es el contexto que se reutiliza entre llamadas (las instrucciones fijas, los documentos de referencia), y en un agente que trabaja durante horas es la mayor parte del consumo. Anthropic calcula que, con este cambio, Sonnet 5.5 sale un 20% más barato en la mayoría del trabajo con agentes.
Hace nueve días contábamos que Sonnet 5.5 salió al mismo precio que su antecesor y un 30% más rápido. Ahora encima baja.
Crédito de API para Max y Team
Esta semana Anthropic empieza a dar crédito mensual de API a todos los suscriptores de Max y Team: 100 $ en Max 5x, 200 $ en Max 20x y hasta 500 $ en Team, compartidos entre los usuarios del equipo. Vale para cualquier modelo. La idea es que quien ya paga la suscripción pruebe a montar sus propias herramientas y agentes sobre la API sin abrir otra factura.
Para alguien con Max que nunca ha tocado la API es una invitación directa. 100 $ al mes en Haiku 5.5 son unos 1.000 millones de tokens de entrada a precio corto.
Por qué importa
Para una empresa española que usa Claude, el cambio práctico está en las tareas que hasta hoy no salían a cuenta. Clasificar todos los tickets de soporte, resumir cada llamada comercial, revisar cada albarán contra su pedido. Con Haiku 4.5 había que mirar la factura antes de lanzarlo a todo el volumen. Con Haiku 5.5, en muchos casos, deja de ser una conversación.
Mi recomendación es probarlo en paralelo antes de cambiar nada. Coge 200 casos reales de una tarea que ya tengas con otro modelo, pásalos por Haiku 5.5 y compara aciertos y coste. Si estás en el rango de peticiones cortas y el acierto aguanta, el ahorro es inmediato. Si tus peticiones son largas, el descuento es del 50% y merece la pena hacer bien la cuenta.
El modelo también cambia cómo se reparte el trabajo. Anthropic lo empuja como subagente de Opus 5.5 y Sonnet 5.5: el modelo grande decide y planifica, y Haiku hace las búsquedas, los resúmenes y la lectura de documentos que antes se comían el presupuesto. Cognition ya lo ha metido así en Devin, con Opus 5.5 al mando y Haiku 5.5 de ayudante. Si usas Opus 5.5 desde su lanzamiento del 22 de septiembre, ese es el primer sitio donde mirar.
Fuente original: Anthropic
Relacionado


