Intel ha sacado SuperClaw, una plataforma de agentes que decide tarea a tarea si el trabajo se hace en el equipo del usuario o en la nube. La empresa dice que en sus pruebas internas el enrutado recorta más de un 70% el consumo medio de tokens de nube.
El planteamiento es local por defecto, nube cuando compensa. El componente que toma la decisión se llama Auto Route.
Puntos clave
- Auto Route elige para cada tarea entre un modelo local en el equipo, un recurso en el borde de la empresa o un modelo en la nube. El usuario ajusta el equilibrio entre calidad y coste con un control.
- Intel cifra el ahorro en más del 70% de tokens de nube sobre cargas de trabajo empresariales internas.
- Vienen siete agentes: por defecto, código híbrido, investigación profunda, correo y calendario, ficheros locales, búsqueda web y protección de ficheros (experimental).
- Requisitos duros: Intel Core Ultra con gráfica integrada B370 (10 Xe) o B390 (12 Xe), o GPU Arc Pro serie B, más 64 GB de RAM a 8.000 MT/s o superior.
- Instalación en Windows con WSL por debajo, virtualización VT-x activada y driver gráfico 32.0.101.8860 o posterior.
El problema que ataca
Cualquiera que haya montado agentes en producción conoce la factura. Un agente que hace veinte llamadas para resolver una tarea gasta veinte veces lo que una consulta suelta, y la mayoría de esas veinte no necesitan un modelo de frontera. Leer un fichero local, buscar en la memoria del agente, enmascarar datos sensibles: eso lo hace un modelo pequeño sin despeinarse.
Lo que hace SuperClaw es poner esa decisión en manos de un enrutador en vez de dejarla al criterio de quien escribió el prompt. Y de paso resuelve el otro dolor de las empresas europeas: que el dato sensible no salga del edificio.
El corte de hardware es el peaje. 64 GB de RAM a 8.000 MT/s y una Core Ultra reciente no es el portátil medio de una oficina española. Esto está pensado para equipos nuevos, y ahí está la jugada comercial de Intel: vender la razón por la que renovar el parque.
Dónde encaja en el mercado
El enrutado de modelos lleva un año largo siendo tema. Cuando la CNBC titula que el enrutado es un problema para OpenAI y Anthropic, lo que está diciendo es que las empresas empiezan a mirar la factura y a preguntarse por qué la consulta de "resume este PDF" cuesta lo mismo que la de "analiza este contrato".
Cloudflare ha ido por otro camino con su plataforma abierta de agentes, que usa AI Gateway para elegir modelo y controlar coste. Intel lo ataca desde el silicio.
Por qué importa
Si estás pagando facturas de API que crecen más rápido que el uso, el enrutado es la primera palanca y casi nadie la ha tirado. No hace falta comprar SuperClaw para aplicar la idea: separa tus llamadas en las que necesitan razonamiento y las que no, y manda las segundas a un modelo barato. Ese ejercicio, hecho a mano, ya suele recortar entre un 30 y un 50%.
Si además manejas datos que no pueden salir (nóminas, historiales, contratos), el reparto local-nube deja de ser una optimización de coste y pasa a ser un requisito legal que puedes cumplir sin renunciar a la IA.
El aviso: el 70% es el número de Intel sobre sus propias cargas. Mide el tuyo antes de firmar nada.
Relacionado


