Qwen3.8-27B corre en Cerebras a unos 1.500 tokens por segundo
Cerebras ha metido Qwen3.8-27B en sus endpoints públicos a unos 1.500 tokens por segundo. Su catálogo de modelos lista el modelo como qwen-3.8-27b, con 27.
Newsletter
Tag
Cerebras ha metido Qwen3.8-27B en sus endpoints públicos a unos 1.500 tokens por segundo. Su catálogo de modelos lista el modelo como qwen-3.8-27b, con 27.
Callosum ha levantado 100 millones de dólares en una ronda semilla liderada por Atomico para orquestar peticiones de IA entre chips distintos. La…
Cerebras ha presentado el CS-4, la cuarta generación de su computador de IA. Monta tres procesadores Wafer Scale Engine 3 Turbo sobre su plataforma…
OpenAI ha abierto Ultrafast, un nivel de servicio de su API que corre GPT-5.6 Sol a hasta 750 tokens de salida por segundo, catorce veces la velocidad…
Cognition ha sacado SWE-1.7, su modelo propio para Devin, el agente de programación. Lo interesante del cómo: no lo…
El jefe de ingeniería de Codex en OpenAI, Thibault Sottiaux, confirmó el 6 de julio que la variante GPT-5.6 Sol Ultra llegará al cliente de Codex para…
Hugging Face y Cerebras han montado un asistente de voz que responde en tiempo real, y el truco no está en el micrófono ni en el altavoz. Está en el…