Elon Musk anunció en X que Grok 4.6 se lanza el 7 de agosto, y que será un modelo de 1,5 billones de parámetros. Semanas después llegará Grok 4.7, con 2,1 billones. El anuncio salió el mismo día en que 1.224 empleados de laboratorios rivales pedían herramientas para frenar exactamente este ritmo.
Puntos clave
- Grok 4.6 sale el 7 de agosto de 2026 con 1,5 billones de parámetros y mejoras en ajuste supervisado y aprendizaje por refuerzo.
- Grok 4.7 llegará pocas semanas después con 2,1 billones de parámetros.
- Musk dice que 4.7 será mejor que 4.6 en todo, algo más lento de servir y con mejor eficiencia de tokens.
- Grok 5 queda como "el próximo salto importante", sin fecha.
Tres versiones en poco más de un mes
Grok 4.5 salió a principios de julio. Con el calendario que acaba de anunciar Musk, xAI habrá publicado tres versiones del modelo entre julio y septiembre. Esa cadencia es la que explica que la conversación sobre el ritmo de lanzamientos haya llegado a las páginas de opinión: los eventos grandes de la industria pasaron de 20 en 2023 a 62 en 2025, y este año sale algo relevante cada cuatro días de media.
El salto de parámetros es el dato que más se ha comentado. De 1,5 a 2,1 billones entre dos versiones separadas por semanas implica que xAI está entrenando en paralelo, no en secuencia. Ese patrón solo lo puede sostener quien tiene cómputo de sobra, y ahí es donde el respaldo del grupo pesa.
El matiz de la eficiencia
Hay un detalle en la descripción de 4.7 que merece atención por encima del número de parámetros. Musk dice que será algo más lento de servir pero con mejor eficiencia de tokens. Son dos métricas distintas que suelen confundirse.
Más lento de servir significa que cada respuesta tarda más en generarse. Mejor eficiencia de tokens significa que necesita menos tokens para resolver la misma tarea. Para un uso interactivo, donde el usuario espera delante de la pantalla, la latencia manda. Para un uso automatizado en lote, donde lo que cuenta es la factura a fin de mes, la eficiencia de tokens manda.
Un modelo más grande y más lento que consume menos tokens por tarea puede salir más barato que uno más pequeño y rápido que necesita tres intentos. Ese cálculo hay que hacerlo con la carga de trabajo propia, no con benchmarks.
Qué dice el ritmo sobre el mercado
El calendario de xAI llega en una semana rara. Por un lado, 1.224 empleados de OpenAI, Anthropic y Google firmaron una carta pidiendo al gobierno estadounidense herramientas para pautar el avance. Por otro, xAI no aparece entre los firmantes y anuncia dos modelos en un mes.
No hace falta atribuir intenciones. El hecho es que la presión competitiva que la carta describe como problema se ve mejor en este anuncio que en cualquier párrafo del texto.
Por qué importa a un operador
Si tienes procesos montados sobre Grok, tres versiones en dos meses es una carga de mantenimiento real. Cada salto de versión cambia el comportamiento del modelo en los bordes: formato de salida, tono, cómo interpreta instrucciones ambiguas. Los prompts afinados para 4.5 no se comportan igual en 4.6.
La forma de no sufrirlo es la de siempre y sigue sin ser glamurosa. Fijar la versión del modelo en producción en vez de apuntar al alias genérico, tener un conjunto de 20 o 30 casos reales propios con la salida esperada, y pasar ese conjunto antes de mover nada. Con eso, actualizar es una tarde. Sin eso, actualizar es enterarse por un cliente de que algo se rompió.
Y con este calendario, la pregunta ya no es si habrá que actualizar. Es cuántas veces al trimestre.
Relacionado


