Google ha lanzado Gemini 3.7 Flash con un salto de 16 puntos en DeepSWE v1.1, de 49,0% a 65,3%, y un precio de estreno de 0,75 dólares por millón de tokens de entrada que se dobla el 1 de enero de 2027. Es el relevo de Gemini 3.6 Flash, y por primera vez el modelo barato de Google se pone a discutir tareas de código de verdad.
Puntos clave
- DeepSWE v1.1: 65,3% contra el 49,0% de 3.6 Flash. Es la mejora más grande de toda la tabla.
- FrontierCode 1.1 Main: 43,6% contra 34,4%.
- AutomationBench: 30,4% contra 17,0%. Casi el doble en tareas de automatización de varios pasos.
- Precio introductorio: 0,75 dólares por millón de entrada y 3,75 de salida hasta el 31 de diciembre de 2026.
Qué cambia técnicamente
Los cinco números que publica Google apuntan al mismo sitio: trabajo agéntico. DeepSWE mide resolver incidencias de software reales, no completar fragmentos de código. Pasar de 49 a 65 en esa prueba es la diferencia entre un modelo al que revisas todo y uno al que le puedes soltar una tarea acotada.
AutomationBench cuenta la misma historia desde otro lado. De 17,0% a 30,4% en planificación de varios pasos. Sigue siendo un porcentaje bajo en absoluto, y conviene decirlo: dos de cada tres intentos fallan. Pero la pendiente entre dos versiones separadas por semanas es la señal.
GDP.pdf sube de 22,0% a 34,0%. Es la prueba de comprensión documental, la que importa cuando le pasas un contrato de 80 páginas o un packing list escaneado. Google también menciona mejor uso de herramientas dentro de las apps de Workspace, que es donde acaba tocando tierra para la mayoría de empresas.
En WebDev Arena, el Elo llega a 1588 frente a 1538. Cincuenta puntos de Elo en una arena de preferencia humana es una mejora perceptible, no ruido estadístico.
El precio es la mitad de la noticia
Google ha puesto una fecha de caducidad al precio de lanzamiento, y eso es nuevo. Hasta el 31 de diciembre de 2026 cuesta 0,75 dólares por millón de tokens de entrada y 3,75 por millón de salida. El 1 de enero de 2027 pasa a 1,50 y 7,50. El doble exacto.
Leer eso como una promoción es quedarse corto. Es una ventana de cinco meses para que los equipos migren cargas de trabajo con un coste que luego se duplica. Quien monte un agente sobre 3.7 Flash en septiembre tiene que hacer los números con la tarifa de enero, no con la de estreno, porque el cambio no es del 10%.
Comparado con el resto del mercado sigue siendo barato incluso a tarifa completa. La ronda de recortes de precio de los últimos meses ha dejado la gama media en un rango donde 1,50 dólares por millón de entrada no llama la atención.
Dónde está disponible
Sale a la vez en Antigravity, la plataforma de agentes de Google; en la API a través de AI Studio y Android Studio; en Gemini Enterprise Agent Platform y en la app de Gemini Enterprise. Y en Gemini Spark para suscriptores de AI Pro y Ultra en más de 160 países.
Google no ha publicado ventana de contexto, identificador exacto del modelo ni opciones de presupuesto de razonamiento en el anuncio. Para quien tenga que planificar una integración, esos tres datos hay que sacarlos de la ficha de la API.
Por qué importa
Si tienes procesos corriendo sobre un modelo barato, esta es la actualización que toca probar esta semana, no el mes que viene. El salto en DeepSWE y AutomationBench mueve la frontera de qué tareas puedes delegar sin supervisar cada paso, y la ventana de precio se cierra el 31 de diciembre.
El orden sensato es el de siempre. Coge tres tareas que ya hagas con Gemini o con otro modelo de gama media, mídelas contra 3.7 Flash con tus propios datos y calcula el coste con la tarifa de 2027. Si con 1,50 dólares por millón sigue saliendo a cuenta, migra. Si solo sale con la tarifa de estreno, no era un caso de uso, era un descuento.
Relacionado

