Google DeepMind publicó este 13 de agosto Gemini 3.7 Flash, apenas tres semanas después de Gemini 3.6 Flash, con una suba de casi diez puntos en las pruebas de programación que la propia compañía usa para medir sus modelos. El lanzamiento llega con precio introductorio a la mitad del anterior hasta fin de año y sin ninguna fecha para el modelo insignia, Gemini Pro, que sigue demorado.

Google presenta a 3.7 Flash como su "modelo caballo de batalla" para programación y agentes, diseñado para generar código listo para producción al primer intento y para sostener tareas de varios pasos sin perder el hilo. Según Google, el modelo "piensa con más detenimiento, pone más esfuerzo en la planificación de varios pasos", en palabras de Tulsee Doshi, quien conduce el desarrollo de Gemini en la compañía.

Los números frente a la versión anterior

Los saltos más grandes aparecen en las pruebas de código y automatización de tareas:

Prueba 3.6 Flash → 3.7 Flash
FrontierCode 1.1 34.4% → 43.6%
DeepSWE v1.1 49.0% → 65.3%
AutomationBench 17.0% → 30.4%
GDP.pdf (documentos complejos) 22.0% → 34.0%
WebDev Arena (Elo) 1538 → 1588

Son cifras que Google mide con su propia metodología y publica sin auditoría externa, un punto que retoman los analistas que siguieron el lanzamiento.

Precio a mitad, con vencimiento

Gemini 3.7 Flash sale a 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de salida, la mitad del costo original de 3.6 Flash, pero esa tarifa introductoria rige solo hasta el 31 de diciembre de 2026. Desde el 1 de enero de 2027 el precio sube a 1,50 y 7,50 dólares respectivamente, es decir se duplica apenas termine el año.

El modelo ya está disponible para desarrolladores en la API de Gemini, Google AI Studio, Google Antigravity y Android Studio; para empresas, en la Gemini Enterprise Agent Platform, y para usuarios finales de Google AI Pro y Ultra, a través de Gemini Spark en más de 160 países.

Ficha técnica y qué omite

Gemini 3.7 Flash procesa hasta un millón de tokens de entrada, entre texto, imagen y video, y devuelve respuestas de hasta 64.000 tokens. Su corte de conocimiento llega a marzo de 2026, aunque algunos dominios quedan limitados a enero de 2025. El propio model card aclara que el modelo está construido sobre Gemini 3.6 Flash y remite a la documentación de esa versión para arquitectura, datos de entrenamiento y metodología: Google no publicó detalles nuevos sobre cómo se entrenó 3.7 Flash.

En la evaluación de seguridad automatizada frente a 3.6 Flash, el modelo mejora 1,17 puntos porcentuales en seguridad texto a texto pero retrocede 0,48 puntos en seguridad multilingüe y 0,47 puntos en la evaluación de tono, con un aumento de 0,84 puntos en rechazos injustificados. La evaluación de fronteras de seguridad de Google no encontró que el modelo alcance umbrales de capacidad crítica en armas químicas, biológicas, radiológicas o nucleares, ciberseguridad ofensiva, manipulación dañina o investigación y desarrollo de machine learning. El propio documento admite que el modelo "puede exhibir algunas de las limitaciones generales de los modelos de fundación, como alucinaciones", además de lentitud o cortes ocasionales.

Lo que todavía no se puede confirmar

Los analistas que revisaron el lanzamiento marcan una distancia entre lo que Google reporta y lo que un usuario puede verificar por su cuenta.

"Estas siguen siendo afirmaciones de benchmark del proveedor hasta que el nuevo modelo acumule suficiente evidencia de producción independiente."

La cita es de Sanchit Gogia, de la consultora Greyhound Research. Otro analista consultado, Amit Chandak, de Kanerika, situó el valor del modelo en la práctica: las mejoras importan cuando se traducen en "menos bucles de corrección, menos supervisión humana por tarea y una ejecución más confiable de varios pasos".

Google concentra sus lanzamientos en la serie Flash, de actualización frecuente, mientras la serie Pro, la de mayor capacidad, sigue sin cadencia clara. En la última presentación de resultados, el CEO Sundar Pichai evitó responder preguntas sobre cuándo llegará el próximo modelo Pro y la compañía no dio ninguna fecha.