TL;DR:
- Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026, tres semanas después de 3.6 Flash, a 0.75 dólares por millón de tokens de entrada y 3.75 de salida.
- Es un precio de introducción que vence el 31 de diciembre de 2026: desde el 1 de enero sube a 1.50 y 7.50, justo lo que costaba 3.6 Flash cuando salió en julio.
- La ficha del modelo cobra hoy esa misma tarifa por 3.6 Flash, así que los dos modelos valen igual por token hasta fin de año.
Google presentó este jueves 13 de agosto de 2026 Gemini 3.7 Flash, su nuevo modelo para programación y agentes, tres semanas después de haber lanzado Gemini 3.6 Flash. La compañía lo anunció con un precio de introducción de 0.75 dólares por millón de tokens de entrada y 3.75 por millón de salida, la mitad de lo que costaba su antecesor al salir. Una nota al pie del propio anuncio le pone fecha de caducidad: la tarifa termina el 31 de diciembre de 2026 y desde el 1 de enero de 2027 sube a 1.50 y 7.50 dólares. La ficha técnica del modelo, publicada el mismo día por Google DeepMind, añade que 3.6 Flash figura hoy con esa misma tarifa y la misma fecha de vencimiento.
La rebaja se mide contra el precio de julio, no contra el de hoy
El anuncio, firmado por Tulsee Doshi, directora sénior de gestión de producto, en nombre del equipo de Gemini, presenta a 3.7 Flash como el modelo más inteligente hasta ahora de la serie Flash para código y agentes, y su tarifa como la mitad del costo original de 3.6 Flash. Eso es exacto: el 21 de julio, cuando Google lanzó 3.6 Flash, lo puso en 1.50 y 7.50 dólares por millón de tokens, sin mencionar entonces ninguna promoción.
La ficha técnica cuenta otra parte. En su tabla comparativa, Google DeepMind lista tanto a 3.7 Flash como a 3.6 Flash a 0.75 y 3.75 dólares, y el asterisco aclara que el precio de introducción de ambos vence el 31 de diciembre de 2026. Es decir: contra la lista de julio la rebaja es real, pero un desarrollador que hoy compare los dos modelos paga lo mismo por cualquiera de ellos, y en enero los dos vuelven a la tarifa con la que arrancó 3.6 Flash.
Los precios están en dólares por millón de tokens, entrada y salida:
| Momento | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| Al lanzarse 3.6 Flash, 21 de julio de 2026 | 1.50 / 7.50 | Sin lanzar |
| Hoy, según la ficha del modelo | 0.75 / 3.75 | 0.75 / 3.75 |
| Desde el 1 de enero de 2027 | 1.50 / 7.50 | 1.50 / 7.50 |
Para un equipo que mueva mil millones de tokens de salida al mes, la diferencia entre la tarifa de hoy y la de enero son 3,750 dólares mensuales que aparecen en la factura sin que cambie una sola línea de código. Google no ha dicho si extenderá la promoción.
La comparación con la competencia también depende de esa fecha. Con el precio de hoy, la ficha coloca a 3.7 Flash muy por debajo de Claude Sonnet 5 (2.00 y 10.00 dólares) y de GPT-5.6 Terra (2.00 y 12.00). Con el precio de enero, la distancia se reduce a la mitad. Otras actualizaciones recientes ayudan a ubicar la maniobra. En la última de Grok 4.6, el precio por token no se movió y lo que subió fue el costo del caché, como contamos.

Los benchmarks suben frente a 3.6 Flash, pero no alcanzan a GPT-5.6 Terra
Las mejoras que reporta Google son grandes y se concentran en código. En DeepSWE v1.1, que mide ingeniería de software de largo aliento, 3.7 Flash pasa de 48.6% a 65.3%. En FrontierCode 1.1 Main sube de 34.4% a 43.6%, en el benchmark de comprensión de PDF GDP.pdf va de 22.0% a 34.0% y en AutomationBench, que mide flujos de trabajo empresariales, salta de 17.0% a 30.4%. En desarrollo web, su Elo en Code Arena sube de 1538 a 1588. Los dos documentos no coinciden del todo en el punto de partida, eso sí: el blog cifra en 49.0% el resultado previo de DeepSWE y la ficha lo pone en 48.6%.
Las columnas que el anuncio no destaca son las de los rivales. En el índice compuesto de Artificial Analysis, 3.7 Flash obtiene 56 puntos, por encima de Claude Sonnet 5 (55) y del 52 de su antecesor, pero por debajo de GPT-5.6 Terra y Muse Spark 1.2, ambos con 57. En DeepSWE lo supera GPT-5.6 Terra con 69.6%. Y en trabajo de conocimiento, el terreno que el anuncio subraya, 3.7 Flash mejora 103 puntos de Elo en GDPVal-AA v2, hasta 1525, y aun así queda último de los cuatro modelos comparados.
Hay además dos retrocesos frente a 3.6 Flash: en CharXiv Reasoning, que mide lectura de gráficas complejas, baja de 85.2% a 84.5% sin herramientas y de 89.4% a 88.7% con ellas.
Google sostiene también que el modelo se adapta mejor a los obstáculos, pide aclaraciones cuando las necesita y «piensa con más diligencia» al planear varios pasos y encadenar llamadas a herramientas, con menos supervisión manual y menos reintentos. Esa parte del anuncio es la única que no viene acompañada de una cifra.
La velocidad se explica en la propia ficha, que dice que 3.7 Flash está construido sobre 3.6 Flash y remite a la ficha anterior para arquitectura, datos de entrenamiento, hardware y software. Lo nuevo son mejoras algorítmicas sobre esa base de razonamiento, no un modelo entrenado desde cero. En seguridad, Google reporta que el modelo alcanzó el umbral de alerta del primer nivel de capacidad crítica en ciberseguridad y en el dominio químico, biológico, radiológico y nuclear, sin cruzarlo en ninguno de los dos, y anuncia que el reporte completo de su marco de seguridad se publicará más adelante.

Gemini Spark lo estrena hoy, salvo en España y el resto del Espacio Económico Europeo
Para desarrolladores, 3.7 Flash está disponible desde hoy en la API de Gemini vía Google AI Studio y Android Studio, en Google Antigravity, en Gemini Enterprise Agent Platform y en la app de Gemini Enterprise. Acepta texto, imágenes, audio y video con una ventana de contexto de hasta un millón de tokens y devuelve hasta 64,000 de salida. Su corte de conocimiento es marzo de 2026, aunque la propia ficha advierte que en algunos dominios la información del modelo llega solo hasta enero de 2025.
Del lado del consumidor, el modelo llega a Gemini Spark, el agente que Google presentó en su conferencia I/O y que funciona en segundo plano ejecutando tareas. Spark exige suscripción a Google AI Pro o Ultra, ser mayor de 18 años y usar una cuenta personal de Google, no una de trabajo o escuela. Google habla de más de 160 países, pero la letra chica de su centro de ayuda excluye al Espacio Económico Europeo, Nigeria, Suiza y el Reino Unido. En la práctica, los suscriptores de España quedan fuera mientras que los de México y el resto de América Latina sí lo tienen, en la misma app que superó los mil millones de usuarios mensuales.
El 3.5 Pro que Google prometió en julio sigue sin aparecer
El 21 de julio, en el mismo anuncio en el que puso precio a 3.6 Flash, Google escribió que 3.5 Pro estaba en pruebas con socios y que esperaba lanzarlo pronto. Veintitrés días después llegó otro Flash y el modelo grande sigue sin fecha. Axios reportó este jueves que Google declinó hablar del futuro de 3.5 Pro y apuntó una posibilidad concreta: que la compañía se salte esa versión y convierta a Gemini 4 Pro en su próximo modelo grande. Google ya había dicho en julio que empezó el entrenamiento previo de Gemini 4.
El lanzamiento tampoco tomó por sorpresa a quien seguía el código. La semana pasada aparecieron referencias a Gemini 3.7 Flash dentro del SDK de Python de Google en GitHub, y el sitio NokiaPowerUser publicó horas antes del anuncio las cifras de 0.75 y 3.75 dólares como un rumor sin confirmar, advirtiendo que Google no las había documentado. Acertó a la centésima. Lo que la filtración no traía era la fecha de vencimiento.
Quien migre ahora a 3.7 Flash para bajar su factura tiene cuatro meses y medio con la tarifa de introducción. En enero, salvo que Google anuncie otra cosa, pagará por el modelo nuevo lo mismo que pagaba en julio por el anterior.