POR QUÉ IMPORTA
Google lanzó el 13 de agosto de 2026 Gemini 3.7 Flash, un modelo caballo de batalla orientado a ingeniería de software, agentes de IA y ejecución de tareas en múltiples pasos. Según el blog oficial de Google y SiliconANGLE, el modelo obtuvo 65,3% en el benchmark DeepSWE v1.1, frente al 49,0% de Gemini 3.6 Flash. El precio de lanzamiento de US$0,75 por millón de tokens de entrada y US$3,75 por millón de tokens de salida rige hasta el 31 de diciembre de 2026, con una ventana de contexto de aproximadamente 1,05 millones de tokens. Según Bloomberg, el lanzamiento llega mientras el modelo insignia de próxima generación de Google sigue retrasado.En este artículo
Un modelo caballo de batalla pensado para agentes
Google lanzó el jueves 13 de agosto de 2026 Gemini 3.7 Flash, el nuevo modelo de su familia Gemini concebido como caballo de batalla para ingeniería de software, flujos de agentes de IA y ejecución de tareas en múltiples pasos. Según el blog oficial de Google, la propuesta es sostener cargas de trabajo intensivas en programación y automatización sin el costo de los modelos de punta, un enfoque que interesa directamente a quienes construyen productos de IA a gran escala.
Salto de rendimiento en el benchmark DeepSWE
En el benchmark DeepSWE v1.1, referencia para tareas de ingeniería de software asistida por IA, Gemini 3.7 Flash obtuvo 65,3%, frente al 49,0% de Gemini 3.6 Flash, la generación anterior. La mejora de más de 16 puntos porcentuales, según datos difundidos por SiliconANGLE y confirmados por el blog de Google, apunta a un avance considerable en la capacidad del modelo para manejar código real, no solo ejercicios sintéticos, algo relevante para equipos que dependen de IA para escribir, revisar y depurar software.
Precio promocional agresivo hasta fin de año
Google fijó un precio de lanzamiento de US$0,75 por millón de tokens de entrada y US$3,75 por millón de tokens de salida, vigente hasta el 31 de diciembre de 2026. Después de esa fecha, según cobertura del sector, se espera que el precio estándar suba. Mientras dure la promoción, sin embargo, Gemini 3.7 Flash se ubica entre las opciones más económicas del mercado para cargas de trabajo de alto volumen, lo que podría acelerar la adopción entre empresas que hasta ahora evitaban la IA generativa por el costo por token.
Ventana de contexto de más de un millón de tokens
El modelo también incorpora una ventana de contexto de aproximadamente 1,05 millones de tokens, suficiente para procesar bases de código completas, historiales de conversación extensos o grandes volúmenes de documentación en una sola llamada. Para agentes que necesitan mantener memoria de conversaciones largas con clientes, o para flujos que analizan repositorios enteros, esa capacidad reduce la necesidad de dividir tareas en múltiples solicitudes, lo que también afecta el costo y la latencia.
Disponible en toda la pila de herramientas de Google
Gemini 3.7 Flash ya está disponible a través de Gemini API, Google AI Studio, Android Studio, la plataforma de desarrollo de agentes Google Antigravity y la Gemini Enterprise Agent Platform, orientada a clientes corporativos. Esa distribución amplia, confirmada por el blog oficial de Google y por medios como Axios y 9to5google, indica que la empresa quiere el modelo presente tanto en el flujo de desarrolladores individuales como en implementaciones corporativas de agentes de atención y automatización.
El lanzamiento llega con el modelo insignia todavía retrasado
Bloomberg señala que el lanzamiento de Gemini 3.7 Flash ocurre justo mientras el modelo insignia de próxima generación de Google sigue retrasado, un tema ya tratado en otra nota de este sitio. El contraste sugiere una estrategia de mantener el ritmo de anuncios y la competitividad de precios en los modelos intermedios mientras el modelo tope de línea todavía no llega, manteniendo a desarrolladores y empresas comprometidos con el ecosistema Gemini.
Por qué esto importa a agencias y pymes brasileñas
Para agencias de automatización y pymes brasileñas que operan chatbots, agentes de atención y flujos de soporte en WhatsApp u otros canales de alto volumen, el costo por token suele ser el mayor límite para escalar operaciones de IA. Un modelo con mejor rendimiento en tareas agénticas y de código, con precio de entrada por debajo de US$1 por millón de tokens hasta fines de 2026, reduce la barrera financiera para poner más interacciones bajo IA generativa sin disparar el presupuesto mensual. Vale la advertencia: el precio promocional tiene fecha de vencimiento, así que las operaciones que planeen anclar su infraestructura en Gemini 3.7 Flash deben monitorear el ajuste previsto para después del 31 de diciembre y simular el costo a escala real de mensajes antes de comprometerse con contratos de largo plazo con clientes.