Super Sale WeekClaude Skills — 20% OFF
News

Gemini 3.7 Flash: Novedades, precios y alternativas (2026)

Powerdrill Team·
Gemini 3.7 Flash: Novedades, precios y alternativas (2026)

Google anunció Gemini 3.7 Flash el 13 de agosto de 2026, calificándolo como "nuestro modelo de batalla más inteligente hasta la fecha para programación y agentes". Cuesta la mitad de lo que costaba 3.6 Flash, llegando tres semanas después de este. El precio indicado es de lanzamiento y vence a finales de año.

Este artículo analiza qué ha cambiado, cuál es el precio real y qué miden las pruebas de rendimiento. También aborda a qué recurrir cuando el producto final es un informe o una presentación. Los datos corresponden al 17 de agosto de 2026.

Novedades de Gemini 3.7 Flash

Lo más destacado es el salto en el trabajo con agentes y programación. Google señala como áreas objetivo la ingeniería de software, el trabajo de conocimiento, el desarrollo web, la generación de código, la depuración, la resolución de problemas, la comprensión de documentos y la automatización de flujos de trabajo empresariales.

Dos de ellas son importantes para cualquiera que trabaje con archivos en lugar de código. La comprensión de documentos y la automatización de flujos de trabajo empresariales son las que afectan a hojas de cálculo, extractos e informes.

El ritmo de lanzamientos merece una mención aparte. Gemini 3.6 Flash llegó aproximadamente tres semanas antes, por lo que se trata de una iteración rápida y no de un cambio generacional.

Este ritmo tiene una consecuencia práctica. Cualquier cosa que desarrolle en torno a una versión específica del modelo debe tolerar que dicha versión cambie constantemente de base.

Google también define esta categoría explícitamente como un modelo de batalla en lugar de un modelo de frontera. Está pensado para el volumen y el costo, no para resolver el problema de forma individual más difícil que tenga.

La disponibilidad se divide según el público. Los desarrolladores lo obtienen en Google AI Studio, Android Studio y Google Antigravity. Las empresas lo reciben a través de Gemini Enterprise Agent Platform. Los particulares acceden a él a través de Gemini Spark, para suscriptores de AI Pro y Ultra en más de 160 países.

Estas tres plataformas no son el mismo producto. Un desarrollador que realiza pruebas en AI Studio y un colega que utiliza Spark trabajan con interfaces y límites diferentes.

Precios y la fecha clave

Ahora A partir del 1 de enero de 2027
Entrada $0.75 por 1M de tokens $1.50 por 1M de tokens
Salida $3.75 por 1M de tokens $7.50 por 1M de tokens

Google afirma claramente que "el precio de lanzamiento vence el 31 de diciembre de 2026". La duplicación de la tarifa está publicada, no es una especulación.

En comparación con 3.6 Flash, Google describe la tarifa actual como "la mitad del costo original de 3.6 Flash por millón de tokens". Por lo tanto, el descuento es real hoy y temporal por diseño.

Si está planificando un presupuesto para después de este año, tome como referencia las cifras de enero. Un análisis de costos basado en la tarifa de lanzamiento será incorrecto en cuestión de meses.

También vale la pena señalar lo contrario. Para un proyecto que finalice este año, la tarifa actual representa un ahorro de dinero real y no una simple cifra de marketing.

Un detalle más afecta a la planificación. La duplicación se aplica tanto a la entrada como a la salida, por lo que la proporción entre ambas no varía.

Qué miden y qué no miden las pruebas de rendimiento

Google publica cinco comparaciones frente a 3.6 Flash. Las mejoras son significativas en cada una de ellas.

Prueba de rendimiento 3.7 Flash 3.6 Flash
FrontierCode 1.1 Main 43.6% 34.4%
DeepSWE v1.1 65.3% 49.0%
WebDev Arena Elo 1588 1538
GDP.pdf 34.0% 22.0%
AutomationBench 30.4% 17.0%

Tres de las cinco son evaluaciones de programación. Le dicen muy poco sobre si un modelo lee correctamente su exportación trimestral.

La que más se acerca a ese tipo de tarea es GDP.pdf, una evaluación de comprensión de documentos. Observe su cifra absoluta en lugar de su mejora: un 34.0% significa que todavía se pasa por alto aproximadamente dos tercios de los elementos.

AutomationBench se comporta de la misma manera. Un salto del 17.0% al 30.4% es una gran mejora relativa, pero una puntuación absoluta baja.

Esa combinación es el resumen más honesto. Se trata de un modelo significativamente mejor para el trabajo con documentos, y el trabajo con documentos sigue siendo la columna más débil de la tabla.

Qué cambia esto si su producto final es un informe o una presentación

Una inferencia más barata y rápida cambia la viabilidad económica antes de cambiar la calidad del resultado. Reducir a la mitad el costo de los tokens hace que sea razonable ejecutar un paso que antes se omitía.

El candidato obvio es la verificación. Solicitar una segunda pasada para contrastar una cifra con su fuente cuesta muy poco cuando los tokens son baratos.

El segundo candidato es el volumen. Procesar cada archivo de una carpeta se vuelve asequible, en lugar de tener que limitarse a tomar muestras.

El tercero es la iteración. Cuando un primer intento es económico, se puede plantear la misma pregunta de tres formas distintas y comparar las respuestas.

Lo que no cambia es el último tramo del proceso. Aunque un modelo devuelva cifras correctas, usted todavía tiene que armar el gráfico, el resumen escrito y las diapositivas. Nuestra página del generador de informes con IA explica detalladamente dónde encaja ese paso de ensamblaje.

Por eso el costo por token es un indicador deficiente del costo por producto final. Los tokens rara vez son la parte costosa de la elaboración de un informe.

Evalúe el cambio en función de lo que ahora puede permitirse hacer dos veces. Revisar el propio trabajo es el paso que la mayoría de la gente omite por cuestiones de costo.

Tres cosas que el anuncio no menciona

La ventana de contexto. No aparece ninguna cifra en la publicación. Si sus archivos son extensos, esta omisión es lo primero que debe probar.

Cómo maneja la entrada de tablas desorganizadas. Se menciona la comprensión de documentos como un punto fuerte, pero sin describir qué sucede con las celdas combinadas, los encabezados de varias filas o las tablas escaneadas.

Si la disponibilidad en Spark equivale a la paridad con la API. Gemini Spark y la API se enumeran como plataformas independientes, y la publicación no afirma que el comportamiento sea idéntico.

Cuáles son los límites de velocidad. No aparece ninguna cuota por minuto o por día en el anuncio, lo cual es más importante con un precio bajo que con uno alto.

Hay un cuarto vacío importante para la planificación. No se dice nada sobre cuánto tiempo seguirá vigente 3.7 Flash, y 3.6 Flash duró unas tres semanas.

Dónde deja de ser útil un modelo más rápido

Un modelo es solo un componente. El trabajo por el que se le evalúa es un producto final terminado, y la brecha entre ambos es donde realmente se va la mayor parte del tiempo.

Esa brecha consta de tres partes: dar al archivo un formato utilizable, decidir qué cifras son importantes y producir algo que un colega pueda leer sin necesidad de que usted se lo explique.

Observe que solo la parte intermedia tiene que ver realmente con la inteligencia. La primera y la última se refieren al manejo de archivos y a la generación de formatos.

Ninguno de esos tres aspectos se resuelve con un token más barato. Se resuelven mediante herramientas que integran el archivo, el análisis y el resultado en una sola plataforma.

Esa es la capa en la que trabaja Powerdrill Bloom. Usted sube el archivo Excel, CSV, TSV o PDF y lo explora en un lienzo. Lo que decida conservar se convierte en un gráfico, un informe o diapositivas en un solo paso. Su limitación real va en la otra dirección: no es un endpoint de modelo puro, por lo que usted no controla los tokens, la temperatura ni la elección del modelo.

Alternativas que vale la pena conocer

Si necesita Considere
Inferencia rápida y económica para trabajo con agentes y programación Gemini 3.7 Flash
Razonamiento profundo en documentos extensos y desorganizados Un modelo de frontera en lugar de una categoría de batalla
Un gráfico, informe o presentación terminados a partir de un archivo de datos Un agente de acción con carga y exportación de archivos
Una vista interactiva sobre una Google Sheet Sheets canvas, analizado en nuestra guía de Sheets canvas

Elija según la parte de la cadena que le falte. Si la pieza que falta es el costo de inferencia, un modelo de batalla es la respuesta.

Tenga en cuenta que no se trata de compras que compitan entre sí. Una categoría de modelo y una herramienta de entrega se sitúan en puntos diferentes, y la mayoría de los equipos terminan pagando por ambas.

Si la pieza que falta es el producto final, un modelo más barato no lo generará. Se trata de una categoría de herramienta diferente, no de una más débil.

Conclusión

Gemini 3.7 Flash es un verdadero paso adelante en el trabajo con agentes y documentos, a la mitad del costo anterior, y esa reducción de costo es temporal. Esos son los tres datos clave que debe recordar.

La cifra que hay que tener en cuenta es el 34.0% de GDP.pdf. La mejora y la suficiencia son cosas distintas, y la comprensión de documentos sigue siendo la columna que usted mismo debe verificar.

Si su trabajo termina en un gráfico, un resumen escrito o una presentación, pruebe Powerdrill Bloom con uno de sus propios archivos. Consulte también nuestras guías sobre complementos de agentes y qué es MCP.

Preguntas frecuentes

¿Qué es Gemini 3.7 Flash?

Es el modelo de categoría de batalla de Google anunciado el 13 de agosto de 2026, descrito como su modelo de batalla más inteligente hasta la fecha para programación y agentes. Google incluye la programación, el trabajo de conocimiento, la comprensión de documentos y la automatización de flujos de trabajo empresariales entre sus áreas objetivo.

¿Cuánto cuesta Gemini 3.7 Flash?

Actualmente, $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida. Google indica que este precio de lanzamiento vence el 31 de diciembre de 2026, tras lo cual se aplicarán las tarifas de $1.50 y $7.50.

¿Es mejor que Gemini 3.6 Flash?

Google publica mejoras en las cinco pruebas de rendimiento comparadas, incluyendo FrontierCode 1.1 Main con un 43.6% frente al 34.4%. También señala que el precio actual es la mitad del costo original de 3.6 Flash por millón de tokens.

¿Qué tamaño tiene su ventana de contexto?

El anuncio no especifica ninguna cifra para la ventana de contexto. Si los archivos extensos son importantes para su trabajo, compruébelo usted mismo en lugar de asumir que existe paridad con otra categoría.

¿Puede convertir una hoja de cálculo en una presentación?

Un modelo devuelve texto y razonamiento, no una presentación con formato. Generar diapositivas a partir de un archivo de datos requiere herramientas que gestionen el archivo y la exportación, lo cual constituye una capa independiente del modelo.