Gemini 3.7 Flash se convierte en el modelo más rápido y pone la velocidad en el centro de la batalla de la IA

Mientras OpenAI prepara la llegada de Ultrafast a Sol, Google pisa el acelerador con el nuevo Gemini 3.7 Flash.
en el centro de la pantalla aparece un icono de Gemini. Está moviendo los brazos (múltiples brazos) a toda velocidad, dejando estelas de velocidad, y haciendo múltiples tareas (teclear en un ordenador, usar un móvil, aparecen líneas de código de desarrollo, una paleta de pintor...)
14 de agosto de 2026

Google ha lanzado Gemini 3.7 Flash, la nueva versión de su serie Flash y que, de acuerdo con benchmarks independientes, se convierte en el más rápido del mercado, por delante de otros como GPT 5.6 Luna o el Fable 5 de Anthropic. Como veremos se trata de una apuesta fuerte de Google por seguir recortando terreno a ChatGPT como referencia de la IA generalista, y en cierto modo, también a los modelos de Anthropic en el ámbito profesional.

Tal y como ha explicado Google, “3.7 Flash ofrece mejoras sustanciales en los flujos de trabajo de ingeniería de software, gestión del conocimiento y desarrollo web, con un precio de lanzamiento que es la mitad del coste original de 3.6 Flash por millón de tokens”.

La versión 3.7 Flash ya está disponible a 0,75 $/1 millón de tokens de entrada y 3,75 $/1 millón de tokens de salida

Un modelo orientado al trabajo de programación y desarrollo

La compañía no ha tardado en presumir de los benchmarks de este nuevo modelo frente a su competencia, aunque, como verás, están ligeramente sesgados. Google ha optado por mostrar las comparativas con su versión anterior (3.6 Flash) y otras IA de la competencia como Claude Sonnet 5, GPT 5.6 Terra o Muse Spark 1.2, con los que claramente busca competir. Sin embargo, deja fuera de esas tablas a las grandes referencias del sector, como Fable o Sol.

Benchmarks de la ia de gemini 5.6 flash respecto de la competencia
Fuente: Google

 

En concreto, Gemini 3.7 Flash destaca en:

  • Tareas de codificación, como la depuración y la resolución de problemas. “Se adapta mejor a los obstáculos, aclara la intención cuando es necesario y sigue las instrucciones con mayor precisión. Analiza las tareas con mayor detenimiento, dedicando más esfuerzo a la planificación de múltiples pasos y a las llamadas a herramientas. Una ejecución más disciplinada implica menos supervisión manual y menos reintentos en los flujos de trabajo de ingeniería”, apuntan desde Google.
  • Desarrollo web. Google explica que Flash 3.7 es capaz de “genera diseños más funcionales y aplicaciones completas con menos indicaciones.”  De hecho, este nuevo modelo ya ha entrado en el top 10 del LLM Arena para este tipo de trabajos.
  • Supera “significativamente” a Flash 3.6 en razonamiento y precisión.
  • Por lo demás, echando un vistazo a LLM Arena, donde los usuarios evalúan comparativamente los distintos modelos del mercado, 3.7 Flash consigue buenos resultados en las tareas relacionados con la generación, tratamiento y comprensión de textos (9º)

Pero sin duda, donde destaca es a la hora de evaluar su velocidad. Según las mediciones independientes de Artificial Analysis, Gemini 3.7 Flash (high) es capaz de alcanzar los 340 tokens de salida por segundo, situándose como el modelo más rápido de su comparativa (por ahora), muy por encima de los 152 tokens/s de GPT-5.6 Luna (max), que ocupa la segunda posición.

Comparativa de la velocidad de los principales modelos de ia
Fuente: Artificial Analysis

Para que te hagas una idea, los aclamados Claude Fable 5 o GPT Sol se quedan en 63 y 62 tokens por segundo, respectivamente.

Y claro, digo que es el más rápido por ahora porque el anuncio de Gemini 3.6 Flash se realiza el mismo día en el que OpenAI anuncia la próxima llegada del modo ultrarrápido de GPT Sol, con el que promete que será capaz de alcanzar velocidades del entorno de los 750 tokens por segundo, sin sacrificar capacidad de cómputo, algo habitual en los modelos Flash, que suelen ser más pequeños.

(En cualquier caso, ten en cuenta que los 340 tokens/s de Gemini proceden de las mediciones independientes de Artificial Analysis, mientras que los 750 tokens/s son el máximo anunciado por OpenAI para cuando lance el modo ultrarrápido de Sol).

Parece que la velocidad se ha convertido en el nuevo frente de batalla de la carrera por la IA

Veremos quién la gana.

Imagen: ChatGPT

Otros artículos de

Publicado por

Content manager en Marketing4eCommerce
Content manager de Marketing4eCommerce desde 2014. En este tiempo he redactado más de 2.000 artículos relacionados con el mundo del marketing.

Suscríbete a M4C

 
Únete a nuestro canal de Telegram

¡Todo lo que necesitas saber!

Apúntate a nuestra newsletter y recibe gratis en tu correo nuestros mejores artículos sobre eCommerce y marketing digital.