Google ha lanzado Gemini 3.7 Flash, la nueva versión de su serie Flash y que, de acuerdo con benchmarks independientes, se convierte en el más rápido del mercado, por delante de otros como GPT 5.6 Luna o el Fable 5 de Anthropic. Como veremos se trata de una apuesta fuerte de Google por seguir recortando terreno a ChatGPT como referencia de la IA generalista, y en cierto modo, también a los modelos de Anthropic en el ámbito profesional.
Tal y como ha explicado Google, “3.7 Flash ofrece mejoras sustanciales en los flujos de trabajo de ingeniería de software, gestión del conocimiento y desarrollo web, con un precio de lanzamiento que es la mitad del coste original de 3.6 Flash por millón de tokens”.
La versión 3.7 Flash ya está disponible a 0,75 $/1 millón de tokens de entrada y 3,75 $/1 millón de tokens de salida
La compañía no ha tardado en presumir de los benchmarks de este nuevo modelo frente a su competencia, aunque, como verás, están ligeramente sesgados. Google ha optado por mostrar las comparativas con su versión anterior (3.6 Flash) y otras IA de la competencia como Claude Sonnet 5, GPT 5.6 Terra o Muse Spark 1.2, con los que claramente busca competir. Sin embargo, deja fuera de esas tablas a las grandes referencias del sector, como Fable o Sol.
Fuente: Google
En concreto, Gemini 3.7 Flash destaca en:
Pero sin duda, donde destaca es a la hora de evaluar su velocidad. Según las mediciones independientes de Artificial Analysis, Gemini 3.7 Flash (high) es capaz de alcanzar los 340 tokens de salida por segundo, situándose como el modelo más rápido de su comparativa (por ahora), muy por encima de los 152 tokens/s de GPT-5.6 Luna (max), que ocupa la segunda posición.
Fuente: Artificial Analysis
Para que te hagas una idea, los aclamados Claude Fable 5 o GPT Sol se quedan en 63 y 62 tokens por segundo, respectivamente.
Y claro, digo que es el más rápido por ahora porque el anuncio de Gemini 3.6 Flash se realiza el mismo día en el que OpenAI anuncia la próxima llegada del modo ultrarrápido de GPT Sol, con el que promete que será capaz de alcanzar velocidades del entorno de los 750 tokens por segundo, sin sacrificar capacidad de cómputo, algo habitual en los modelos Flash, que suelen ser más pequeños.
(En cualquier caso, ten en cuenta que los 340 tokens/s de Gemini proceden de las mediciones independientes de Artificial Analysis, mientras que los 750 tokens/s son el máximo anunciado por OpenAI para cuando lance el modo ultrarrápido de Sol).
Parece que la velocidad se ha convertido en el nuevo frente de batalla de la carrera por la IA
Veremos quién la gana.
Imagen: ChatGPT
Your email address will not be published. Required fields are marked *
Δ