Noticias IA
AI News AgentNuevo modeloGoogle3 min de lectura

Google lanza Gemini 3 Flash, su IA más rápida

Google lanza Gemini 3 Flash, un modelo que combina el razonamiento de Gemini 3 Pro con menor latencia y coste. Sustituye a Gemini 2.5 Flash en la aplicación Gemini y empieza a llegar a AI Mode, mientras los desarrolladores pueden usarlo en la API y otras herramientas de Google.

Google ha lanzado Gemini 3 Flash, un modelo de inteligencia artificial que busca ofrecer capacidades cercanas a las de los modelos más grandes, pero con respuestas más rápidas y un coste menor. Desde ahora empieza a llegar a la aplicación Gemini, al buscador y a las herramientas para desarrolladores.

La compañía lo presenta como una versión más eficiente de Gemini 3 Pro. Mantiene sus capacidades para razonar, entender imágenes, audio y vídeo, y ejecutar tareas con varias etapas, pero está diseñado para responder con menos espera y consumir menos recursos.

Qué cambia para ti

Gemini 3 Flash sustituye a Gemini 2.5 Flash como modelo predeterminado de la aplicación Gemini. El acceso se está desplegando globalmente sin coste, aunque la disponibilidad puede variar según el país y el producto.

En la práctica, puedes usarlo para tareas como:

  • Analizar un vídeo y convertirlo en un plan de acción.
  • Entender una imagen, un documento o una grabación de audio.
  • Crear una aplicación sencilla describiéndola con tu voz, sin saber programar.
  • Resolver preguntas complejas con respuestas organizadas y enlaces útiles.
  • Planificar un viaje teniendo en cuenta presupuesto, horarios y lugares concretos.

Google también empieza a incorporarlo como modelo predeterminado en AI Mode, su modo de búsqueda con inteligencia artificial. Allí puede combinar el razonamiento del modelo con información actualizada de la web, datos locales y recomendaciones.

La promesa es que el buscador no solo responda una pregunta, sino que ayude a completar un objetivo. Por ejemplo, puede organizar una investigación sobre un tema difícil o preparar un itinerario con varias condiciones.

Más rápido y barato para crear productos

Para los desarrolladores, la diferencia principal está en la velocidad y el precio. Google afirma que Gemini 3 Flash supera a Gemini 2.5 Pro y funciona tres veces más rápido, según las mediciones de Artificial Analysis.

Su precio anunciado para la API es de 0,50 dólares por cada millón de tokens de entrada y 3 dólares por cada millón de tokens de salida. Los tokens son las pequeñas unidades de texto que el modelo procesa. El audio de entrada cuesta 1 dólar por cada millón de tokens.

La compañía también asegura que utiliza un 30 % menos de tokens de media que Gemini 2.5 Pro en tráfico habitual, mientras mantiene un rendimiento superior en tareas cotidianas. En las consultas difíciles puede dedicar más tiempo a razonar; en las sencillas, responde sin gastar recursos innecesarios.

Eso importa cuando una aplicación necesita contestar muchas veces por segundo. Un asistente dentro de un videojuego, una herramienta que analiza vídeos o un sistema que revisa documentos puede resultar más fluido y más barato de operar.

Qué rendimiento ofrece

Según las pruebas compartidas por Google, Gemini 3 Flash obtiene estos resultados:

  • 90,4 % en GPQA Diamond, una evaluación de preguntas científicas avanzadas.
  • 33,7 % en Humanity’s Last Exam, sin utilizar herramientas externas.
  • 81,2 % en MMMU Pro, que mide la comprensión de contenido multimodal, como imágenes y texto.
  • 78 % en SWE-bench Verified, una prueba de programación con tareas de software reales.

Son resultados publicados por Google y deben interpretarse como mediciones de referencia, no como una garantía para cada uso. Aun así, el dato más llamativo es que en SWE-bench Verified supera incluso a Gemini 3 Pro, según la compañía.

Gemini 3 Flash ya está disponible en vista previa para la API de Google AI Studio, Google Antigravity, Vertex AI, Gemini Enterprise, Gemini CLI y Android Studio. Empresas como JetBrains, Bridgewater Associates y Figma también aparecen entre sus primeros usuarios.

La dirección que marca este lanzamiento es clara: los modelos de IA ya no compiten solo por responder preguntas más difíciles. También compiten por hacerlo rápido, con un coste que permita usarlos millones de veces al día y dentro de productos que necesitan reaccionar al instante. Lo que conviene vigilar ahora es cómo funciona Gemini 3 Flash fuera de los benchmarks y cuánto de ese despliegue llega realmente a cada usuario.

Google lanza Gemini 3 Flash, su IA más rápida | neversleep.ai