Gemini 3.5 Live Translate traduce voz en tiempo real
Google lanza Gemini 3.5 Live Translate, un modelo que traduce voz de forma continua en más de 70 idiomas y conserva parte del tono y el ritmo del hablante. La tecnología llega a Google Translate y se prepara para Google Meet, con usos para llamadas, reuniones y conversaciones cotidianas.

Google ha lanzado Gemini 3.5 Live Translate, un modelo que traduce conversaciones habladas casi en tiempo real y mantiene parte del tono, el ritmo y la entonación de quien habla. El audio traducido llega con un retraso de apenas unos segundos, sin esperar siempre a que la otra persona termine.
La diferencia está en cómo trabaja. Los sistemas tradicionales suelen procesar una frase completa y traducirla después. Este modelo analiza el audio mientras se transmite y genera la traducción de forma continua, con menos silencios y cortes incómodos.
Detecta automáticamente más de 70 idiomas y puede manejar conversaciones multilingües sin que tengas que configurar manualmente cada idioma. También está diseñado para funcionar en entornos ruidosos, como una calle, una estación o una llamada con mala calidad de audio.
Dónde estará disponible
Google está desplegando el modelo en varios productos y servicios:
- Desarrolladores: acceso en vista previa pública mediante la
Gemini Live APIy Google AI Studio. - Empresas: pruebas privadas en Google Meet para algunos clientes de Workspace desde este mes.
- Usuarios particulares: integración global en Google Translate para Android y iOS.
En la aplicación de Translate, puedes conectar unos auriculares y escuchar la traducción mientras la otra persona habla. En Android también empieza a llegar un modo de escucha que envía el audio traducido directamente al auricular del teléfono, como si estuvieras atendiendo una llamada.
Por ejemplo, podrías apuntar el teléfono hacia una visita guiada en español y escuchar una traducción al inglés sin que el resto de las personas oiga el audio. Es una función pensada para situaciones rápidas y discretas, especialmente cuando no llevas auriculares.
Más idiomas en Google Meet
La actualización de traducción de voz de Google Meet pasará de un límite anterior de cinco idiomas a más de 70. Además, permitirá trabajar con más de 2.000 combinaciones de idiomas en una misma reunión, en lugar de depender únicamente de traducciones hacia o desde el inglés.
La función se estrena primero en una vista previa privada para clientes empresariales seleccionados y tendrá un despliegue más amplio a lo largo de este año. La idea es que una reunión con participantes de distintos países no tenga que organizarse alrededor de un único idioma común.
Qué podrán crear los desarrolladores
La Gemini Live API permite incorporar esta traducción a llamadas, clases, retransmisiones y reuniones. Empresas como Agora, Fishjam, LiveKit, Pipecat y Vision Agents ya ofrecen herramientas para gestionar la transmisión de audio, de modo que los desarrolladores no tengan que construir desde cero toda la infraestructura técnica.
Grab está probando el sistema para facilitar la comunicación entre conductores y viajeros durante las recogidas. La plataforma gestiona más de 10 millones de llamadas de voz al mes, por lo que este caso pone a prueba la traducción en conversaciones breves y con ruido de fondo.
Todo el audio generado por el modelo incluye una marca invisible SynthID. Esta marca permite detectar que el contenido ha sido creado por IA y busca dificultar el uso engañoso de voces generadas, aunque no evita por sí sola todos los riesgos de una traducción automática.
Para ti, el cambio más visible llegará en Translate: hablar con alguien en otro idioma será menos parecido a intercambiar frases separadas y más parecido a mantener una conversación. Aun así, conviene vigilar la precisión en nombres propios, acentos, ruido y situaciones delicadas, porque reducir el retraso no elimina los errores de traducción.