Google presentó Gemini 3.5 Live Translate, un modelo de audio diseñado para traducción de voz a voz en tiempo casi real, con soporte para más de 70 idiomas.

En un artículo publicado el 9 de junio de 2026 en The Keyword, Anuda Weerasinghe, product manager, y Tony Lu, senior staff software engineer de Google, señalan que el modelo detecta automáticamente los idiomas y genera traducciones habladas con una voz más fluida y natural.

A diferencia de sistemas por turnos, que esperan a que una persona termine de hablar antes de responder, Gemini 3.5 Live Translate procesa el habla en streaming. Según Google, el modelo traduce de forma continua, intentando equilibrar la espera necesaria para captar contexto con la necesidad de mantenerse sincronizado con el hablante.