La IA nos está trayendo muchas cosas sorprendentes que hace solo unos años nos parecían reservadas a la ciencia ficción. Uno de los mayores empeños y mejores usos de los desarrollos de IA pasa por romper la barrera idiomática. Lo vemos ya, por ejemplo, en vídeos de YouTube que se doblan o traducen en tiempo real. Eso hace que ahora podamos ver creadores de contenido de todo el mundo y entender perfectamente lo que nos están contando.
Google está inmersa en esa hazaña y poco a poco nos va contando novedades al respecto. La última gran función llega con Gemini 3.5 Live Translate, que ofrece traducción de voz en tiempo real, compatibilidad con más de 70 idiomas y modo de escucha en Android. Vamos a ver en qué consiste y por qué pretende cambiarlo todo.
Rompiendo la barrera de los idiomas con Gemini
Como decimos, Google ha presentado Gemini 3.5 Live Translate, su nuevo modelo de audio para la traducción de voz a voz en tiempo real. Según detalla la compañía, el sistema se basa en dos décadas de trabajo en aprendizaje automático aplicado a la traducción y está orientado a permitir una comunicación más natural y continua entre distintos idiomas, manteniendo el tono, el ritmo y la entonación.

Google asegura que actualmente sus sistemas de traducción procesan más de un billón de palabras cada mes en todos sus productos, y que esta actualización representa el siguiente paso para mejorar la interacción multilingüe en vivo. Su principal atractivo es la traducción continua en streaming, en lugar de los sistemas tradicionales por turnos. G
El sistema genera el habla traducida mientras la persona sigue hablando, manteniéndose solo unos segundos por detrás para conservar la sincronización. Google ha detallado las principales capacidades de Gemini 3.5 Live Translate:
- Detección automática de más de 70 idiomas.
- Traducción continua de voz a voz sin esperar a que termine la frase.
- Conservación de la entonación, el ritmo y el tono de voz.
- Equilibrio entre esperar el contexto y traducir de inmediato para mejorar calidad y velocidad.
- Salida de baja latencia con audio fluido y sin pausas incómodas.
- Gran resistencia al ruido en entornos impredecibles.
- No requiere configuración manual del idioma.
Multitud de usos y aplicaciones
A partir de aquí, la idea es que se empiecen a construir aplicaciones reales. La idea es que el sistema resuelva situaciones donde el idioma puede suponer una traba, como reuniones, llamadas, clases y retransmisiones. La clave es que permite conversaciones multilingües más fluidas, pero también traducción simultánea a varios idiomas y el doblaje en tiempo real.
El sistema se pone desde ya en manos de los desarrolladores para que puedan crear sus propias aplicaciones de traducción de voz en tiempo real aprovechando la infraestructura de streaming de Google. Por su parte, Google comenzará a integrarlo en su ecosistema:
En Google Meet
Para mejorar las reuniones multilingües al ampliar las capacidades de traducción en tiempo real. La función comenzará a desplegarse primero para algunos clientes privados del ámbito empresarial. A lo largo del año se hará una implementación más amplia.

En Google Translate
El Traductor de Google, que de tantos apuros nos ha sacado, también se va a beneficiar de Gemini 3.5 Live Translate. Llegará para Android con la traducción en vivo usando auriculares, la compatibilidad con más de 70 idiomas y una salida de voz más fluida que refleja el tono de voz del hablante.
En teléfonos Android
También se integrará en el Modo de escucha en Android. Es decir, que los usuarios podrán sostener el teléfono junto al oído como si fuera una llamada. El audio traducido se reproduce directamente por el auricular interno, en situaciones en las que no hay auriculares o directamente para escuchar en privado.











