YouTube doblará las transmisiones en vivo mientras hablas. Empieza con inglés y español

YouTube va a traducir las transmisiones en vivo mientras ocurren. En su evento Made on YouTube del 23 de septiembre, la empresa anunció que empezará a probar el doblaje automático en directo a principios de 2027, primero en inglés y español. En una presentación llena de anuncios sobre inteligencia artificial, esa es la frase que más importa a quien se gana la vida poniéndole voz a las palabras de otros.

Cinco claves

  1. Llega el doblaje en vivo. La prueba arranca a principios de 2027 y traduce al creador mientras habla.
  2. Inglés y español van primero. Son los dos idiomas de lanzamiento confirmados hasta ahora.
  3. El video grabado ya lo tiene. El doblaje automático se abrió a todos los canales en 27 idiomas en febrero.
  4. La sincronía labial está en prueba. YouTube ensaya ajustar el movimiento de la boca al audio traducido.
  5. La protección de la voz también avanza. Likeness Detection ya se prueba con voces habladas, no solo con rostros.

Qué anunció YouTube exactamente

El detalle está en una entrada del blog de YouTube firmada por Barbara Macdonald, del equipo de producto de YouTube Live. Ella explica el motivo sin rodeos: “más del 40% del tiempo de visualización en vivo viene de espectadores fuera del país del creador”, y el idioma deja fuera de la conversación a buena parte de ese público. La solución, según YouTube, es una herramienta que traduce automáticamente “tu discurso en tiempo real, para que los espectadores puedan escuchar en su idioma preferido mientras hablas”.

TechCrunch, ese mismo día, describió la función como una que va a “traducir el discurso de los creadores a otros idiomas en tiempo real” y la ubicó junto a otras herramientas de IA: un asistente que opina sobre borradores, selección automática de miniaturas y etiquetado para enlaces de compra. El director ejecutivo, Neal Mohan, presentó el paquete completo como algo construido “desde cero por los creadores y las comunidades que los impulsan”.

Dos medios del sector confirman el par de idiomas. Social Media Today informa que la prueba será “en inglés y español a principios del año próximo”, y Dataconomy dice lo mismo: una herramienta “para la traducción en tiempo real del discurso del creador, empezando por inglés y español”.

De una prueba pequeña a un producto en vivo, en dos años

Esto no salió de la nada. El doblaje automático empezó como una prueba limitada en ocho idiomas en 2024. El 4 de febrero de este año, la gerente de producto Chandralekha Motati escribió que se abría a todos los canales en 27 idiomas, con “Expressive Speech para todos los canales de YouTube en 8 idiomas (inglés, francés, alemán, hindi, indonesio, italiano, portugués y español)” para conservar algo de la interpretación original.

Ese mismo texto trae un dato que conviene mirar con calma. “En diciembre, YouTube promedió más de 6 millones de espectadores diarios que vieron al menos 10 minutos de contenido doblado automáticamente”. Eso fue hace nueve meses, cuando la función era más nueva y más limitada. Motati también confirmó una prueba de sincronía labial, que ajusta la boca del hablante a la pista traducida, y les dijo a los creadores que una versión doblada “podría ayudar con el descubrimiento en otros idiomas” sin perjudicar al original.

Línea de tiempo del doblaje automático de YouTube, desde la prueba de 2024 en ocho idiomas hasta la prueba en vivo en inglés y español a principios de 2027

El trabajo al que esto le llega primero

Nadie va a doblar automáticamente un largometraje. Lo que queda bajo presión es la capa de abajo, y siempre fue así: videos explicativos, recorridos de producto, tutoriales, menciones de patrocinadores, canales corporativos que quieren los mismos doce minutos en once mercados. Ese trabajo lleva una década pagando la renta de muchos actores de voz, y es justo el que una herramienta integrada en la plataforma se lleva primero, porque viene incluida y sin costo con la subida del video.

VoiceEditSuiteTrim it, clean it, deliver it. One pass.$20/mo$15/monthShow me more

El directo, sin embargo, es otra cosa, y vale la pena precisar por qué. Una transmisión en vivo nunca se dobló con personas a esta escala, porque no se puede reservar una cabina para una partida de un martes por la noche. No es una herramienta que reemplaza un trabajo que existía. Es una herramienta que crea un mercado que no existía y lo llena de voces sintéticas antes de que nadie más pueda acercarse. Esa diferencia importa a la hora de decidir si conviene enojarse o pensar en estrategia.

Hay un efecto de segundo orden que se pasa por alto con facilidad. Cuando un público se acostumbra a escuchar una transmisión en su idioma, la expectativa se traslada al video grabado y después a todo lo demás que haga ese canal. Un cliente que vio a una máquina hacerlo gratis el martes es un cliente más difícil el miércoles. El argumento a favor de una persona sigue siendo el correcto, pero ahora se defiende contra una base cada vez más alta de lo que la gente acepta.

El anuncio que conviene leer dos veces

Dentro del mismo paquete hay algo que empuja en la dirección contraria. Social Media Today informa que YouTube está “probando la detección de voz hablada como una nueva parte de su proceso de detección de imagen y semejanza”. Likeness Detection es el sistema que YouTube ha ido ampliando durante 2026, primero para políticos y periodistas, después para celebridades y luego para creadores del programa de socios. Hasta ahora miraba rostros. Sumar la voz hablada significa que un intérprete podría, en principio, enterarse de que algo en la plataforma suena como él.

No es poca cosa. El problema de IA más realista para un actor de voz que trabaja no es un estudio que licencia su voz con un contrato en regla. Es una grabación clonada que aparece en un anuncio que nunca vio, en una plataforma demasiado grande para revisarla a mano. Una herramienta que rastrea una voz es la primera pieza de infraestructura que vuelve localizable ese problema. Si sirve, y si llega a gente que no es famosa, es la pregunta que habrá que hacer cuando la prueba se amplíe.

También es justo señalar el ánimo de la gente para la que YouTube construye todo esto. TechCrunch encontró creadores desconfiados de las herramientas de IA en general, con el temor de que “un solo error generado por IA podría dañar su credibilidad”. Una máquina que pronuncia mal el nombre de un patrocinador frente a una audiencia en vivo no es una hipótesis.

Qué hacer antes de 2027

Tres cosas prácticas. Primero, si aceptas trabajo de localización, revisa hoy tus contratos y busca cláusulas sobre reproducción sintética y versiones derivadas en otros idiomas, porque el cliente que compraba once versiones puede pasar a comprar una y apretar un botón. Segundo, si tienes un catálogo público propio, familiarízate con el proceso de inscripción en la detección de semejanza de las plataformas donde estás, para estar en la fila cuando se abra la búsqueda por voz.

Tercero, y menos evidente: mira el directo en lugar de descartarlo. La traducción en tiempo real de una transmisión va a ser rara e imperfecta durante bastante tiempo, y los creadores a los que les importa cómo suenan lo van a notar. Está apareciendo un nicho de conducción en vivo en otros idiomas, lectura simultánea y arreglo de lo que la máquina hace mal. Alguien va a montar un negocio con eso. Bien puede ser alguien de la voz.

Fuentes: Blog de YouTube, 23 de septiembre de 2026; Blog de YouTube, Neal Mohan, 23 de septiembre de 2026; Blog de YouTube, 4 de febrero de 2026; TechCrunch; Social Media Today; Dataconomy. Las citas de fuentes en inglés fueron traducidas por Voice Over Herald.

Read this article in English: YouTube Will Dub Live Streams as They Happen. English and Spanish Go First

¿Sabe algo más sobre esta noticia, o ha visto un error? Escriba a la redacción.