Unidad 7 / 11

Subtitulado, Doblaje y Traducción Audiovisual

Ganancias:

  • Capacidad de encajar preservando el significado aplicando las reglas técnicas del subtítulo (línea, carácter, CPS)
  • Capacidad de verificar errores de nombres y números adecuados mediante voz y al mismo tiempo acelerar la transcripción y la codificación de tiempo automática con ASR
  • Capacidad para gestionar los límites de la inteligencia artificial teniendo en cuenta el contexto visual, la diferencia tonal y la sincronización labial en el doblaje.

Traducir una película, una serie de televisión, un vídeo corporativo o un curso online es radicalmente diferente a traducir texto plano: el tiempo, la velocidad de lectura, la imagen en pantalla, la voz y el movimiento de los labios de los personajes también son condicionantes. En esta unidad, aprenderá la traducción audiovisual (subtitulado, doblaje, locución), las reglas técnicas de la subtitulación, la transcripción asistida por IA y la codificación del tiempo, y los problemas de calidad de este campo. El objetivo es trabajar como un experto en traducción audiovisual que "se adapta a los ojos y oídos del público" en lugar de "traducir el texto".

Conceptos básicos

La traducción audiovisual (TAV) es la traducción de contenidos que contienen audio y vídeo; Las principales modalidades son la subtitulación, el doblaje y la audiodescripción. La subtitulación es el reflejo del discurso escrito en la pantalla. El doblaje es el doblaje de la voz original en el idioma de destino. La voz en off es cuando se silencia el sonido original y se lee una traducción sobre él (común en documentales).

Dos términos técnicos críticos de la subtitulación: CPS (caracteres por segundo) limita la velocidad de la subtitulación para que el espectador pueda leerla cómodamente; El límite superior generalmente aceptado es de unos 17 caracteres por segundo (más bajo para contenido infantil). El código de tiempo es el tiempo de inicio y fin que indica cuándo aparecerá y desaparecerá el subtítulo en la pantalla (como 00:01:23,400).

¿Por qué es difícil? Porque significa adaptar la traducción a los subtítulos. Dos líneas, ~42 caracteres por línea, un mínimo de ~1 segundo y un máximo de ~6 segundos de tiempo de pantalla, y el límite de CPS: debes cumplir con todo esto manteniendo el significado y el tono. Es por eso que la traducción de subtítulos es a menudo una cuestión de compresión y reformulación, no de traducción palabra por palabra.

Consejo: evite el reflejo de "traducir cada palabra" en los subtítulos. El espectador mira y lee la imagen; No se pueden leer subtítulos demasiado largos. Encontrar la expresión natural más corta que conserve el significado es la verdadera maestría del subtitulador.

El papel de la IA en la traducción audiovisual

La IA acelera significativamente varios pasos en este ámbito:

  1. Transcripción: Con ASR (Reconocimiento automático de voz), la voz se transcribe automáticamente. Esto extrae la fuente sin procesar del subtítulo en minutos.
  2. Codificación de tiempo automática: las herramientas dividen la conversación en segmentos y producen borradores de códigos de tiempo.
  3. Borrador de traducción: se traduce el texto de la transcripción.
  4. CPS/control de longitud: La IA puede marcar qué subtítulo excede la velocidad de lectura y sugerir acortamiento.

Pero cuidado: ASR se equivoca con el ruido, el acento, la superposición de palabras, los nombres propios y los términos técnicos; no puede proporcionar "descripción de audio"; Quien habla puede confundirse. La traducción de la IA no ve la imagen; no puede saber cuándo un objeto que se muestra en la pantalla se llama "eso". Por lo tanto, el humano verifica el contexto visual y la precisión del descifrado.

Precaución: El error más común es pensar que la salida ASR está "decodificada". ASR comete errores frecuentes, especialmente en nombres propios, números, marcas y términos técnicos; una transcripción incorrecta se traslada a la traducción y la subtitulación. Asegúrese de verificar las áreas críticas escuchando el audio.

Reglas de formato de subtítulos

Reglas comunes (varía según la plataforma):

  • ~37-42 caracteres por línea, 2 líneas como máximo.
  • Duración: ~1-6 segundos; Evite los subtítulos "flash" muy cortos.
  • CPS no debe exceder ~17 (contenido para adultos).
  • Divide la oración donde tenga sentido (no dejes "y" o "pero" al final de la línea).
  • Si es posible, no te saltes el corte de escena (cambio de plano).
  • Siga las reglas de la plataforma para elementos como malas palabras, canciones y escritura de guiones.

tres mini casos

Caso 1: ASR + posedición acelerada en un 60%. Primero, un equipo transcribió y codificó en el tiempo un documental de 45 minutos con ASR, luego lo tradujo y lo editó. Tiempo reducido en un 60% en comparación con la transcripción + tiempo de codificación desde cero. Pero todos los nombres y números propios fueron corregidos mediante comparación de sonidos.

Caso 2: CPS verifica la legibilidad guardada. La primera traducción de un vídeo instructivo con subtítulos fue precisa, pero el CPS promedió 24: la audiencia no pudo seguir el ritmo. Una ronda de acortamiento impulsado por IA acortó los subtítulos en un 30 %, reduciendo el CPS a 16; Se conservó el significado, llegó la legibilidad.

Caso 3: error de contexto visual. En la traducción basada en ASR, un personaje señaló un letrero en la pantalla y dijo "lee eso"; La IA lo tradujo como "léelo", pero el texto del cartel no estaba traducido, por lo que el espectador no podía ver qué leer. El subtitulador agregó un título separado para el título de pantalla; La persona que vio la imagen compensó la diferencia.

Cuatro plantillas copiables

1) Lista de verificación de transcripción (ASR):

A continuación se muestra una transcripción automática de un vídeo. Marque posibles errores en la transcripción: nombres propios, marcas, números, términos técnicos, frases ambiguas/incompletas. Enumérelos como "verificar por voz". No traduzcas. Transcribir: [...]

2) Traducción de subtítulos (CPS/longitud limitada):

Traduzca la siguiente transcripción a subtítulos en [idioma de destino]. RESTRICCIÓN: cada subtítulo debe tener un máximo de 2 líneas, línea ~42 caracteres, CPS no debe exceder ~17. ACORTAR y naturalizar conservando el significado; No traduzcas palabra por palabra. Preservar códigos de tiempo. Transcripción + códigos de tiempo: [...]

3) CPS/verificación de legibilidad:

Calcule el CPS aproximado en función de la duración y el número de caracteres de cada uno de los siguientes subtítulos. Marque cualquiera que exceda 17 y sugiera una alternativa más corta que preserve el significado. Subtítulos (texto | duración segundos): [...]

4) Verificación del texto en pantalla/contexto visual:

En el siguiente diálogo, marque los lugares que pueden hacer referencia a la imagen (texto en pantalla, objeto puntiagudo, letrero). Indique si se requieren subtítulos/explicaciones adicionales para estos, suponiendo que el espectador no pueda ver la imagen. Diálogo: [...]

Aviso débil / Aviso fuerte

Débil: "Traduce estos subtítulos". (Sin longitud, CPS, reglas de línea; la salida no cabe en la pantalla, es ilegible).

Güçlü: "Traduzca esta transcripción de diálogo a subtítulos en turco. Cada subtítulo debe tener un máximo de 2 líneas, 42 caracteres por línea; acórtelo conservando el significado cuando sea necesario para acelerar la lectura. Proporcione el idioma hablado en turco natural, suavice la jerga. No toque los códigos de tiempo".

Diferencia: un mensaje fuerte proporciona las limitaciones técnicas del subtítulo (línea, carácter, CPS, tono); el resultado en realidad se acerca a los subtítulos utilizables.

Cuadro comparativo de formatos AVT

formato

¿Qué hace?

Contribución de la IA

punto critico humano

subtítulo

Transcribe el discurso

ASR, traducción, CPS

Ajuste, contexto visual

doblaje

Locución en el idioma de destino

Borrador de traducción

sincronización de labios, actuación

voz en off

Leer la traducción arriba

Traducción, sincronización

Flujo natural, tono.

Audiodescripción

Describe la imagen con sonido.

borrador de texto

Interpretación visual (humana)

Errores comunes

  • Traducir la transcripción ASR sin verificarla. Los errores de nombre/número adecuados se trasladan al subtítulo.
  • Traducir palabra por palabra y moverse por CPS. El público no puede leer; se debe hacer el ajuste.
  • Ignorando el contexto visual. El texto en pantalla y los objetos puntiagudos permanecen sin traducir.
  • Hacer que la división de líneas sea inútil. Estropea la legibilidad.
  • Aplanando el tono/registro. Los dialectos y la jerga de los personajes desaparecen.

Doblaje y lip sync

Mientras que la limitación de la subtitulación es la velocidad de lectura, la limitación del doblaje es el tiempo y los labios. Hay tres tipos distintos de sincronización en la traducción de voz en off: sincronización de labios, donde la traducción coincide con el movimiento de la boca del personaje, especialmente las vocales abiertas en primeros planos; isocronía: la línea de traducción tiene la misma longitud que la línea original, ni demasiado corta ni demasiado larga; sincronía de gestos: hacer coincidir lo que se dice con los movimientos de manos y brazos del personaje. Por eso el traductor de doblaje suele escribir una línea "pegadiza" que conserva el significado pero con palabras completamente diferentes; Aquí la fidelidad de las palabras es incluso menor que la del subtítulo.

La IA puede proporcionar un borrador de traducción sin procesar y una advertencia de tiempo para el doblaje ("esta línea es un 40% más larga que el original, acórtela"). Las nuevas tecnologías pueden incluso clonar el sonido y producir doblajes automáticos; pero la actuación, la emoción, afinar la respiración del personaje y la sincronización de los labios siguen siendo trabajo del traductor humano y del actor de doblaje. El doblaje automático proporciona un esquema; La decisión artística y sincrónica es humana. Además, el consentimiento de la persona cuya voz se clona es una cuestión ética y legal importante.

En resumen

La traducción audiovisual es el arte de adaptar el texto a las limitaciones del ojo y el oído del espectador: límites línea/carácter/CPS en la subtitulación, sincronización labial en el doblaje, el contexto visual es el factor determinante en todos ellos. La IA acelera la transcripción, la codificación de tiempo, la redacción de traducciones y la verificación de CPS con ASR; Pero ASR se equivoca con los nombres propios y el ruido, no puede ver la imagen y las decisiones sobre el tono adecuado las toma el humano. El subtitulador maestro no traduce palabra por palabra; encuentra la expresión más corta y natural que preserva el significado.

Tarea de aplicación

Elija un videoclip corto (de 2 a 3 minutos). Transcribe con una herramienta ASR y compara y corrige áreas de riesgo con el audio con una plantilla de “verificación de transcripción”. Luego traduzca con la restricción CPS ~17 con la plantilla "traducción de subtítulos" y acorte los subtítulos que excedan el límite con el "control CPS". Si hay un texto o letrero en pantalla, aplique una "verificación de contexto visual".

lista de verificación

  • [] Verifiqué el descifrado ASR por voz para el nombre/número específico.
  • [] Hice que los subtítulos encajaran dentro de las reglas de línea/carácter/CPS.
  • [ ] Lo acorté y naturalicé, no palabra por palabra, preservando el significado.
  • [ ] Tomé en cuenta el contexto visual (texto en pantalla, letrero).
  • [] Lo traduje para preservar las diferencias de tono y carácter.