Ganancias:
- Capacidad para comprender los conceptos de transcripción automática y separación de hablantes y convertir grabaciones sin formato en texto codificado por tiempo.
- Capacidad para comprender formatos de subtítulos (SRT/VTT), velocidad de lectura y reglas de línea, y producir y editar borradores de subtítulos multilingües.
- Entendiendo que es responsabilidad del editor verificar la terminología, nombres propios, errores de puntuación y errores de traducción en la transcripción automática antes de su publicación.
La tarea de posproducción más tediosa y que requería más tiempo era tradicionalmente la transcripción: un editor escuchaba interminablemente horas de material de entrevistas y escribía cada oración a mano. Una grabación de una hora fácilmente tardaría entre cuatro y cinco horas en transcribirse. La inteligencia artificial ha cambiado radicalmente este negocio: hoy en día, una grabación de una hora se puede convertir en texto codificado en el tiempo en cuestión de minutos. Esto acelera el proceso de edición y permite la accesibilidad (subtítulos para espectadores con problemas de audición y visualización silenciosa). Pero la salida automática nunca es adecuada para la publicación en su forma original; En esta unidad veremos tanto el poder como los peligros.
Empecemos por los términos. La transcripción es la puesta por escrito del discurso. El reconocimiento automático de voz (ASR) es una tecnología que traduce la voz en texto. El código de tiempo es el signo que muestra a qué segundo corresponde el texto en el vídeo. La diarización del hablante consiste en distinguir "quién habló" y dividir el texto en hablantes. Subtítulo (subtítulo/título) es el texto codificado por tiempo que aparece en la pantalla. SRT y VTT son los formatos de archivos de subtítulos más comunes; Contienen el orden, la hora de inicio y fin y el texto de cada línea. La velocidad de lectura (CPS: caracteres por segundo) determina cuánto tiempo debe permanecer la línea en la pantalla para que el espectador pueda leer el subtítulo cómodamente.
El poder y el límite de la transcripción automática
La transcripción mediante IA transcribe una voz clara de un solo hablante grabada en turco adecuado con muy alta precisión. Pero comete errores en las siguientes situaciones, y conocerlos le permite dirigir la verificación: nombres propios (los nombres de personas, marcas y lugares a menudo están mal escritos), términos técnicos y abreviaturas, palabras que suenan similares (“kar/kar”, “still/still”), habla superpuesta (dos personas al mismo tiempo), ruido de fondo y música, diferencias de dialecto/acento y puntuación (final de pregunta o oración). Además, el modelo puede “escuchar” y transcribir una palabra que nunca se ha pronunciado en un momento ruidoso; esta es la alucinación de la transcripción.
La siguiente tabla resume las condiciones fuertes y débiles para la transcripción automática:
condición
precisión
Enfoque del editor
Un solo altavoz, sonido claro, ambiente silencioso
muy alto
Nombres propios, puntuación.
Panel de varios altavoces
medio
Separación de hablantes, discurso superpuesto
Grabación ruidosa/en exteriores
bajo-medio
Palabra inventada, saltar.
Contenido técnico/jerga
medio
Escritura de términos y abreviaturas.
discurso acentuado
variable
Errores de palabras, significado
Formato de subtítulos y reglas de legibilidad.
Un buen subtítulo no es sólo "texto correcto"; debe ser legible. Existen algunas reglas generales en la práctica internacional: una línea de subtítulos generalmente no debe tener más de dos líneas; cada línea debe tener una longitud razonable (aproximadamente 37 a 42 caracteres); El subtítulo debe permanecer en la pantalla el tiempo suficiente para poder leerse (normalmente entre 1 y 6 segundos); La velocidad de lectura no debe ser demasiado alta (la mayoría de las guías consideran ~15-17 caracteres/segundo como límite). Las herramientas de inteligencia artificial dividen automáticamente el subtítulo, pero estas divisiones a veces cortan la oración en lugares incorrectos (línea que termina en "y", ruptura que divide el significado). El trabajo del editor es hacer que el texto sea preciso y fluido.
Tu función: asistente del editor de subtítulos. A continuación se muestra una transcripción automática. Tarea:1) Divida el texto en bloques de subtítulos según la lógica SRT.2) Cada bloque debe tener un máximo de 2 líneas, cada línea no debe exceder ~40 caracteres.3) Divida la oración en lugares significativos; Línea que termina en "y", "pero", "eso".4) Marque los nombres propios y los términos con la etiqueta [CHECK] para que pueda verificarlos manualmente.5) No cambie el texto, solo divídalo y márquelo.
La idea de la "etiqueta [CONTROL]" en este mensaje es valiosa: hacer que la IA marque áreas donde no está seguro o es riesgoso (nombre propio, término) dirige la atención del editor a los puntos correctos y evita la confianza ciega.
Subtítulos y traducción multilingües.
Abrir un vídeo en varios idiomas aumenta la audiencia. La IA puede tomar la transcripción, traducirla al idioma de destino y producir un archivo de subtítulos. Esta es una capacidad poderosa, pero es la más vulnerable: la traducción automática puede tergiversar modismos, referencias culturales, humor y juegos de palabras, términos y contexto. Traducir palabra por palabra la frase "Está lloviendo a cántaros" es un desastre. También existe una limitación de espacio en la traducción de subtítulos: la frase en el idioma de destino puede ser más larga y superar la velocidad de lectura. Por eso es esencial para los subtítulos multilingües que una persona que conozca el idioma de destino verifique la traducción; especialmente en el caso de contenido sensible como el de marca, el legal o el de salud, una traducción incorrecta puede tener graves consecuencias.
Traduce los siguientes bloques de subtítulos turcos al inglés. Reglas: - Transferir el modismo y el chiste, no palabra por palabra, pero conservando su SIGNIFICADO. - Dejar la marca y el nombre del producto como están, no traducir. - Deje que cada bloque mantenga su velocidad de lectura; Acorte si es necesario, pero no distorsione el significado. - Especifica la referencia cultural o término del que no estás seguro con [NOTA DEL TRADUCTOR].
tres mini casos
Caso 1: Línea de aceleración. Un equipo de documentalistas pasó tres semanas transcribiendo manualmente un archivo de entrevistas de 12 horas. Con la transcripción automática, el texto sin formato se publicó en un día; Al buscar por texto (palabra por palabra), el equipo encontró los momentos que buscaba en segundos. Luego editaron y subtitularon meticulosamente sólo el episodio de 40 minutos que usarían. Tres semanas se convirtieron en cuatro días; esfuerzo de verificación centrado en la sección utilizada.
Caso 2: Palabra inventada. Un canal de noticias transmitió la estridente entrevista callejera con subtítulos automáticos, sin control. La modelo "escuchó" una palabra no dicha en el zumbido de fondo, y la leyenda imputó una palabra no dicha al entrevistado. Hubo reacción en las redes sociales y se publicó la corrección. Lección: en grabaciones ruidosas, los subtítulos automáticos deben compararse con el audio original.
Caso 3: Desastre de traducción. Una marca publicó los subtítulos en inglés de su vídeo promocional con traducción automática y sin control. Cuando se tradujo palabra por palabra un modismo turco ("mantente atento"), al público inglés le pareció sin sentido e incluso divertido, y la seriedad de la marca quedó dañada. La forma correcta: hacer que la traducción sea verificada por alguien que conozca el idioma de destino.
Aviso débil / Aviso fuerte
Aviso débil:
Subtitula este vídeo y tradúcelo al inglés.
No hay formato, ni reglas de legibilidad, ni marcas de validación. La salida será cruda y arriesgada.
Potente mensaje:
Su función: editor de subtítulos bilingüe. Entrada: transcripción con código de tiempo en turco. Tarea: 1) Editar subtítulos en turco en 2 líneas / ~40 caracteres / buenas reglas de división. 2) Marcar nombres y términos propios con [CONTROL]. 3) Producir traducción al inglés por separado; Transfiera la frase literalmente, conserve la marca.4) Marque los bloques que excedan la velocidad de lectura con [LARGO].5) No invente ninguna palabra; Escribe el sonido indefinido [NO INDICADO].
Errores comunes
- Publicación de transcripciones automáticas sin control. Persisten errores en nombres propios, términos, puntuación y palabras inventadas.
- Mala división de líneas. Las líneas que terminan en "y/pero/ki" dificultan la lectura.
- Superar la velocidad de lectura. Los subtítulos largos que son demasiado cortos en la pantalla no se pueden leer.
- No verificar la traducción automática. Si un modismo, un chiste o un término salen mal, la marca sufre.
- Sin pasar por la distinción de hablante. Si hay confusión sobre "quién dijo qué" en el panel, el subtítulo será engañoso.
Consejo: Mientras editas la transcripción, mira el vídeo a una velocidad de 1,25-1,5 y comprueba que esté sincronizado con los subtítulos. De esta manera, podrá captar rápidamente tanto la desviación del código de tiempo como las palabras inventadas o perdidas.
Precaución: en campos como la salud, el derecho y las finanzas, una sola palabra transcrita incorrectamente (por ejemplo, una dosis, un número de ingrediente) puede tener consecuencias graves. En estos contenidos se deberá verificar por separado cada número y término.
En resumen
La transcripción y los subtítulos automatizados son el mayor ahorro de tiempo en posproducción y permiten la accesibilidad. La IA reduce las horas de transcripción a minutos y permite la búsqueda por texto. Pero el resultado no es adecuado para su publicación en su forma original: deben corregirse los nombres propios, los términos, la puntuación, las palabras inventadas y los saltos de línea incorrectos. Las reglas de legibilidad (longitud de línea, duración, velocidad de lectura) hacen que el texto sea fluido para el espectador. En los subtítulos multilingües, la traducción automática debe ser verificada por una persona que conozca el idioma de destino. La IA vierte y sugiere; La precisión, legibilidad y significado son responsabilidad del editor.
Tarea de aplicación
Realice una grabación breve de una conversación (tal vez su propia voz, de 2 a 3 minutos) y transcríbala automáticamente. Compare el resultado con el audio original y marque los nombres propios, los términos y los errores de puntuación; Encuentra al menos cinco errores. Luego, divida el texto en bloques de subtítulos de acuerdo con las reglas anteriores, tradúzcalo a un idioma y corrija al menos dos puntos riesgosos (modismos/términos) en la traducción. Informe el proceso y cualquier error que encuentre.
lista de verificación
- [] ¿He comparado la transcripción con el audio original y he corregido cualquier error de puntuación, término o nombre propio?
- [ ] ¿He revisado si hay palabras inventadas u omitidas?
- [] ¿He editado el subtítulo según las reglas de longitud de línea, duración y velocidad de lectura?
- [ ] Para subtítulos multilingües, ¿he verificado cuidadosamente la traducción con alguien que conozca el idioma de destino?
- [] ¿He verificado por separado cada número y término en contenido confidencial?