Unidade 7 / 11

Legendagem, Dublagem e Tradução Audiovisual

Ganhos:

  • Capacidade de ajuste preservando o significado aplicando as regras técnicas da legenda (linha, caractere, CPS)
  • Capacidade de verificar erros de nome e número adequados por voz enquanto acelera a transcrição e a codificação de tempo automática com ASR
  • Capacidade de gerenciar os limites da inteligência artificial levando em consideração o contexto visual, a diferença tonal e a sincronização labial na dublagem

Traduzir um filme, uma série de TV, um vídeo corporativo ou um curso online é radicalmente diferente de traduzir um texto simples: o tempo, a velocidade de leitura, a imagem na tela, a voz e o movimento labial dos personagens também são restrições. Nesta unidade, você aprenderá tradução audiovisual (legendagem, dublagem, narração), as regras técnicas de legendagem, transcrição e codificação de tempo apoiadas por IA e as armadilhas de qualidade deste campo. O objetivo é trabalhar como um especialista em tradução audiovisual que “se adapte aos olhos e ouvidos do público” em vez de “traduzir o texto”.

Conceitos básicos

A tradução audiovisual (AVT) é a tradução de conteúdo contendo áudio e vídeo; As principais formas são legendagem, dublagem e audiodescrição. A legendagem é o reflexo do discurso escrito na tela. Dublagem é a redobragem da voz original no idioma alvo. A narração ocorre quando o som original é silenciado e uma tradução é lida sobre ele (comum em documentários).

Dois termos técnicos críticos de legendagem: CPS (Caracteres por Segundo) limita a velocidade da legendagem para que o espectador possa lê-la confortavelmente; O limite superior geralmente aceito é de cerca de 17 caracteres por segundo (inferior para conteúdo infantil). Timecode é o horário de início e término que indica quando a legenda aparecerá e desaparecerá da tela (como 00:01:23.400).

Por que é difícil? Porque significa encaixar a tradução nas legendas. Duas linhas, aproximadamente 42 caracteres por linha, um mínimo de aproximadamente 1 segundo e um máximo de aproximadamente 6 segundos de tempo de tela e o limite de CPS – você precisa cumprir tudo isso enquanto mantém o significado e o tom. É por isso que a tradução de legendas costuma ser uma questão de compactação e reformulação, e não de tradução palavra por palavra.

Dica: Evite o reflexo de “traduzir cada palavra” nas legendas. O espectador observa e lê a imagem; Legendas muito longas não podem ser lidas. Encontrar a expressão natural mais curta que preserve o significado é o verdadeiro domínio do legendador.

O papel da IA na tradução audiovisual

A IA acelera significativamente várias etapas nesta área:

  1. Transcrição: Com ASR (Reconhecimento Automático de Fala), a voz é transcrita automaticamente. Isso extrai a fonte bruta da legenda em minutos.
  2. Codificação automática de tempo: as ferramentas dividem a conversa em segmentos e produzem rascunhos de códigos de tempo.
  3. Rascunho de tradução: O texto transcrito é traduzido.
  4. Controle de CPS/comprimento: A IA pode marcar qual legenda excede a velocidade de leitura e sugerir encurtamento.

Mas cuidado: ASR erra em ruído, sotaque, fala sobreposta, nomes próprios e termos técnicos; não pode fornecer “audiodescrição”; Quem está falando pode ficar confuso. A tradução da IA ​​​​não vê a imagem – ela não pode saber quando um objeto mostrado na tela é chamado de “aquilo”. Portanto, o humano verifica o contexto visual e a precisão da decifração.

Cuidado: O erro mais comum é pensar que a saída ASR está “decodificada”. ASR comete erros frequentes, principalmente em nomes próprios, números, marcas e termos técnicos; uma transcrição incorreta é transferida para a tradução e legendagem. Certifique-se de verificar as áreas críticas ouvindo o áudio.

Regras de formato de legenda

Regras comuns (variam de acordo com a plataforma):

  • ~37-42 caracteres por linha, máximo de 2 linhas.
  • Duração: ~1-6 segundos; Evite legendas muito curtas em "flash".
  • CPS não deve exceder ~17 (conteúdo adulto).
  • Quebre a frase onde fizer sentido (não deixe “e” ou “mas” no final da linha).
  • Se possível, não pule o corte da cena (mudança de cena).
  • Siga as regras da plataforma para itens como palavrões, músicas, escrita de tela.

três mini cases

Caso 1 — ASR + pós-edição acelerada em 60%. Uma equipe primeiro transcreveu e codificou o tempo de um documentário de 45 minutos com ASR, depois o traduziu e pós-editou. Tempo reduzido em 60% em comparação com transcrição + codificação de tempo do zero. Mas todos os nomes próprios e números foram corrigidos por comparação sonora.

Caso 2 — CPS verifica a legibilidade salva. A primeira tradução de um vídeo instrutivo com legendas foi precisa, mas o CPS teve uma média de 24 – o público não conseguiu acompanhar. Uma rodada de encurtamento com tecnologia de IA reduziu as legendas em 30%, reduzindo o CPS para 16; o significado foi preservado, a legibilidade veio.

Caso 3 — Erro de contexto visual. Na tradução baseada em ASR, um personagem apontou para uma placa na tela e disse “leia isso”; A IA traduziu como “leia”, mas o texto na placa não foi traduzido, então o espectador não conseguia ver o que ler. O legendador adicionou uma legenda separada para a legenda da tela; Quem viu a imagem fez a diferença.

Quatro modelos copiáveis

1) Lista de verificação de transcrição (ASR):

Abaixo está uma transcrição automática de um vídeo. Marcar possíveis erros na transcrição: nomes próprios, marcas, números, termos técnicos, frases ambíguas/incompletas. Liste-os como "verificar por voz". Não traduza. Transcreva: [...]

2) Tradução de legendas (CPS/comprimento limitado):

Traduza a seguinte transcrição para legendas em [idioma de destino]. RESTRIÇÃO: cada legenda deve ter no máximo 2 linhas, linha ~42 caracteres, CPS não deve exceder ~17. ENCURTAR e naturalizar preservando o significado; não traduza palavra por palavra. Preservar códigos de tempo. Transcrição + códigos de tempo: [...]

3) Verificação de CPS/legibilidade:

Calcule o CPS aproximado com base na duração e na contagem de caracteres de cada uma das legendas a seguir. Marque qualquer que exceda 17 e sugira uma alternativa mais curta que preserve o significado. Legendas (texto | duração em segundos): [...]

4) Verificação do texto da tela/contexto visual:

No diálogo seguinte, marque os locais que podem remeter à imagem (texto na tela, objeto pontiagudo, sinal). Diga se são necessárias legendas/explicações adicionais para estes, assumindo que o espectador não consegue ver a imagem. Diálogo: [...]

Alerta fraco / Alerta forte

Fraco: "Traduza essas legendas." (Sem comprimento, CPS, regras de linha; a saída não cabe na tela, ilegível.)

Güçlü: "Traduza esta transcrição do diálogo para legendas em turco. Cada legenda deve ter no máximo 2 linhas, 42 caracteres por linha; encurte-a preservando o significado quando necessário para a velocidade de leitura. Forneça a língua falada em turco natural, suavize a gíria. Não toque nos códigos de tempo."

Diferença: prompt forte fornece as restrições técnicas da legenda (linha, caractere, CPS, tom); a saída realmente se aproxima das legendas utilizáveis.

Gráfico de comparação de formatos AVT

formato

O que faz

Contribuição de IA

ponto crítico humano

legenda

Transcreve o discurso

ASR, tradução, CPS

Ajuste, contexto visual

dublagem

Locução no idioma alvo

Rascunho de tradução

sincronização labial, atuação

narração

Leia a tradução acima

Tradução, tempo

Fluxo natural, tom

Descrição de áudio

Descreve a imagem com som

rascunho de texto

Interpretação visual (humana)

Erros comuns

  • Traduzir a transcrição ASR sem verificá-la. Erros de nome/número próprios são transferidos para a legenda.
  • Traduzindo palavra por palavra e contornando o CPS. O público não sabe ler; o ajuste deve ser feito.
  • Ignorando o contexto visual. O texto da tela e os objetos pontiagudos permanecem sem tradução.
  • Tornando a divisão de linha inútil. Isso prejudica a legibilidade.
  • Achatando o tom/registro. Os dialetos e gírias dos personagens desaparecem.

Dublagem e sincronização labial

Enquanto a restrição da legendagem é a velocidade de leitura, a restrição da dublagem é o tempo e os lábios. Existem três tipos distintos de sincronização na tradução de narração: sincronização labial — onde a tradução corresponde ao movimento da boca do personagem, especialmente vogais abertas em close-ups; isocronia — a linha de tradução tem o mesmo comprimento da linha original, nem muito curta nem muito longa; sincronia de gestos — combinando o que é dito com os movimentos das mãos e dos braços do personagem. É por isso que o tradutor de dublagem muitas vezes escreve uma linha “cativante” que preserva o significado, mas com palavras completamente diferentes; A fidelidade das palavras é ainda menor do que a das legendas aqui.

A IA pode fornecer um rascunho de tradução bruto e um aviso de tempo para dublagem (“esta linha é 40% mais longa que o original, encurte-a”). Novas tecnologias podem até clonar som e produzir dublagem automática; mas atuação, emoção, ajuste fino da respiração do personagem e dublagem ainda são trabalho do tradutor e dublador humano. A dublagem automática fornece um esboço; A decisão artística e síncrona é do ser humano. Além disso, o consentimento da pessoa cuja voz é clonada é uma importante questão ética e legal.

Em resumo

A tradução audiovisual é a arte de adequar o texto às restrições do olho e do ouvido do espectador: limites de linha/caractere/CPS na legendagem, sincronização labial na dublagem, o contexto visual é o fator determinante em todos eles. A IA acelera a transcrição, codificação de tempo, elaboração de tradução e verificação de CPS com ASR; Mas o ASR comete erros com nomes próprios e ruído, não consegue ver a imagem e as decisões de ajuste do tom são tomadas pelo ser humano. O legendador mestre não traduz palavra por palavra; encontra a expressão mais curta e natural que preserva o significado.

Tarefa de aplicativo

Escolha um videoclipe curto (2-3 minutos). Transcreva com uma ferramenta ASR e compare e corrija áreas de risco com o áudio com um modelo de “verificação de transcrição”. Em seguida, traduza com a restrição CPS ~17 com o modelo "tradução de legendas" e encurte as legendas que excedem o limite com o "controle CPS". Se houver um texto ou sinal na tela, aplique uma "verificação de contexto visual".

lista de verificação

  • [] Verifiquei a descriptografia ASR por voz para o nome/número específico.
  • [ ] Fiz com que as legendas se enquadrassem nas regras de linha/personagem/CPS.
  • [ ] Encurtei e naturalizei, não palavra por palavra, preservando o sentido.
  • [ ] Levei em consideração o contexto visual (texto na tela, sinalização).
  • [] Eu traduzi para preservar as diferenças de tom e caráter.