Jednotka 7 / 11

Titulky, dabing a audiovizuální překlady

zisky:

  • Schopnost přizpůsobit se při zachování významu použitím technických pravidel titulku (řádek, znak, CPS)
  • Schopnost ověřit správné jméno a číslo chyby hlasem a zároveň urychlit přepis a automatické časové kódování s ASR
  • Schopnost řídit limity umělé inteligence zohledněním vizuálního kontextu, rozdílu tónů a synchronizace rtů v dabingu

Překlad filmu, televizního seriálu, firemního videa nebo online kurzu se radikálně liší od překládání prostého textu: omezeními jsou také čas, rychlost čtení, obraz na obrazovce, hlas a pohyby rtů postav. V této lekci se naučíte audiovizuální překlad (titulky, dabing, voice-over), technická pravidla titulkování, přepis a časové kódování s podporou AI a úskalí kvality tohoto oboru. Cílem je pracovat jako odborník na audiovizuální překlad, který „padne divákům do očí a uší“, spíše než „překládat text“.

Základní pojmy

Audiovizuální překlad (AVT) je překlad obsahu obsahujícího zvuk a video; Hlavními formami jsou titulky, dabing a audio popis. Titulky jsou odrazem řeči v psané podobě na obrazovce. Dabing je překopírování původního hlasu v cílovém jazyce. Voice-over je, když je původní zvuk ztlumen a je přes něj přečten překlad (běžné v dokumentech).

Dva kritické technické termíny titulkování: CPS (znaky za sekundu) omezuje rychlost titulkování tak, aby je divák mohl pohodlně číst; Obecně přijímaný horní limit je kolem 17 znaků za sekundu (nižší u obsahu pro děti). Časový kód je čas začátku a konce, který označuje, kdy se titulky objeví a zmizí na obrazovce (například 00:01:23,400).

proč je to těžké? Protože to znamená umístit překlad do titulků. Dva řádky, ~42 znaků na řádek, minimálně ~1 sekunda a maximálně ~6 sekund času stráveného na obrazovce a limit CPS – to vše musíte dodržet a zároveň zachovat význam a tón. Proto je překlad titulků často záležitostí komprese a přeformulování, nikoli překladu slovo od slova.

Tip: Vyhněte se reflexu „překládat každé slovo“ v titulcích. Divák obraz sleduje i čte; Příliš dlouhé titulky nelze přečíst. Nalezení nejkratšího přirozeného výrazu, který zachovává význam, je skutečným mistrovstvím titulkáře.

Role AI v audiovizuálním překladu

AI výrazně urychluje několik kroků v této oblasti:

  1. Přepis: S ASR (Automatic Speech Recognition) je hlas automaticky přepisován. Toto extrahuje nezpracovaný zdroj titulků během několika minut.
  2. Automatické časové kódování: Nástroje rozdělují konverzaci na segmenty a vytvářejí návrhy časových kódů.
  3. Návrh překladu: Text přepisu je přeložen.
  4. Ovládání CPS/délky: AI může označit, které titulky překračuje rychlost čtení, a navrhnout zkrácení.

Ale pozor: ASR chybuje v šumu, přízvuku, překrývající se řeči, vlastních jménech a odborných termínech; nemůže poskytnout "zvukový popis"; Kdo mluví, může být zmatený. AI ​​překlad nevidí obrázek – nemůže vědět, kdy se objekt zobrazený na obrazovce nazývá „to“. Člověk si proto ověřuje vizuální kontext a přesnost dešifrování.

Pozor: Nejčastější chybou je myslet si, že výstup ASR je „dekódovaný“. ASR dělá časté chyby, zejména ve vlastních jménech, číslech, názvech značek a odborných termínech; nesprávný přepis se přenese do překladu a titulkování. Nezapomeňte ověřit kritické oblasti poslechem zvuku.

Pravidla formátu titulků

Společná pravidla (liší se podle platformy):

  • ~37-42 znaků na řádek, maximálně 2 řádky.
  • Doba trvání: ~1-6 sekund; Vyhněte se velmi krátkým „flash“ titulkům.
  • CPS nesmí překročit ~17 (obsah pro dospělé).
  • Přerušte větu tam, kde to dává smysl (nenechávejte „a“ nebo „ale“ na konci řádku).
  • Pokud je to možné, nepřeskakujte střih scény (změnu záběru).
  • Dodržujte pravidla platformy pro položky, jako jsou nadávky, písně, psaní obrazovky.

tři mini pouzdra

Případ 1 — ASR + dodatečná úprava zrychlena o 60 %. Tým nejprve přepsal a časově zakódoval 45minutový dokument pomocí ASR, poté jej přeložil a následně upravil. Čas zkrácen o 60 % ve srovnání s přepisem + časové kódování od začátku. Ale všechna vlastní jména a čísla byla opravena zvukovým srovnáním.

Případ 2 — CPS kontroluje uloženou čitelnost. První překlad instruktážního videa s titulky byl přesný, ale CPS bylo v průměru 24 — diváci nestíhali. Kolo zkrácení s umělou inteligencí zkrátilo titulky o 30 % a snížilo CPS na 16; význam zůstal zachován, čitelnost přišla.

Případ 3 – Chyba vizuálního kontextu. V překladu založeném na ASR postava ukázala na znamení na obrazovce a řekla „přečti si to“; Umělá inteligence to přeložila jako „přečtěte si to“, ale text na cedulce nebyl přeložen, takže divák neviděl, co má číst. Titulkující přidal samostatný titulek pro titulek obrazovky; Osoba, která viděla obrázek, vytvořila rozdíl.

Čtyři kopírovatelné šablony

1) Seznam ověření přepisu (ASR):

Níže je automatický přepis videa. Označte případné chyby v přepisu: vlastní jména, názvy značek, čísla, odborné výrazy, nejednoznačné/neúplné věty. Uveďte je jako „ověření hlasem“. Nepřekládat. Přepis: [...]

2) Překlad titulků (CPS/omezená délka):

Přeložte následující přepis do [cílový jazyk] titulků. OMEZENÍ: každý titulek musí mít maximálně 2 řádky, řádek ~42 znaků, CPS nesmí překročit ~17. ZKRÁTIT a naturalizovat při zachování významu; nepřekládejte slovo od slova. Zachovejte časové kódy. Přepis + časové kódy: [...]

3) Kontrola CPS/čitelnosti:

Vypočítejte přibližné CPS na základě trvání a počtu znaků pro každý z následujících titulků. Označte všechny, které přesahují 17, a navrhněte kratší alternativu, která zachová význam. Titulky (text | trvání v sekundách): [...]

4) Kontrola textu na obrazovce / vizuálního kontextu:

V následujícím dialogu označte místa, která mohou odkazovat na obrázek (text na obrazovce, špičatý předmět, znak). Řekněte, zda jsou k tomu zapotřebí další titulky/vysvětlivky, za předpokladu, že divák obraz nevidí. Dialog: [...]

Slabá výzva / Silná výzva

Slabé: "Přeložte tyto titulky." (Žádná délka, CPS, řádková pravidla; výstup se nevejde na obrazovku, nečitelný.)

Güçlü: "Přeložte tento přepis dialogu do tureckých titulků. Každý titulek musí mít maximálně 2 řádky, 42 znaků na řádek; zkraťte je při zachování významu, pokud je to nutné pro rychlost čtení. Mluvený jazyk uveďte v přirozené turečtině, zjemněte slang. Nedotýkejte se časových kódů."

Rozdíl: silná výzva udává technická omezení titulků (řádek, znak, CPS, tón); výstup se skutečně blíží použitelným titulkům.

Tabulka srovnání formátů AVT

formát

Co dělá

Příspěvek AI

lidský kritický bod

podtitulek

Přepisuje řeč

ASR, překlad, CPS

Fit, vizuální kontext

dabing

Voiceover v cílovém jazyce

Návrh překladu

synchronizace rtů, herectví

voice-over

Přečtěte si překlad výše

Překlad, načasování

Přirozený tok, tón

Zvukový popis

Popisuje obraz se zvukem

návrh textu

Vizuální interpretace (člověk)

Časté chyby

  • Překlad přepisu ASR bez jeho ověření. Chyby správného jména/čísla se přenesou do titulků.
  • Překlad slovo po slovu a obcházení CPS. Publikum neumí číst; musí být provedeno fit.
  • Ignorování vizuálního kontextu. Text na obrazovce a špičaté objekty zůstanou nepřeložené.
  • Dělat dělení čáry zbytečným. Kazí to čitelnost.
  • Zploštění tónu/registru. Mizí dialekty a slang postav.

Dabing a synchronizace rtů

Zatímco omezením titulků je rychlost čtení, omezením dabingu je čas a rty. V překladu komentáře existují tři odlišné typy synchronizace: synchronizace rtů — kde překlad odpovídá pohybu úst postavy, zvláště otevřených samohlásek v detailních záběrech; izochronie — čára překladu je stejně dlouhá jako původní čára, není ani příliš krátká, ani příliš dlouhá; synchronizace gest — přizpůsobení toho, co je řečeno, s pohyby rukou a paží postavy. Proto dabingový překladatel často napíše „chytlavou“ repliku, která zachová význam, ale se zcela jinými slovy; Slovní věrnost je zde ještě menší než titulky.

Umělá inteligence může poskytnout nezpracovaný návrh překladu a časové varování pro dabing („tento řádek je o 40 % delší než originál, zkraťte ho“). Nové technologie mohou dokonce klonovat zvuk a produkovat automatický dabing; ale herectví, emoce, doladění dýchání postavy a synchronizace rtů jsou stále úkolem lidského překladatele a hlasového herce. Automatický dabing poskytuje obrys; Umělecké a synchronní rozhodnutí je na lidech. Kromě toho je souhlas osoby, jejíž hlas je klonován, důležitým etickým a právním problémem.

V souhrnu

Audiovizuální překlad je uměním přizpůsobit text omezením divákova oka a ucha: hranice linie/postavy/CPS v titulcích, synchronizace rtů v dabingu, vizuální kontext je ve všech určujícím faktorem. AI urychluje přepis, časové kódování, navrhování překladu a kontrolu CPS pomocí ASR; Ale ASR se mýlí ve správných jménech a šumu, nevidí obraz a rozhodnutí o vhodném tónu dělá člověk. Hlavní titulkovač nepřekládá slovo od slova; najde nejkratší, nejpřirozenější výraz, který zachová význam.

Aplikační úkol

Vyberte si krátký (2-3 minuty) videoklip. Přepisujte pomocí nástroje ASR a porovnejte a opravte rizikové oblasti se zvukem pomocí šablony „ověření přepisu“. Poté přeložte s omezením CPS ~17 pomocí šablony "překlad titulků" a zkraťte titulky, které překračují limit, pomocí "ovládání CPS". Pokud je na obrazovce text nebo znak, použijte „kontrolu vizuálního kontextu“.

kontrolní seznam

  • [ ] Ověřil jsem dešifrování ASR hlasem pro konkrétní jméno/číslo.
  • [ ] Titulky jsem přizpůsobil pravidlům řádků/znaků/CPS.
  • [ ] Zkrátil jsem a naturalizoval jsem to, ne slovo od slova, se zachováním významu.
  • [ ] Vzal jsem v úvahu vizuální kontext (text na obrazovce, znak).
  • [ ] Přeložil jsem to, abych zachoval rozdíly v tónu a charakteru.