zisky:
- Schopnost přizpůsobit se při zachování významu použitím technických pravidel titulku (řádek, znak, CPS)
- Schopnost ověřit správné jméno a číslo chyby hlasem a zároveň urychlit přepis a automatické časové kódování s ASR
- Schopnost řídit limity umělé inteligence zohledněním vizuálního kontextu, rozdílu tónů a synchronizace rtů v dabingu
Překlad filmu, televizního seriálu, firemního videa nebo online kurzu se radikálně liší od překládání prostého textu: omezeními jsou také čas, rychlost čtení, obraz na obrazovce, hlas a pohyby rtů postav. V této lekci se naučíte audiovizuální překlad (titulky, dabing, voice-over), technická pravidla titulkování, přepis a časové kódování s podporou AI a úskalí kvality tohoto oboru. Cílem je pracovat jako odborník na audiovizuální překlad, který „padne divákům do očí a uší“, spíše než „překládat text“.
Základní pojmy
Audiovizuální překlad (AVT) je překlad obsahu obsahujícího zvuk a video; Hlavními formami jsou titulky, dabing a audio popis. Titulky jsou odrazem řeči v psané podobě na obrazovce. Dabing je překopírování původního hlasu v cílovém jazyce. Voice-over je, když je původní zvuk ztlumen a je přes něj přečten překlad (běžné v dokumentech).
Dva kritické technické termíny titulkování: CPS (znaky za sekundu) omezuje rychlost titulkování tak, aby je divák mohl pohodlně číst; Obecně přijímaný horní limit je kolem 17 znaků za sekundu (nižší u obsahu pro děti). Časový kód je čas začátku a konce, který označuje, kdy se titulky objeví a zmizí na obrazovce (například 00:01:23,400).
proč je to těžké? Protože to znamená umístit překlad do titulků. Dva řádky, ~42 znaků na řádek, minimálně ~1 sekunda a maximálně ~6 sekund času stráveného na obrazovce a limit CPS – to vše musíte dodržet a zároveň zachovat význam a tón. Proto je překlad titulků často záležitostí komprese a přeformulování, nikoli překladu slovo od slova.
Tip: Vyhněte se reflexu „překládat každé slovo“ v titulcích. Divák obraz sleduje i čte; Příliš dlouhé titulky nelze přečíst. Nalezení nejkratšího přirozeného výrazu, který zachovává význam, je skutečným mistrovstvím titulkáře.
Role AI v audiovizuálním překladu
AI výrazně urychluje několik kroků v této oblasti:
- Přepis: S ASR (Automatic Speech Recognition) je hlas automaticky přepisován. Toto extrahuje nezpracovaný zdroj titulků během několika minut.
- Automatické časové kódování: Nástroje rozdělují konverzaci na segmenty a vytvářejí návrhy časových kódů.
- Návrh překladu: Text přepisu je přeložen.
- Ovládání CPS/délky: AI může označit, které titulky překračuje rychlost čtení, a navrhnout zkrácení.
Ale pozor: ASR chybuje v šumu, přízvuku, překrývající se řeči, vlastních jménech a odborných termínech; nemůže poskytnout "zvukový popis"; Kdo mluví, může být zmatený. AI překlad nevidí obrázek – nemůže vědět, kdy se objekt zobrazený na obrazovce nazývá „to“. Člověk si proto ověřuje vizuální kontext a přesnost dešifrování.
Pozor: Nejčastější chybou je myslet si, že výstup ASR je „dekódovaný“. ASR dělá časté chyby, zejména ve vlastních jménech, číslech, názvech značek a odborných termínech; nesprávný přepis se přenese do překladu a titulkování. Nezapomeňte ověřit kritické oblasti poslechem zvuku.
Pravidla formátu titulků
Společná pravidla (liší se podle platformy):
- ~37-42 znaků na řádek, maximálně 2 řádky.
- Doba trvání: ~1-6 sekund; Vyhněte se velmi krátkým „flash“ titulkům.
- CPS nesmí překročit ~17 (obsah pro dospělé).
- Přerušte větu tam, kde to dává smysl (nenechávejte „a“ nebo „ale“ na konci řádku).
- Pokud je to možné, nepřeskakujte střih scény (změnu záběru).
- Dodržujte pravidla platformy pro položky, jako jsou nadávky, písně, psaní obrazovky.
tři mini pouzdra
Případ 1 — ASR + dodatečná úprava zrychlena o 60 %. Tým nejprve přepsal a časově zakódoval 45minutový dokument pomocí ASR, poté jej přeložil a následně upravil. Čas zkrácen o 60 % ve srovnání s přepisem + časové kódování od začátku. Ale všechna vlastní jména a čísla byla opravena zvukovým srovnáním.
Případ 2 — CPS kontroluje uloženou čitelnost. První překlad instruktážního videa s titulky byl přesný, ale CPS bylo v průměru 24 — diváci nestíhali. Kolo zkrácení s umělou inteligencí zkrátilo titulky o 30 % a snížilo CPS na 16; význam zůstal zachován, čitelnost přišla.
Případ 3 – Chyba vizuálního kontextu. V překladu založeném na ASR postava ukázala na znamení na obrazovce a řekla „přečti si to“; Umělá inteligence to přeložila jako „přečtěte si to“, ale text na cedulce nebyl přeložen, takže divák neviděl, co má číst. Titulkující přidal samostatný titulek pro titulek obrazovky; Osoba, která viděla obrázek, vytvořila rozdíl.
Čtyři kopírovatelné šablony
1) Seznam ověření přepisu (ASR):
Níže je automatický přepis videa. Označte případné chyby v přepisu: vlastní jména, názvy značek, čísla, odborné výrazy, nejednoznačné/neúplné věty. Uveďte je jako „ověření hlasem“. Nepřekládat. Přepis: [...]
2) Překlad titulků (CPS/omezená délka):
Přeložte následující přepis do [cílový jazyk] titulků. OMEZENÍ: každý titulek musí mít maximálně 2 řádky, řádek ~42 znaků, CPS nesmí překročit ~17. ZKRÁTIT a naturalizovat při zachování významu; nepřekládejte slovo od slova. Zachovejte časové kódy. Přepis + časové kódy: [...]
3) Kontrola CPS/čitelnosti:
Vypočítejte přibližné CPS na základě trvání a počtu znaků pro každý z následujících titulků. Označte všechny, které přesahují 17, a navrhněte kratší alternativu, která zachová význam. Titulky (text | trvání v sekundách): [...]
4) Kontrola textu na obrazovce / vizuálního kontextu:
V následujícím dialogu označte místa, která mohou odkazovat na obrázek (text na obrazovce, špičatý předmět, znak). Řekněte, zda jsou k tomu zapotřebí další titulky/vysvětlivky, za předpokladu, že divák obraz nevidí. Dialog: [...]
Slabá výzva / Silná výzva
Slabé: "Přeložte tyto titulky." (Žádná délka, CPS, řádková pravidla; výstup se nevejde na obrazovku, nečitelný.)
Güçlü: "Přeložte tento přepis dialogu do tureckých titulků. Každý titulek musí mít maximálně 2 řádky, 42 znaků na řádek; zkraťte je při zachování významu, pokud je to nutné pro rychlost čtení. Mluvený jazyk uveďte v přirozené turečtině, zjemněte slang. Nedotýkejte se časových kódů."
Rozdíl: silná výzva udává technická omezení titulků (řádek, znak, CPS, tón); výstup se skutečně blíží použitelným titulkům.
Tabulka srovnání formátů AVT
formát
Co dělá
Příspěvek AI
lidský kritický bod
podtitulek
Přepisuje řeč
ASR, překlad, CPS
Fit, vizuální kontext
dabing
Voiceover v cílovém jazyce
Návrh překladu
synchronizace rtů, herectví
voice-over
Přečtěte si překlad výše
Překlad, načasování
Přirozený tok, tón
Zvukový popis
Popisuje obraz se zvukem
návrh textu
Vizuální interpretace (člověk)
Časté chyby
- Překlad přepisu ASR bez jeho ověření. Chyby správného jména/čísla se přenesou do titulků.
- Překlad slovo po slovu a obcházení CPS. Publikum neumí číst; musí být provedeno fit.
- Ignorování vizuálního kontextu. Text na obrazovce a špičaté objekty zůstanou nepřeložené.
- Dělat dělení čáry zbytečným. Kazí to čitelnost.
- Zploštění tónu/registru. Mizí dialekty a slang postav.
Dabing a synchronizace rtů
Zatímco omezením titulků je rychlost čtení, omezením dabingu je čas a rty. V překladu komentáře existují tři odlišné typy synchronizace: synchronizace rtů — kde překlad odpovídá pohybu úst postavy, zvláště otevřených samohlásek v detailních záběrech; izochronie — čára překladu je stejně dlouhá jako původní čára, není ani příliš krátká, ani příliš dlouhá; synchronizace gest — přizpůsobení toho, co je řečeno, s pohyby rukou a paží postavy. Proto dabingový překladatel často napíše „chytlavou“ repliku, která zachová význam, ale se zcela jinými slovy; Slovní věrnost je zde ještě menší než titulky.
Umělá inteligence může poskytnout nezpracovaný návrh překladu a časové varování pro dabing („tento řádek je o 40 % delší než originál, zkraťte ho“). Nové technologie mohou dokonce klonovat zvuk a produkovat automatický dabing; ale herectví, emoce, doladění dýchání postavy a synchronizace rtů jsou stále úkolem lidského překladatele a hlasového herce. Automatický dabing poskytuje obrys; Umělecké a synchronní rozhodnutí je na lidech. Kromě toho je souhlas osoby, jejíž hlas je klonován, důležitým etickým a právním problémem.
V souhrnu
Audiovizuální překlad je uměním přizpůsobit text omezením divákova oka a ucha: hranice linie/postavy/CPS v titulcích, synchronizace rtů v dabingu, vizuální kontext je ve všech určujícím faktorem. AI urychluje přepis, časové kódování, navrhování překladu a kontrolu CPS pomocí ASR; Ale ASR se mýlí ve správných jménech a šumu, nevidí obraz a rozhodnutí o vhodném tónu dělá člověk. Hlavní titulkovač nepřekládá slovo od slova; najde nejkratší, nejpřirozenější výraz, který zachová význam.
Aplikační úkol
Vyberte si krátký (2-3 minuty) videoklip. Přepisujte pomocí nástroje ASR a porovnejte a opravte rizikové oblasti se zvukem pomocí šablony „ověření přepisu“. Poté přeložte s omezením CPS ~17 pomocí šablony "překlad titulků" a zkraťte titulky, které překračují limit, pomocí "ovládání CPS". Pokud je na obrazovce text nebo znak, použijte „kontrolu vizuálního kontextu“.
kontrolní seznam
- [ ] Ověřil jsem dešifrování ASR hlasem pro konkrétní jméno/číslo.
- [ ] Titulky jsem přizpůsobil pravidlům řádků/znaků/CPS.
- [ ] Zkrátil jsem a naturalizoval jsem to, ne slovo od slova, se zachováním významu.
- [ ] Vzal jsem v úvahu vizuální kontext (text na obrazovce, znak).
- [ ] Přeložil jsem to, abych zachoval rozdíly v tónu a charakteru.