Winst:
- Mogelijkheid om te passen met behoud van de betekenis door de technische regels van de ondertitel toe te passen (regel, karakter, CPS)
- Mogelijkheid om eigennaam- en nummerfouten met uw stem te verifiëren en tegelijkertijd de transcriptie en automatische tijdcodering te versnellen met ASR
- Vermogen om de grenzen van kunstmatige intelligentie te beheersen door rekening te houden met de visuele context, toonverschillen en lipsynchronisatie bij het nasynchroniseren
Het vertalen van een film, tv-serie, bedrijfsvideo of online cursus is radicaal anders dan het vertalen van platte tekst: ook tijd, leessnelheid, beeld op het scherm, stem en de lipbeweging van de personages zijn beperkingen. In dit onderdeel leer je audiovisuele vertaling (ondertiteling, nasynchronisatie, voice-over), de technische regels voor ondertiteling, AI-ondersteunde transcriptie en tijdcodering, en de kwaliteitsvalkuilen van dit vakgebied. Het doel is om te werken als een audiovisuele vertaalexpert die "in de ogen en oren van het publiek past" in plaats van "de tekst te vertalen".
Basisconcepten
Audiovisuele vertaling (AVT) is de vertaling van inhoud die audio en video bevat; De belangrijkste vormen zijn ondertiteling, nasynchronisatie en audiodescriptie. Ondertiteling is de weerspiegeling van de toespraak in geschreven vorm op het scherm. Nasynchronisatie is het opnieuw nasynchroniseren van de originele stem in de doeltaal. Bij voice-over wordt het originele geluid gedempt en wordt er een vertaling overheen voorgelezen (gebruikelijk in documentaires).
Twee cruciale technische termen bij ondertiteling: CPS (Characters Per Second) beperkt de snelheid van ondertiteling zodat de kijker deze comfortabel kan lezen; De algemeen aanvaarde bovengrens ligt rond de 17 tekens per seconde (lager voor inhoud voor kinderen). Tijdcode is de start-eindtijd die aangeeft wanneer de ondertiteling op het scherm verschijnt en verdwijnt (zoals 00:01:23.400).
Waarom is het moeilijk? Omdat het betekent dat de vertaling in ondertitels past. Twee regels, ~42 tekens per regel, minimaal ~1 seconde en maximaal ~6 seconden schermtijd, en de CPS-limiet: je moet aan al deze regels voldoen met behoud van de betekenis en toon. Daarom is het vertalen van ondertitels vaak een kwestie van compressie en herformulering, en niet van woord-voor-woordvertaling.
Tip: vermijd de reflex van ‘elk woord vertalen’ in ondertitels. De kijker kijkt én leest het beeld; Te lange ondertitels kunnen niet worden gelezen. Het vinden van de kortste natuurlijke uitdrukking die de betekenis behoudt, is het ware meesterschap van de ondertitelaar.
De rol van AI in audiovisuele vertaling
AI versnelt verschillende stappen op dit gebied aanzienlijk:
- Transcriptie: Met ASR (Automatische Spraakherkenning) wordt de stem automatisch getranscribeerd. Hiermee wordt binnen enkele minuten de onbewerkte bron van de ondertitel opgehaald.
- Automatische tijdcodering: Tools verdelen het gesprek in segmenten en produceren concept-tijdcodes.
- Vertaalconcept: de transcriptietekst wordt vertaald.
- CPS/lengtecontrole: De AI kan markeren welke ondertitel de leessnelheid overschrijdt en verkorting voorstellen.
Maar let op: ASR maakt fouten op het gebied van ruis, accent, overlappende spraak, eigennamen en technische termen; kan geen "audiobeschrijving" bieden; Wie aan het woord is, kan in de war raken. De AI-vertaling ziet de afbeelding niet – hij kan niet weten wanneer een object dat op het scherm wordt weergegeven ‘dat’ heet. Daarom verifieert de mens de visuele context en de ontcijferingsnauwkeurigheid.
Let op: De meest voorkomende fout is te denken dat de ASR-uitvoer "gedecodeerd" is. ASR maakt regelmatig fouten, vooral in eigennamen, cijfers, merknamen en technische termen; een onjuiste transcriptie wordt overgedragen op vertaling en ondertiteling. Zorg ervoor dat u kritieke gebieden verifieert door naar de audio te luisteren.
Regels voor ondertitelformaat
Algemene regels (varieert per platform):
- ~37-42 tekens per regel, maximaal 2 regels.
- Duur: ~1-6 seconden; Vermijd zeer korte "flash"-ondertitels.
- CPS mag niet hoger zijn dan ~17 (inhoud voor volwassenen).
- Breek de zin af waar deze zinvol is (laat geen "en" of "maar" achter aan de regel).
- Sla indien mogelijk het scènefragment (shotwissel) niet over.
- Volg de platformregels voor items zoals vloeken, liedjes en schermschrijven.
drie minikoffers
Case 1 — ASR + nabewerking versneld met 60%. Een team heeft eerst een documentaire van 45 minuten getranscribeerd en in de tijd gecodeerd met ASR, en vervolgens vertaald en nabewerkt. Tijd verminderd met 60% vergeleken met transcriberen + tijdcoderen vanaf nul. Maar alle eigennamen en nummers werden gecorrigeerd door een goede vergelijking.
Geval 2 — CPS controleert de opgeslagen leesbaarheid. De eerste vertaling van een instructievideo met ondertiteling klopte, maar de CPS bedroeg gemiddeld 24 – het publiek kon het niet bijhouden. Een ronde van AI-aangedreven verkorting verkortte de ondertitels met 30%, waardoor de CPS werd teruggebracht tot 16; de betekenis bleef behouden, de leesbaarheid kwam.
Geval 3 — Visuele contextfout. In de op ASR gebaseerde vertaling wees een personage naar een bord op het scherm en zei "lees dat"; De AI vertaalde het als "lees het", maar de tekst op het bord werd niet vertaald, waardoor de kijker niet kon zien wat hij moest lezen. De ondertitelaar heeft een apart onderschrift voor het schermonderschrift toegevoegd; De persoon die het beeld zag, maakte het verschil.
Vier kopieerbare sjablonen
1) Verificatielijst transcriptie (ASR):
Hieronder vindt u een automatische transcriptie van een video. Markeer eventuele fouten in de transcriptie: eigennamen, merknamen, cijfers, technische termen, dubbelzinnige/onvolledige zinnen. Vermeld deze als 'verifiëren met stem'. Niet vertalen. Transcriberen: [...]
2) Vertaling van ondertitels (CPS/lengte beperkt):
Vertaal de volgende transcriptie naar ondertitels in [doeltaal]. BEPERKING: elke ondertitel mag maximaal 2 regels lang zijn, regel ~42 tekens, CPS mag niet groter zijn dan ~17. VERKORT en naturaliseer met behoud van de betekenis; niet woord voor woord vertalen. Tijdcodes bewaren. Transcriptie + tijdcodes: [...]
3) CPS/leesbaarheidscontrole:
Bereken de geschatte CPS op basis van de duur en het aantal tekens voor elk van de volgende ondertitels. Markeer alle opties die groter zijn dan 17 en stel een korter alternatief voor dat de betekenis behoudt. Ondertitels (tekst | duur seconden): [...]
4) Schermtekst / visuele contextcontrole:
Markeer in het volgende dialoogvenster de plaatsen die naar de afbeelding kunnen verwijzen (schermtekst, puntig voorwerp, teken). Geef aan of hiervoor extra ondertiteling/uitleg nodig is, ervan uitgaande dat de kijker het beeld niet kan zien. Dialoog: [...]
Zwakke prompt/sterke prompt
Zwak: "Vertaal deze ondertitels." (Geen lengte, CPS, lijnregels; uitvoer past niet op het scherm, onleesbaar.)
Güçlü: "Vertaal dit dialoogtranscript naar Turkse ondertitels. Elke ondertitel mag maximaal 2 regels zijn, 42 tekens per regel; verkort deze met behoud van de betekenis wanneer dat nodig is voor de leessnelheid. Geef de gesproken taal in natuurlijk Turks, verzacht het jargon. Raak de tijdcodes niet aan."
Verschil: sterke prompt geeft de technische beperkingen van de ondertitel weer (regel, karakter, CPS, toon); de uitvoer benadert feitelijk bruikbare ondertitels.
Vergelijkingstabel AVT-formaten
formaat
Wat doet
AI-bijdrage
menselijk kritisch punt
ondertitel
Transcribeert de toespraak
ASR, vertaling, CPS
Passende, visuele context
nasynchronisatie
Voice-over in de doeltaal
Vertaalontwerp
lipsynchronisatie, acteren
voice-over
Lees de vertaling hierboven
Vertaling, timing
Natuurlijke stroom, toon
Audiobeschrijving
Beschrijft het beeld met geluid
concepttekst
Visuele interpretatie (menselijk)
Veel voorkomende fouten
- Het ASR-transcript vertalen zonder het te verifiëren. Fouten met de juiste naam/nummer worden overgedragen naar de ondertitel.
- Woord voor woord vertalen en CPS omzeilen. Het publiek kan niet lezen; pasvorm moet gemaakt worden.
- Het negeren van visuele context. Schermtekst en puntige voorwerpen blijven onvertaald.
- Het splitsen van lijnen zinloos maken. Het bederft de leesbaarheid.
- Afvlakking van de toon/register. De dialecten en het jargon van de personages verdwijnen.
Dubben en lipsynchronisatie
Terwijl de beperking van ondertiteling de leessnelheid is, is de beperking van nasynchronisatie tijd en lippen. Er zijn drie verschillende soorten synchronisatie bij voice-oververtaling: lipsynchronisatie - waarbij de vertaling overeenkomt met de mondbeweging van het personage, vooral open klinkers in close-ups; isochronie — de vertaallijn heeft dezelfde lengte als de originele lijn, niet te kort en niet te lang; gebaarsynchronisatie - het afstemmen van wat er wordt gezegd op de hand- en armbewegingen van het personage. Dat is de reden waarom de nasynchronisatievertaler vaak een "pakkende" regel schrijft die de betekenis behoudt, maar met totaal andere woorden; Woordgetrouwheid is hier zelfs minder dan ondertiteling.
De AI kan een onbewerkt vertaalconcept en een tijdwaarschuwing voor het nasynchroniseren leveren ("deze regel is 40% langer dan het origineel, verkort deze"). Nieuwe technologieën kunnen zelfs geluid klonen en automatische nasynchronisatie produceren; maar acteren, emotie, het afstemmen van de ademhaling van het personage en lipsynchronisatie zijn nog steeds de taak van de menselijke vertaler en stemacteur. Automatische nasynchronisatie geeft een overzicht; De artistieke en synchrone beslissing is de menselijke beslissing. Bovendien is de toestemming van de persoon wiens stem wordt gekloond een belangrijke ethische en juridische kwestie.
Samengevat
Audiovisuele vertaling is de kunst van het passen van tekst binnen de beperkingen van het oog en oor van de kijker: lijn/karakter/CPS-grenzen bij ondertiteling, lipsynchronisatie bij nasynchronisatie, de visuele context is in al deze aspecten de bepalende factor. AI versnelt transcriptie, tijdcodering, het opstellen van vertalingen en CPS-controle met ASR; Maar ASR vergist zich in eigennamen en ruis, het kan het beeld niet zien en de beslissingen over de juiste toon worden door de mens genomen. De hoofdondertiteler vertaalt niet woord voor woord; vindt de kortste, meest natuurlijke uitdrukking die de betekenis behoudt.
Applicatie taak
Kies een korte videoclip (2-3 minuten). Transcribeer met een ASR-tool en vergelijk en corrigeer risicovolle gebieden met de audio met een sjabloon voor “transcriptieverificatie”. Vertaal vervolgens met de CPS ~17-beperking met de sjabloon "vertaling van ondertitels" en verkort de ondertitels die de limiet overschrijden met de "CPS-controle". Als er sprake is van een schermtekst of teken, pas dan een ‘visuele contextcontrole’ toe.
controlelijst
- [ ] Ik heb de ASR-decodering met stem geverifieerd voor de specifieke naam/nummer.
- [ ] Ik heb de ondertitels passend gemaakt binnen de regels voor regels/tekens/CPS.
- [ ] Ik heb het ingekort en genaturaliseerd, niet woord voor woord, waarbij de betekenis behouden bleef.
- [ ] Ik heb rekening gehouden met de visuele context (tekst op het scherm, teken).
- [ ] Ik heb het vertaald om de verschillen in toon en karakter te behouden.