Печалби:
- Възможност за пасване при запазване на смисъла чрез прилагане на техническите правила на субтитрите (ред, знак, CPS)
- Възможност за проверка на правилните имена и грешки в номера чрез глас, като същевременно ускорява транскрипцията и автоматичното времекодиране с ASR
- Възможност за управление на границите на изкуствения интелект, като се вземе предвид визуалният контекст, тоналната разлика и синхронизирането на устните при дублажа
Преводът на филм, телевизионен сериал, корпоративно видео или онлайн курс е коренно различен от превода на обикновен текст: времето, скоростта на четене, изображението на екрана, гласът и движението на устните на героите също са ограничения. В този модул ще научите аудиовизуален превод (субтитри, дублаж, глас зад кадър), техническите правила за субтитриране, транскрипция и времево кодиране, поддържано от AI, както и капаните на качеството в тази област. Целта е да работите като експерт по аудиовизуален превод, който „пасва на очите и ушите на публиката“, а не „да превежда текста“.
Основни понятия
Аудиовизуален превод (AVT) е превод на съдържание, съдържащо аудио и видео; Основните форми са субтитри, дублаж и аудио описание. Субтитрирането е отразяването на речта в писмен вид на екрана. Дублажът е презапис на оригиналния глас на целевия език. Глас зад кадър е, когато оригиналният звук е заглушен и върху него се чете превод (често срещано в документалните филми).
Два критични технически условия на субтитри: CPS (символи в секунда) ограничава скоростта на субтитри, така че зрителят да може да ги чете удобно; Общоприетата горна граница е около 17 знака в секунда (по-ниска за съдържание за деца). Времевият код е началният и крайният час, който показва кога субтитрите ще се появят и изчезнат на екрана (като 00:01:23,400).
Защо е трудно? Защото това означава вписване на превод в субтитри. Два реда, ~42 знака на ред, минимум ~1 секунда и максимум ~6 секунди екранно време и CPS лимит — трябва да спазвате всичко това, като запазвате смисъла и тона. Ето защо преводът на субтитри често е въпрос на компресиране и преформулиране, а не превод дума по дума.
Съвет: Избягвайте рефлекса "превеждане на всяка дума" в субтитрите. Зрителят едновременно гледа и чете изображението; Твърде дългите субтитри не могат да се четат. Намирането на най-краткия естествен израз, който запазва смисъла, е истинското майсторство на надписващия.
Ролята на AI в аудиовизуалния превод
AI значително ускорява няколко стъпки в тази област:
- Транскрипция: С ASR (автоматично разпознаване на реч) гласът се транскрибира автоматично. Това извлича необработения източник на субтитрите за минути.
- Автоматично времево кодиране: Инструментите разделят разговора на сегменти и създават чернови на времеви кодове.
- Чернова на превод: Текстът на преписа е преведен.
- CPS/контрол на дължината: AI може да маркира кой субтитър надвишава скоростта на четене и да предложи съкращаване.
Но внимавайте: ASR греши относно шум, акцент, припокриваща се реч, собствени имена и технически термини; не може да предостави "аудио описание"; Който говори може да се обърка. AI преводът не вижда изображението — той не може да знае кога даден обект, показан на екрана, се нарича „това“. Следователно човекът проверява визуалния контекст и точността на дешифрирането.
Внимание: Най-честата грешка е да мислите, че ASR изходът е "декодиран". ASR прави чести грешки, особено в собствени имена, числа, имена на марки и технически термини; неправилна транскрипция се пренася в превод и субтитри. Не забравяйте да проверите критичните зони, като слушате аудиото.
Правила за форматиране на субтитрите
Общи правила (варират според платформата):
- ~37-42 знака на ред, максимум 2 реда.
- Продължителност: ~1-6 секунди; Избягвайте много къси "флаш" субтитри.
- CPS да не надвишава ~17 (съдържание за възрастни).
- Разделете изречението там, където има смисъл (не оставяйте „и“ или „но“ в края на реда).
- Ако е възможно, не пропускайте изрязването на сцената (смяна на кадър).
- Следвайте правилата на платформата за елементи като псувни, песни, екранно писане.
три мини калъфа
Случай 1 — ASR + пост-редактиране, ускорено с 60%. Екип първо транскрибира и кодира във времето 45-минутен документален филм с ASR, след което го превежда и редактира след това. Времето е намалено с 60% в сравнение с транскрибиране + времево кодиране от нулата. Но всички собствени имена и числа бяха коригирани чрез звуково сравнение.
Случай 2 — CPS проверка на запазената четливост. Първият превод на видео с инструкции със субтитри беше точен, но CPS беше средно 24 — публиката не можа да се справи. Рунд от съкращаване, задвижван от AI, съкрати субтитрите с 30%, намалявайки CPS до 16; значението беше запазено, четивността дойде.
Случай 3 — Грешка във визуалния контекст. В превода, базиран на ASR, герой посочи знак на екрана и каза „прочетете това“; AI го преведе като „прочетете го“, но текстът на знака не беше преведен, така че зрителят не можеше да види какво да прочете. Авторът на надписи добави отделен надпис за надписа на екрана; Човекът, който е видял изображението, прави разликата.
Четири копируеми шаблона
1) Списък за проверка на транскрипция (ASR):
По-долу е автоматична транскрипция на видеоклип. Маркирайте възможните грешки в транскрипцията: собствени имена, имена на марки, числа, технически термини, двусмислени/непълни изречения. Избройте ги като „проверка чрез глас“. Не превеждай. Транскрибиране: [...]
2) Превод на субтитри (CPS/ограничена дължина):
Преведете следната транскрипция на [целеви език] субтитри. ОГРАНИЧЕНИЕ: всеки субтитър трябва да бъде максимум 2 реда, ред ~42 знака, CPS да не надвишава ~17. СЪКРАТЯВАНЕ и натурализиране при запазване на смисъла; не превеждайте дума по дума. Запазете времеви кодове. Транскрипция + времеви кодове: [...]
3) CPS/проверка за четливост:
Изчислете приблизителния CPS въз основа на продължителността и броя знаци за всеки от следните субтитри. Маркирайте всички, които надвишават 17, и предложете по-кратка алтернатива, която запазва значението. Субтитри (текст | продължителност секунди): [...]
4) Проверка на екранен текст / визуален контекст:
В следващия диалог маркирайте местата, които може да се отнасят за изображението (текст на екрана, заострен предмет, знак). Кажете дали са необходими допълнителни субтитри/обяснения за тях, ако се приеме, че зрителят не може да види изображението. Диалог: [...]
Слаба подкана / Силна подкана
Слаб: „Преведете тези субтитри.“ (Няма дължина, CPS, редови правила; изходът няма да се побере на екрана, не се чете.)
Güçlü: „Преведете този препис на диалог на турски субтитри. Всеки субтитър трябва да бъде максимум 2 реда, 42 знака на ред; съкратете го, като запазите смисъла, когато е необходимо за скоростта на четене. Дайте говоримия език на естествен турски, омекотете жаргона. Не докосвайте времевите кодове.“
Разлика: силната подкана дава техническите ограничения на субтитрите (ред, знак, CPS, тон); изходът всъщност се доближава до използваемите субтитри.
Таблица за сравнение на AVT формати
формат
Какво прави
Принос на AI
човешка критична точка
подзаглавие
Транскрибира речта
ASR, превод, CPS
Подходящ, визуален контекст
дублаж
Озвучаване на целевия език
Чернова на превод
синхронизиране на устните, актьорско майсторство
глас зад кадър
Прочетете превода по-горе
Превод, тайминг
Естествен поток, тон
Аудио описание
Описва изображението със звук
чернова на текст
Визуална интерпретация (човек)
Често срещани грешки
- Превод на ASR преписа без проверка. Грешките в правилното име/номер се пренасят в подзаглавието.
- Превеждане дума по дума и заобикаляне на CPS. Публиката не може да чете; годни трябва да се направи.
- Пренебрегване на визуалния контекст. Текстът на екрана и заострените обекти остават непреведени.
- Обезсмисляне на разделянето на редове. Разваля четливостта.
- Изравняване на тона/регистъра. Диалектите и жаргонът на героите изчезват.
Дублаж и синхронизиране на устни
Докато ограничението на субтитрите е скоростта на четене, ограничението на дублажа е времето и устните. Има три различни типа синхронизация при превод на глас зад кадър: синхронизиране на устните — където преводът съответства на движението на устата на героя, особено отворените гласни в близки планове; изохрония — редът на превода е със същата дължина като оригиналния ред, нито твърде къс, нито твърде дълъг; синхрон на жестове — съпоставяне на казаното с движенията на ръцете и ръцете на героя. Ето защо преводачът на дублажа често пише "закачлив" ред, който запазва смисъла, но със съвсем други думи; Тук верността на думите е дори по-малка от тази на субтитрите.
AI може да предостави необработена чернова на превод и предупреждение за време за дублаж („този ред е 40% по-дълъг от оригинала, съкратете го“). Новите технологии могат дори да клонират звук и да произвеждат автоматично презаписване; но актьорската игра, емоцията, фината настройка на дишането на героя и синхронизирането на устните все още са работа на човешкия преводач и гласов актьор. Автоматичното презаписване осигурява контур; Художественото и синхронично решение е човешко. Освен това съгласието на лицето, чийто глас е клониран, е важен етичен и правен въпрос.
В обобщение
Аудиовизуалният превод е изкуството да се вписва текст в рамките на ограниченията на окото и ухото на зрителя: границите на линия/знак/CPS при субтитри, синхронизиране на устни при дублаж, визуалният контекст е определящият фактор във всички тях. AI ускорява транскрипцията, времекодирането, изготвянето на превод и проверката на CPS с ASR; Но ASR греши в правилните имена и шума, не може да види изображението и решенията за подходящ тон се вземат от човека. Главният субтитър не превежда дума по дума; намира най-краткия, най-естествен израз, който запазва смисъла.
Задача за приложение
Изберете кратък (2-3 минути) видеоклип. Транскрибирайте с ASR инструмент и сравнявайте и коригирайте рисковите области с аудиото с шаблон за „проверка на транскрипция“. След това преведете с ограничението CPS ~17 с шаблона „превод на субтитри“ и съкратете субтитрите, които надхвърлят ограничението, с „CPS контрола“. Ако има екранен текст или знак, приложете „визуална проверка на контекста“.
контролен списък
- [ ] Проверих ASR дешифрирането чрез глас за конкретното име/номер.
- [ ] Направих субтитрите да отговарят на правилата за ред/символ/CPS.
- [ ] Съкратих го и го натурализирах, не дума по дума, запазвайки смисъла.
- [ ] Взех предвид визуалния контекст (текст на екрана, знак).
- [ ] Преведох го, за да запазя разликите в тона и характера.