Прибуток:
- Можливість підгонки зі збереженням сенсу шляхом застосування технічних правил субтитрів (рядок, символ, CPS)
- Можливість перевіряти власне ім’я та помилки в номері за допомогою голосу, одночасно прискорюючи транскрипцію та автоматичне кодування часу за допомогою ASR
- Можливість керувати межами штучного інтелекту, беручи до уваги візуальний контекст, різницю тонів і синхронізацію губ під час дубляжу
Переклад фільму, серіалу, корпоративного відео або онлайн-курсу кардинально відрізняється від перекладу звичайного тексту: час, швидкість читання, зображення на екрані, голос і рухи губ героїв також є обмеженнями. У цьому розділі ви дізнаєтесь про аудіовізуальний переклад (субтитри, дубляж, голос за кадром), технічні правила субтитрів, транскрипцію та часове кодування, що підтримуються штучним інтелектом, а також підводні камені якості в цій галузі. Мета полягає в тому, щоб працювати як експерт з аудіовізуального перекладу, який «відповідає очам і вухам аудиторії», а не «перекладає текст».
Основні поняття
Аудіовізуальний переклад (AVT) – це переклад вмісту, що містить аудіо та відео; Основними формами є субтитрування, дубляж і звуковий опис. Субтитрування - це відображення мови в письмовій формі на екрані. Дубляж — це повторний дубляж оригінального голосу цільовою мовою. Закадровий звук — це коли оригінальний звук приглушено, а переклад читається поверх нього (поширене в документальних фільмах).
Два найважливіших технічних терміна субтитрів: CPS (Characters Per Second) обмежує швидкість субтитрів, щоб глядач міг їх зручно читати; Загальноприйнятою верхньою межею є близько 17 символів на секунду (нижча для дитячого вмісту). Часовий код — це час початку та закінчення, який вказує, коли субтитри з’являться та зникнуть на екрані (наприклад, 00:01:23 400).
Чому важко? Бо це означає вписати переклад у субтитри. Два рядки, ~42 символи в рядку, мінімум ~1 секунда та максимум ~6 секунд екранного часу та обмеження CPS — вам потрібно дотримуватися всього цього, зберігаючи сенс і тон. Ось чому переклад субтитрів часто є питанням стиснення та перефразування, а не дослівного перекладу.
Порада: уникайте рефлексу «перекладати кожне слово» в субтитрах. Глядач і дивиться, і читає зображення; Занадто довгі субтитри не читаються. Пошук найкоротшого природного виразу, який зберігає значення, є справжньою майстерністю автора титрів.
Роль ШІ в аудіовізуальному перекладі
AI значно прискорює декілька кроків у цій сфері:
- Транскрипція: за допомогою ASR (автоматичного розпізнавання мовлення) голос автоматично транскрибується. Це за лічені хвилини витягне необроблений вихідний код субтитрів.
- Автоматичне кодування часу: Інструменти розділяють розмову на сегменти та створюють проекти часових кодів.
- Чернетка перекладу: текст стенограми перекладається.
- CPS/контроль довжини: штучний інтелект може позначити, які субтитри перевищують швидкість читання, і запропонувати скоротити.
Але будьте обережні: ASR помиляється на шум, акцент, накладання мови, власні імена та технічні терміни; не може надати «аудіоопис»; Хто говорить, може заплутатися. ШІ-переклад не бачить зображення — він не може знати, коли об’єкт, показаний на екрані, називається «це». Таким чином, людина перевіряє візуальний контекст і точність розшифровки.
Застереження: найпоширенішою помилкою є думка, що вихід ASR «декодований». ASR часто допускає помилки, особливо у власних назвах, цифрах, назвах брендів і технічних термінах; неправильна транскрипція переноситься на переклад і субтитри. Обов’язково перевірте критичні місця, прослухавши аудіо.
Правила оформлення субтитрів
Загальні правила (залежить від платформи):
- ~37-42 символи в рядку, максимум 2 рядки.
- Тривалість: ~1-6 секунд; Уникайте дуже коротких «флеш» субтитрів.
- CPS не має перевищувати ~17 (вміст для дорослих).
- Розділіть речення там, де це має сенс (не залишайте «і» або «але» в кінці рядка).
- Якщо можливо, не пропускайте фрагмент сцени (зміна кадру).
- Дотримуйтесь правил платформи щодо таких предметів, як лайка, пісні, екранізація.
три міні-чохла
Випадок 1 — ASR + post-edit прискорено на 60%. Команда спочатку транскрибувала та закодувала 45-хвилинний документальний фільм за допомогою ASR, а потім переклала та відредагувала його. Час скорочено на 60% порівняно з транскрибуванням + кодуванням часу з нуля. Але всі власні назви та числа були виправлені звуковим порівнянням.
Випадок 2 — CPS перевірити збережену читабельність. Перший переклад навчального відео з субтитрами був точним, але CPS у середньому склав 24 — аудиторія не встигала. Раунд скорочення за допомогою AI скоротив субтитри на 30%, зменшивши CPS до 16; зміст зберігся, прийшла читабельність.
Випадок 3 — помилка візуального контексту. У перекладі на основі ASR символ вказав на знак на екрані та сказав «прочитай це»; ШІ переклав це як «прочитай», але текст на табличці не був перекладений, тому глядач не міг побачити, що читати. Автор субтитрів додав окремий підпис для підпису на екрані; Людина, яка бачила зображення, компенсувала різницю.
Чотири шаблони, які можна копіювати
1) Список перевірки транскрипції (ASR):
Нижче наведено автоматичну транскрипцію відео. Позначте можливі помилки в транскрипції: власні імена, фірмові назви, цифри, технічні терміни, двозначні/неповні речення. Перелічіть їх як «підтвердити голосом». Не перекладай. Транскрибувати: [...]
2) Переклад субтитрів (CPS/довжина обмежена):
Перекладіть наступну транскрипцію субтитрами [мовою перекладу]. ОБМЕЖЕННЯ: кожен субтитр має містити максимум 2 рядки, рядок ~42 символи, CPS не повинен перевищувати ~17. СКОРОТИТИ та натуралізувати, зберігаючи значення; не перекладайте слово в слово. Зберігайте часові коди. Транскрипція + часові коди: [...]
3) CPS/перевірка читабельності:
Обчисліть приблизну CPS на основі тривалості та кількості символів для кожного з наступних субтитрів. Позначте будь-які, які перевищують 17, і запропонуйте коротшу альтернативу, яка зберігає значення. Субтитри (текст | тривалість секунд): [...]
4) Перевірка екранного тексту/візуального контексту:
У наступному діалозі позначте місця, які можуть стосуватися зображення (екранний текст, гострий предмет, знак). Скажіть, чи потрібні для них додаткові субтитри/пояснення, припускаючи, що глядач не бачить зображення. Діалог: [...]
Слабка підказка / Сильна підказка
Слабко: «Перекласти ці субтитри». (Немає довжини, CPS, правил ліній; виведені дані не поміщаються на екрані, нечитабельні.)
Гючлю: «Перекладіть цей стенограму діалогу на турецькі субтитри. Кожен субтитр має складатися максимум з 2 рядків, по 42 символи в рядку; скоротіть його, зберігаючи значення, коли це необхідно для швидкості читання. Передайте розмовну мову природною турецькою, пом’якшіть сленг. Не торкайтеся часових кодів».
Відмінність: сильна підказка дає технічні обмеження субтитрів (рядок, символ, CPS, тон); результат фактично наближається до придатних для використання субтитрів.
Таблиця порівняння форматів AVT
формат
Що робить
внесок ШІ
критична точка людини
підзаголовок
Переписує виступ
ASR, переклад, CPS
Підходить, візуальний контекст
дубляж
Озвучка цільовою мовою
Чернетка перекладу
lip sync, актор
голос за кадром
Прочитайте переклад вище
Переклад, хронометраж
Природний потік, тон
Аудіо опис
Описує зображення звуком
проект тексту
Візуальна інтерпретація (людина)
Поширені помилки
- Переклад стенограми ASR без її перевірки. Помилки у власній назві/номері переносяться на підзаголовок.
- Перекладаючи слово за словом і орієнтуючись на CPS. Аудиторія не може читати; підгонка повинна бути зроблена.
- Ігнорування візуального контексту. Текст на екрані та гострі об’єкти залишаються неперекладеними.
- Зробити поділ рядків безглуздим. Це псує читабельність.
- Вирівнювання тону/реєстру. Зникають діалекти та сленг героїв.
Дубляж і синхронізація губ
У той час як обмеженням субтитрів є швидкість читання, обмеженням дубляжу є час і губи. У перекладі закадрового голосу існує три різні типи синхронізації: синхронізація губ — коли переклад збігається з рухом рота персонажа, особливо відкритих голосних на великих планах; ізохронія — рядок перекладу має таку ж довжину, що й оригінальний рядок, не надто короткий і не надто довгий; синхронність жестів — узгодження сказаного з рухами рук і рук персонажа. Тому перекладач дубляжу часто пише «чіпкий» рядок, який зберігає зміст, але зовсім іншими словами; Точність слів тут навіть менша, ніж субтитри.
AI може надати необроблений чернетку перекладу та попередження про час дубляжу («цей рядок на 40% довший за оригінал, скоротіть його»). Нові технології можуть навіть клонувати звук і створювати автоматичний дубляж; але акторська гра, емоції, тонке налаштування дихання персонажа та синхронізація губ все ще є роботою людини-перекладача та актора голосу. Автоматичний дубляж забезпечує контур; Художньо-синхронне рішення – людське. Крім того, згода особи, чий голос клоновано, є важливим етичним і юридичним питанням.
Підсумовуючи
Аудіовізуальний переклад — це мистецтво адаптації тексту до обмежень ока та слуху глядача: межі рядків/символів/CPS у субтитрах, синхронізація губ у дубляжі, візуальний контекст є визначальним фактором у всіх них. AI прискорює транскрипцію, часове кодування, чорновий переклад і перевірку CPS за допомогою ASR; Але ASR помиляється у власних іменах і шумах, він не бачить зображення, а рішення про відповідність тону приймає людина. Головний субтитр не перекладає слово в слово; знаходить найкоротший, найприродніший вираз, який зберігає зміст.
Аплікаційне завдання
Виберіть короткий (2-3 хвилини) відеоролик. Транскрибуйте за допомогою інструмента ASR і порівнюйте та виправляйте ризиковані області з аудіо за допомогою шаблону «підтвердження транскрипції». Потім перекладіть з обмеженням CPS ~17 за допомогою шаблону «переклад субтитрів» і скоротіть субтитри, які перевищують обмеження, за допомогою «контролю CPS». Якщо є екранний текст або знак, застосуйте «візуальну перевірку контексту».
контрольний список
- [ ] Я перевірив дешифрування ASR голосом для певного імені/номера.
- [ ] Я зробив так, щоб субтитри відповідали правилам рядків/символів/CPS.
- [ ] Я скоротив і натуралізував його, не слово в слово, зберігши значення.
- [ ] Я взяв до уваги візуальний контекст (текст на екрані, знак).
- [ ] Я переклав його, щоб зберегти відмінності в тональності та характері.