одиниця 4 / 11

Транскрипція та субтитри: мовлення в текст і багатомовні субтитри

Прибуток:

  • Здатність розуміти концепції автоматичної транскрипції та поділу мовців і перетворювати необроблений запис у текст із часовим кодуванням
  • Здатність розуміти формати субтитрів (SRT/VTT), швидкість читання та правила ліній, а також створювати та редагувати проекти багатомовних субтитрів
  • Розуміння того, що редактор зобов’язаний перевірити термінологію, власні імена, пунктуаційні помилки та помилки перекладу в автоматичному тексті перед публікацією.

Найбільш виснажливим і трудомістким завданням постпродакшну традиційно була транскрипція: редактор нескінченно слухав записи інтерв’ю годинами, друкуючи кожне речення вручну. На транскрипцію одногодинного запису легко знадобилося б чотири-п’ять годин. Штучний інтелект кардинально змінив цей бізнес: сьогодні годинний запис можна перетворити на текст із часовим кодуванням за лічені хвилини. Це пришвидшує конвеєр редагування та забезпечує доступність (субтитри для глядачів із вадами слуху та беззвучний перегляд). Але автоматичний вихід ніколи не придатний для публікації в необробленому вигляді; У цьому підрозділі ми побачимо як силу, так і підводні камені.

Почнемо з термінів. Транскрипція – це запис мовлення. Автоматичне розпізнавання мовлення (ASR) — це технологія, яка перетворює голос у текст. Таймкод - це знак, який показує, якій секунді відповідає текст у відео. Діаризація мовця – це розрізнення того, хто говорив, і розподіл тексту на мовців. Підзаголовок (підзаголовок/заголовок) — це текст із часовим кодом, який з’являється на екрані. SRT і VTT є найпоширенішими форматами файлів субтитрів; Вони містять порядок, час початку та закінчення та текст кожного рядка. Швидкість читання (CPS: символів за секунду) визначає, скільки рядок має залишатися на екрані, щоб глядач міг зручно читати субтитри.

Потужність і обмеження автоматичної транскрипції

Транскрипція AI транскрибує чіткий голос одного динаміка, записаний правильною турецькою мовою з дуже високою точністю. Але він допускає помилки в наступних ситуаціях, і знання їх дає змогу проводити цільову перевірку: власні імена (імена людей, брендів, місць часто написані з помилками), технічні терміни та абревіатури, слова зі схожим звучанням («кар/кар», «все ще/ще»), накладання мови (двоє людей одночасно), фоновий шум і музика, відмінності діалекту/акценту та пунктуація (запитання чи кінець речення). Крім того, модель може «почути» і транскрибувати слово, яке ніколи не було сказано в галасливий момент — це галюцинація транскрипції.

У наведеній нижче таблиці підсумовано сильні та слабкі умови для автоматичної транскрипції:

стан

точність

Фокус редактора

Один динамік, чистий звук, тихе середовище

дуже високий

Власні назви, розділові знаки

Панель з кількома динаміками

середній

Розділення мовців, накладання мови

Шумно/запис на вулиці

низький-середній

Вигадане слово, стрибок

Технічний/жаргонний вміст

середній

Написання термінів і скорочень

акцентована мова

змінна

Помилки в словах, значення

Формат субтитрів і правила читабельності

Хороший субтитр – це не просто «правильний текст»; має бути читабельним. У міжнародній практиці існує кілька емпіричних правил: рядок субтитрів, як правило, має складатися не більше двох рядків; кожен рядок повинен мати розумну довжину (приблизно 37-42 символи); Субтитри повинні залишатися на екрані достатньо довго, щоб їх можна було прочитати (зазвичай 1-6 секунд); Швидкість читання не повинна бути занадто високою (більшість посібників вважають обмеженням ~15-17 символів/секунду). Інструменти штучного інтелекту автоматично розділяють субтитри, але ці розбиття іноді обрізають речення в невдалих місцях (рядок закінчується на «і», розрив, який розділяє зміст). Завдання редактора — зробити текст точним і плавним.

Ваша роль: помічник редактора субтитрів. Нижче наведена автоматична розшифровка. Завдання: 1) Розбити текст на блоки субтитрів відповідно до логіки SRT. 2) Кожен блок повинен складатися максимум з 2 рядків, кожен рядок не повинен перевищувати ~40 символів. 3) Розділити речення на значущі місця; Рядок, що закінчується на «і», «але», «те».4) Позначте власні іменники та терміни тегом [ПЕРЕВІРИТИ], щоб я міг перевірити їх вручну.5) Не змінюйте текст, просто розділіть і позначте.

Ідея «[CONTROL] tag» у цій підказці є цінною: якщо штучний інтелект позначає зони, де він невпевнений або ризикований (власне ім’я, термін), спрямовує погляд редактора на потрібні місця та запобігає сліпій довірі.

Багатомовні субтитри та переклад

Відкриття відео кількома мовами збільшує аудиторію. AI може взяти розшифровку, перекласти її на цільову мову та створити файл субтитрів. Це потужна можливість, але вона найбільш вразлива: машинний переклад може спотворювати ідіоми, культурні посилання, гумор і гру слів, терміни та контекст. Перекласти речення «Іде дощ, коти і собаки» слово в слово — катастрофа. Також є обмеження на простір у перекладі субтитрів: речення цільовою мовою може бути довшим і перевищувати швидкість читання. Ось чому для багатомовних субтитрів дуже важливо, щоб особа, яка знає цільову мову, перевіряла переклад — особливо для конфіденційного вмісту, такого як брендинг, юридичний чи здоров’я, неправильний переклад може мати серйозні наслідки.

Перекладіть наступні блоки турецьких субтитрів англійською мовою. Правила: - Передавайте фразеологізми та жарти не дослівно, але зберігаючи їх ЗМІС. - Залиште назву бренду та продукту без перекладу. - Нехай кожен блок підтримує свою швидкість читання; При необхідності скоротіть, але не спотворюйте зміст. - Укажіть культурне посилання або термін, у якому ви не впевнені, за допомогою [ПРИМІТКА ПЕРЕКЛАДАЧА].

три міні-чохла

Випадок 1 — Прискорювальна лінія. Команда документалістів витратила три тижні на розшифровку 12-годинного архіву інтерв’ю. З автоматичною транскрипцією необроблений текст виводився за день; Завдяки пошуку в тексті (слово за словом) команда знаходила потрібні моменти за лічені секунди. Потім вони ретельно відредагували та дали субтитри лише 40-хвилинному епізоду, який вони використали. Три тижні перетворилися на чотири дні; перевірка зосереджена на використаному розділі.

Випадок 2 — Вигадане слово. Новинний канал транслював гучне вуличне інтерв'ю з автоматичними субтитрами, без перевірки. Модель «почула» невимовлене слово у фоновому дзижчанні, а підпис приписав невимовлене слово співбесіднику. У соцмережах відреагували, виправлення опублікували. Урок: у шумних записах автоматичні субтитри необхідно порівнювати з оригінальним звуком.

Випадок 3 — катастрофа перекладу. Бренд опублікував англійські субтитри свого рекламного відео з машинним перекладом і без контролю. Коли турецька ідіома («тримати око») була перекладена слово в слово, вона здавалася безглуздим і навіть смішним для англійської аудиторії, і серйозність бренду постраждала. Правильний спосіб: перевірити переклад кимось, хто знає цільову мову.

Слабка підказка / Сильна підказка

Слабка підказка:

Зробіть субтитри для цього відео та перекладіть його англійською мовою.

Немає ні форматування, ні правил читабельності, ні позначок перевірки. Вихід буде грубим і ризикованим.

Потужна підказка:

Ваша роль: двомовний редактор субтитрів. Вхідні дані: транскрипція турецького таймкодування. Завдання: 1) Редагувати турецькі субтитри на 2 рядки / ~ 40 символів / правильні правила поділу. 2) Позначити власні назви та терміни за допомогою [CONTROL]. 3) Окремо створити англійський переклад; Передайте фразу дослівно, збережіть назву бренду.4) Позначайте блоки, які перевищують швидкість читання, [LONG].5) Не складайте слів; Напишіть неозначений звук [НЕПОКАЗАНИЙ].

Поширені помилки

  • Публікація автоматичних стенограм без контролю. Залишаються помилки у власних назвах, термінах, пунктуації та вигаданих словах.
  • Погане розбиття рядків. Рядки, що закінчуються на «і/але/кі», ускладнюють читання.
  • Перевищення швидкості читання. Занадто короткі довгі субтитри на екрані не читаються.
  • Машинний переклад не перевіряється. Якщо ідіома, жарт чи термін йдуть не так, бренд страждає.
  • Обхід розрізнення динаміків. Якщо на панелі виникає плутанина щодо того, «хто що сказав», підзаголовок введе в оману.
Порада: під час редагування стенограми дивіться відео на швидкості 1,25-1,5 і перевіряйте, чи воно синхронізовано з субтитрами. Таким чином ви швидко вловлюєте дрейф часового коду та вигадані/пропущені слова.
Застереження: у таких сферах, як охорона здоров’я, право, фінанси, одне неправильно транскрибоване слово (наприклад, доза, номер інгредієнта) може мати серйозні наслідки. У цьому вмісті кожне число та термін мають бути перевірені окремо.

Підсумовуючи

Автоматизована транскрипція та субтитри найбільше економлять час у постпродакшн і забезпечують доступність. AI скорочує години транскрипції до хвилин і дозволяє здійснювати пошук по тексту. Але результат непридатний для публікації в необробленому вигляді: власні назви, терміни, пунктуація, вигадані слова та неправильні розриви рядків повинні бути виправлені. Правила читабельності (довжина рядка, тривалість, швидкість читання) роблять текст плавним для глядача. У багатомовних субтитрах машинний переклад повинен бути перевірений особою, яка знає цільову мову. ШІ ллє і навіює; Точність, читабельність і значення є відповідальністю редактора.

Аплікаційне завдання

Зробіть короткий запис розмови (можливо, ваш власний голос, 2-3 хвилини) і автоматично розшифруйте його. Порівняйте вихідні дані з оригінальним аудіо та позначте власні іменники, терміни та пунктуаційні помилки; Знайдіть не менше п'яти помилок. Потім розділіть текст на блоки субтитрів відповідно до наведених вище правил, перекладіть їх однією мовою та виправте принаймні два ризиковані моменти (ідіоми/терміни) у перекладі. Повідомте про процес і будь-які виявлені помилки.

контрольний список

  • [ ] Чи я порівняв стенограму з оригінальним аудіо та чи виправив будь-які помилки власного іменника/терміна/пунктуації?
  • [ ] Чи перевірив я вигадані чи пропущені слова?
  • [ ] Чи відредагував я субтитри відповідно до правил довжини рядка, тривалості та швидкості читання?
  • [ ] Для багатомовних субтитрів, чи я ретельно перевіряв переклад у когось, хто знає цільову мову?
  • [ ] Чи перевіряв я окремо кожне число та термін у конфіденційному вмісті?