одиниця 1 / 11

Вступ до штучного інтелекту в перекладі: ролі, межі, автентифікація, конфіденційність та етика

Прибуток:

  • Можливість розрізнити, де штучний інтелект економить час у робочому процесі перекладу (чернетка, термін, резюме), а де такі рішення, як сенс, тон, культура та відповідальність, залишаються за людиною, залежно від рівня ризику.
  • Здатність застосовувати дисципліну, яка перевіряє кожен результат перекладу, порівнюючи його з джерелом, підтверджуючи термінологію та узгодженість, і пропускаючи його через фільтр значення, тону, культури.
  • Зрозумійте, чому конфіденційність, захист особистих даних і неперевірений результат повинні бути враховані при перекладі з самого початку.

Ви вранці за бюро перекладів. У вашій скриньці – терміновий переклад юридичного договору, 800 рядків тексту інтерфейсу програмного забезпечення, файл підготовки до дводенної конференції та редакція субтитрів телесеріалу. Клієнт запитує: "Чому це займає так багато часу, коли є штучний інтелект?" запитує він, і ви знаєте, що неправильно перекладене договірне положення може коштувати компенсації, а вигаданий термін може коштувати репутації бренду. Письмовий та усний переклад (загальна назва професій перекладача, який перекладає письмові тексти, та усного перекладача, який миттєво передає усне мовлення) — сфера багатомовна за своєю природою, залежна від контексту, культурна та дуже відповідальна. Штучний інтелект (ШІ — програмне забезпечення, яке може витягувати закономірності з історичних даних, створювати, перекладати та узагальнювати текст) дає вам серйозну швидкість у такому об’ємі та тиску часу. Але сам початок цього модуля зрозумілий: штучний інтелект є помічником, генератором чернеток перекладу та помічником з термінології/якості; Ви компетентний перекладач, який бере на себе відповідальність за зміст, тон, культуру та остаточний переклад.

У цьому першому розділі ми зосередимося на дисципліні, а не на інструменті. Ви дізнаєтесь, де штучний інтелект економить реальний час у робочому процесі перекладу, де це небезпечно, як перевірити кожен вихід, як захистити конфіденційний документ клієнта та як дотримуватися етики та авторського права. Без закладення цієї основи наступні одиниці залишаються в повітрі — тому що неперевірений вихід у перекладі — це не просто «погане речення»; Це може означати фальшиве зобов’язання в контракті, небезпечну помилку дозування в інструкції до препарату або висміювання марки.

Де штучний інтелект стане в нагоді в процесі перекладу?

Давайте розділимо роботу з перекладу на два великі кластери. Перший кластер: об’ємні, повторювані завдання, що витягуються за шаблоном, і мовні завдання. Перший чорновий переклад великого технічного посібника, послідовна передача повторюваних речень, виділення списку термінів, спрощення тексту для зручності читання, порівняння двох текстів двома мовами, перший чорновий варіант часових кодів субтитрів. У цих роботах ШІ скорочує години до хвилин і не втомлюється.

Другий кластер: сенс, тон, культура, креативність і відповідальні рішення. Що означає ідіома в цільовій культурі, емоційний вплив рекламного слогану, точний еквівалент юридичного терміну між двома правовими системами, голос літературного тексту, остаточне затвердження тексту, який буде передано клієнту. Ці рішення вимагають досвіду, культурних знань і людського судження. Тут штучний інтелект розповсюджує варіанти, створює чернетки, але останнє слово та підпис для доставки залишається за вами.

Давайте прояснимо різницю одним реченням: штучний інтелект сильний у питаннях «що таке перша чернетка цього тексту та його можливі аналоги»; За вами вирішувати, коли йдеться про запитання на зразок «Чи справді це має правильне значення, правильний тон і правильний культурний вплив? Чи можу я передати це своєму клієнту?»

Порада: перш ніж передати роботу штучному інтелекту, запитайте: «Що я втрачу, якщо результат буде неправильним?» Якщо відповідь «кілька хвилин рефакторингу», делегуйте комфортно. Якщо відповідь: «неправильне положення контракту, неправильна медична інформація або криза бренду», дозвольте штучному інтелекту підготувати проект, а ви прийміть рішення та перевірку.

Основні поняття: MT, NMT, LLM, MTPE

Давайте з самого початку визначимо чотири ключові терміни поля. MT (Machine Translation) — загальна назва програмного забезпечення, яке автоматично перекладає текст з однієї мови на іншу. NMT (Neural Machine Translation) — це сучасне покоління МП із використанням штучних нейронних мереж і є основою таких інструментів, як Google Translate і DeepL; Він вільний і швидкий на основі речень. LLM (Large Language Model) — це універсальні, керовані інструкціями, гнучкі моделі в контексті та тоні, такі як ChatGPT і Claude; Вони можуть зрозуміти такі вказівки, як «перекладіть цей текст офіційним тоном і цей список термінів». MTPE (післяредагування машинного перекладу) — це форма роботи, у якій людина-перекладач виправляє вихідні дані машинного перекладу, і це найпоширеніша робоча модель у галузі на сьогодні. Ми детально розглянемо ці терміни в наступних розділах; Наразі пам’ятайте про ланцюжок «ШІ створює необроблений проект, а людина робить його надійним».

Конфіденційність: непорушний принцип

Тексти, які потрапляють до рук перекладача, часто є конфіденційними: непідписаний договір, звіт пацієнта, фінансовий звіт компанії, судові матеріали, ще не анонсований продукт. Основне правило: жодні конфіденційні, особисті або неопубліковані клієнтські документи не вводяться в загальнодоступний інструмент штучного інтелекту, конфіденційність якого не гарантована. Текст, який ви вставляєте в публічну службу перекладу, обробляється на серверах цієї служби; Ви часто не можете контролювати, хто її бачить, де вона зберігається та чи використовується для навчання моделі. Багато контрактів на переклад включають угоду про нерозголошення (NDA), і передача конфіденційного тексту зовнішньому інструменту є порушенням цієї угоди та навіть тягне за собою юридичну відповідальність.

Таким чином, професійне використання штучного інтелекту відбувається у двох світах: загальні інструменти можна використовувати для текстів загального користування; Для конфіденційних/контрактних текстів використовуються лише захищені системи, які гарантують, що дані не витікають, і інституційні/контрактні гарантії «ми не використовуємо дані в освіті». Плутати два - найнебезпечніша помилка цієї професії.

Увага: «ШІ переклав це саме так» не є виправданням. Якщо є неправильний переклад, вигаданий термін або витік документа, відповідальність лежить не на штучному інтелекті, а на перекладачі, який надав цей результат, не перевіривши його, або ввів секретний текст в інструмент.

Перевірочна дисципліна: три кроки

ШІ забезпечує плавний і впевнений переклад; Це не означає, що це правда. ШІ час від часу створює галюцинації, тобто додає речення, якого немає в джерелі, змінює число, перетворює негативне на позитивне (замінюючи «є» замість «є») або створює термін, якого не існує. У договорі чи медичному тексті це згубно. Застосуйте триетапний рефлекс до кожного виходу:

  1. Порівняйте з джерелом. Прочитайте еквівалент кожного речення в джерелі. Зокрема, точно перевірте числа, дати, негативні суфікси, власні імена та валюти.
  2. Підтвердьте термінологію та послідовність. Чи відповідає він списку термінів організації/клієнта та попереднім перекладам? Чи однаково перекладається той самий термін у всьому тексті?
  3. Відфільтруйте його через значення, тон і культуру. Чи природне речення цільовою мовою? Чи правильний тон? Чи відповідає це культурі? Ваша експертна оцінка є остаточним фільтром.

три міні-чохла

Випадок 1 — MTPE заощадив час. Один перекладач переклав посібник користувача з 24 000 слів шляхом постредагування результатів NMT, а не з нуля. Робота, розрахована на 8 днів з нуля, скоротилася до 3,5 днів завдяки великій кількості повторів. Але кожне речення з попередженням безпеки було переглянуто одне за одним.

Випадок 2 — Перевірка виявила семантичну помилку. Експерт доручив штучному інтелекту перекласти пункт контракту. У той час як у джерелі говорилося, що "продавець НЕ несе відповідальності", у вихідних даних говориться, що "продавець НЕ несе відповідальності"; негативу стало менше. Порівняння з вихідним кроком запобігло небезпечній помилці, яка призвела б до скасування відповідальності.

Випадок 3 — Повернення після порушення конфіденційності. Новий перекладач для швидкості вставив медичний висновок пацієнта на загальнодоступний сайт перекладу. Його старший колега зрозумів: це особисті дані про стан здоров’я, і вони вийшли. Про інцидент повідомили як про порушення конфіденційності; робота була перероблена тільки на корпоративному безпечному автомобілі.

Чотири шаблони, які можна копіювати

1) Оцінка відповідності посаді:

Ваша роль: старший менеджер проекту перекладу. Я опишу роботу нижче. Скажіть мені (1) чи це робота за проектом/терміном, яку можна делегувати ШІ, чи важлива робота, яка вимагає сенсу, тону та підзвітності, (2) потенційна вартість неправильного результату, (3) перевірка, яку мені потрібно зробити до та після делегування. Робота: [вставте тут роботу]

2) Запит на переклад з дотриманням джерела:

Перекладіть наступний текст з [вихідної мови] на [цільової мови]. Правило: не додавайте та не видаляйте жодної інформації. Збережіть номер, дату, власне ім’я та заперечення дослівно. Позначте термін, щодо якого ви не впевнені, у [квадратних дужках]. Не складайте речення, якого немає в джерелі. Текст: [напишіть текст тут]

3) Попередня перевірка конфіденційності:

Оцініть наступний текст ПЕРЕД обробкою: чи може він містити особисті дані, конфіденційну ділову інформацію чи неопублікований вміст? Якщо так, то які частини? Попередити мене, якщо його не слід обробляти загальнодоступними засобами. Текст: [вставте текст тут]

4) Тон і культурний фільтр:

Оцініть наведений нижче переклад з точки зору природності, тону та культурної відповідності цільовою мовою. Позначте речення, які звучать як переклад, несуть тінь мови оригіналу (пахнуть перекладом), і запропонуйте більш природну альтернативу. Зміна сенсу. Переклад: [вставте текст тут]

Слабка підказка / Сильна підказка

Слабко: «Перекладіть це англійською». (Ні тону, ні аудиторії, ні термінів, ні контексту; машина виробляє переклад за замовчуванням із родзинкою.)

Сильно: «Перекладіть це маркетингове повідомлення з турецької на англійську. Аудиторія: корпоративні клієнти США. Тон: професійний, але теплий. Використовуйте такі терміни: «підписка» → «підписка», «пробна» → «пробна». Зберігайте числа та дати. Використовуйте природну англійську мову, яка не пахне перекладом».

Відмінність: сильна підказка визначає напрямок, аудиторію, тон, термін і обмеження; результат безпосередньо наближений до придатної для використання тяги.

Ролі та таблиця рівня ризику

тип бізнесу

Роль ШІ

Ризик

перевірка людиною

Проект технічної інструкції

Виробляє необроблений переклад

середній

Термін+перевірка номера

Договір/закон

Проект + термінова пропозиція

дуже високий

Речення за реченням, експертне затвердження

медичний текст

проект

дуже високий

Доза/негатив один до одного

Маркетинг / слоган

мультиплікатор ідеї

висока

Творче, культурне схвалення

Зведення внутрішнього листування

Анотація/проект

низький

Швидкий огляд

Поширені помилки

  • Надання необроблених машинних даних без перевірки. Найпоширеніша і найнебезпечніша помилка; «Це виглядає гладко» не означає, що це правда.
  • Вставлення конфіденційного документа в публічний інструмент. Порушення NDA та юридичний ризик.
  • Запит на переклад без надання контексту. Без маси, тону і терміну вихід завжди буде замовним і поверховим.
  • Число, дата і негатив не перевіряються. Саме тут ховаються найпідступніші помилки MT.
  • Жертвування якістю лише тому, що «ШІ швидкий». Швидкість не замінить перевірку.

Підсумовуючи

ШІ є потужним помічником, який значно прискорює виконання об’ємних, повторюваних і мовних завдань під час перекладу та усного перекладу; але відповідальність за значення, тон, культуру та доставку лежить на компетентному перекладачі. З самого початку запам’ятовуйте три речі: перевіряйте кожен вивід на відповідність джерелу, ніколи не передайте секретний текст незахищеному інструменту та позиціонуйте ШІ як генератор чернеток, а не особу, яка приймає рішення. Наступні підрозділи будуть базуватися на цій дисципліні.

Аплікаційне завдання

Виберіть наявний у вас текст (або зразок) і виконайте такі три дії: (1) Визначте рівень ризику за допомогою шаблону придатності для бізнесу. (2) Виконайте попередню перевірку конфіденційності та вирішіть, з яким інструментом ви будете працювати. (3) Отримайте чернетку з шаблоном точного перекладу, а потім вручну виконайте триетапну перевірку (джерело-термін-тон) і занотуйте будь-які знайдені помилки.

контрольний список

  • [ ] Я визначив рівень ризику роботи (низький/середній/високий).
  • [ ] Я перевірив, чи текст приховано, і вибрав правильний інструмент.
  • [ ] Я надав перекладу масу, тональність і термінологічний контекст.
  • [ ] Я порівняв число, дату, власну назву та заперечення з джерелом.
  • [ ] Я залишив відповідальність за остаточну доставку собі, а не ШІ.