Единицы
1. Введение в искусственный интеллект в письменном и устном переводе: роли, границы, аутентификация, конфиденциальность и этика 2. Основы машинного перевода: NMT, LLM, выбор механизма и предварительная оценка 3. Постредактирование машинного перевода (MTPE): упрощенное и полное постредактирование 4. Управление терминологией и терминологической базой: согласованность и корпоративный язык 5. Интеграция искусственного интеллекта с CAT-инструментами и памятью переводов (TM) 6. Локализация (L10n): программное обеспечение, Интернет, игры и культурная адаптация 7. Субтитры, дубляж и аудиовизуальный перевод 8. Контроль качества (QA), метрики оценки и LQA 9. Подготовка к устному переводу: последовательный и синхронный перевод 10. Контекст, культура, тон и творческий перевод (транскреация) 11. Конфиденциальность, этика, авторское право, подлинность и будущее профессии
Единица 11 / 11

Конфиденциальность, этика, авторское право, подлинность и будущее профессии

Прибыль:

  • Умение применять принципы конфиденциальности, NDA, персональных данных (KVKK/GDPR) и выбирать правильный инструмент для переводческой работы.
  • Способность обеспечить прозрачность, подотчетность, ответственность за авторские права и оригинальность, а также рефлекс проверки источника при использовании машины.
  • Понимание того, почему необходима человеческая проверка и трансформация профессии в эпоху искусственного интеллекта

Мы завершаем этот модуль не техническими навыками, а принципами, защищающими целостность профессии. ИИ дает переводчику огромные возможности; Но эти полномочия также налагают новые и серьезные обязанности в отношении конфиденциальности, этики, авторских прав и оригинальности. Один неправильно переданный конфиденциальный документ, одно скрытое использование компьютера, одно нарушение авторских прав или одна мошенническая претензия о «человеческом переводе» могут разрушить не только один бизнес, но и карьеру и доверие клиентов. В этом модуле вы узнаете о конфиденциальности, профессиональной этике, вопросах авторского права и данных, о том, почему необходима человеческая проверка, а также о будущем профессии в эпоху искусственного интеллекта.

Конфиденциальность и данные: непреложные принципы

Большинство документов, попадающих в руки переводчика, являются конфиденциальными, а конфиденциальность является фундаментальным обязательством профессии. Четыре правила в эпоху искусственного интеллекта:

  1. Ввод конфиденциального/личного/неопубликованного текста в общедоступный инструмент, политика данных которого не обеспечивает гарантий. Введенный вами текст обрабатывается на внешнем сервере; Его можно использовать и хранить при обучении модели.
  2. Соблюдайте NDA (соглашение о неразглашении). Многие вакансии подразумевают NDA; Передача текста стороннему инструменту является прямым нарушением и влечет за собой юридическую ответственность.
  3. Выберите правильный инструмент. Корпоративные инструменты по контракту, которые не просто «хранят/обучают данные» для конфиденциальной работы; общие инструменты для общественных работ.
  4. Защищайте личные данные (область действия KVKK/GDPR) конфиденциально. Тексты, содержащие информацию об имени, состоянии здоровья, финансовом положении и личности, требуют дополнительной осторожности; Требуется анонимизация или безопасная среда.

KVKK (Закон о защите персональных данных — Турция) и GDPR (Европейский регламент защиты данных) определяют законом, как будут обрабатываться персональные данные; нарушение является не только этической, но и юридической проблемой.

Внимание: «Просто быстрый перевод, никто его не увидит» — наиболее распространенное оправдание нарушения конфиденциальности. Однажды утерянную информацию невозможно вернуть обратно. В случае сомнений не экспортируйте текст во внешний инструмент; выберите безопасный путь.

Этика и прозрачность: не скрывать использование машин

Новой осью профессиональной этики в эпоху искусственного интеллекта является прозрачность. Заказчик имеет право знать, как выполняется его работа. Два правила честности:

  • Сокрытие использования машины. Если вы выполнили работу с МТПЭ и клиент ожидал «чистого человеческого перевода», скрывать это неэтично. Цены и ожидания должны формироваться соответствующим образом.
  • Честно заявите о своих пределах. Рискованно браться за работу за пределами вашей области знаний (например, в области передового права или медицины), думая, что вы сможете «справиться с этим» с помощью ИИ; ИИ не закрывает ваш пробел в знаниях.

А еще ответственность: переводчик несет ответственность за каждый переданный текст. «ИИ так перевел» — это не оправдание; Вы несете ответственность перед клиентом.

Авторское право, данные и оригинальность

Три отдельные, но связанные темы:

  • Авторское право: текст, подлежащий переводу, может иметь авторские права; Перевод также является производной работой. Перевод и публикация произведения без разрешения является нарушением. «Переписывание» текста ИИ не устраняет проблемы с авторскими правами.
  • Данные для обучения и согласие: инструменты ИИ обучаются на общедоступных текстах, а иногда и на текстах, защищенных авторским правом; Это спорный этический вопрос в отрасли. Ваш вклад: не «дарите» данные вашего клиента для обучения модели без разрешения.
  • Оригинальность и галлюцинации. Особенно в человеческих/литературных текстах ИИ может создавать вымышленные цитаты, фальшивые источники, несуществующие идиомы. Каждое культурное/фактическое утверждение отправленного вами текста должно быть проверено и достоверно.
Совет: Настройте себе рефлекс «проверки источника»: когда ИИ называет имя, дату, цитату, источник или «известный факт», не вставляйте это в текст, не проверив самостоятельно. Сфабрикованная ссылка по гуманитарным наукам подрывает доверие ко всей работе.

Человеческая проверка: незаменимое последнее звено

Общий урок каждого раздела этого модуля: ИИ ускоряется, люди проверяют и несут ответственность. Верификация — это не «лишний шаг», а неотъемлемая часть работы. В текстах высокого риска (юридических, медицинских, охранных, брендовых) проверка важнее самого перевода. Результаты ИИ, предоставляемые без проверки человеком, быстры, но уязвимы.

Будущее профессии: трансформация, а не вытеснение

ИИ не делает переводчиков безработными; Это меняет характер работы. По мере того, как рутинные, простые, повторяющиеся задачи перевода переходят к машине, ценность переводчика смещается к уровням, которые машина не может выполнить, таким как опыт постредактирования, оценка качества, культурная глубина, знание экспертной области, транскреация и проверка. Переводчик будущего; Он человек, который умело использует ИИ, но знает, чему не следует доверять, и имеет значение благодаря своему опыту в этой области и культурным суждениям. Те, кто отвергает ИИ, и те, кто слепо подчиняется ему, останутся позади; На первом месте стоит тот, кто приручит его как инструмент.

три мини-кейса

Случай 1. Прозрачность укрепляет доверие. Переводчик заранее объяснил заказчику, что он будет выполнять работу из МТПЭ, какие детали будут трудоемкими, и цена соответственно. Клиент остался доволен прозрачностью и обеспечил регулярный бизнес; Если бы он это скрыл, доверие было бы подорвано при первой же проблеме.

Случай 2. Нарушение конфиденциальности стало риском для карьеры. Переводчик-фрилансер заключил конфиденциальный договор в общедоступный инструмент; Как только клиент обнаружил нарушение соглашения о неразглашении, деловые отношения прекратились, а рекомендация была утеряна. Одно-единственное удобство разрушило долгосрочное доверие.

Случай 3 — Проверка сохраненной подлинности. В одном академическом переводе AI добавила «цитатуру», которой не было в источнике, и вымышленное имя автора. Рефлекс проверки источника у переводчика уловил это; Если бы оно было подано, это было бы нарушением академической честности и потерей репутации.

Четыре копируемых шаблона

1) Решение о конфиденциальности/доступности инструментов:

Ваша роль: консультант по конфиденциальности данных. Я опишу, что включает в себя работа по переводу. Скажите мне (1) является ли этот текст конфиденциальным/личным/защищенным авторскими правами, (2) уместно ли его обрабатывать в общедоступном инструменте искусственного интеллекта, (3) если нет, то какую безопасную альтернативу мне следует использовать. Содержание: [...]

2) Проект прозрачной записки для клиента:

Напишите клиенту короткую профессиональную записку, честно объяснив, как я буду выполнять эту работу: машинный перевод + ручное постредактирование, какие части будут трудоемкими, как будет проводиться проверка, соответственно цена/время. Не преувеличивайте, дайте уверенности. Вид работы: [...]

3) Список источников/проверки фактов:

Опустите все фактические элементы, которые необходимо проверить в следующем переводе: имена, даты, числа, цитаты, источники/атрибуции, утверждения об «истине», идиомы/пословицы. Укажите для каждого из них пометку «подтверждено независимым источником». Не доверяйте тексту, только тому, что можно проверить. Перевод: [...]

4) Предварительная проверка этики/авторских прав:

Работу опишу ниже. Сообщите мне о возможных проблемах этического характера и авторских прав: статус авторских прав на текст, производные переводы, личные данные, защита данных клиентов, необходимость прозрачности. Перечислите риски и меры предосторожности.Работа: [...]

Слабая подсказка / Сильная подсказка

Слабое: «Переведите этот документ». (Скрытый текст можно передать во внешний инструмент, не ставя под сомнение конфиденциальность, авторские права или совместимость инструмента.)

Гючлю: «Сначала оцените это: этот документ представляет собой отчет пациента; он содержит личные данные о здоровье. Должен ли он обрабатываться в общедоступном инструменте или требуется безопасная/институциональная среда? На что мне следует обратить внимание с точки зрения KVKK? Дайте план перевода после определения подходящей среды».

Разница: сильная подсказка начинается с конфиденциальности и юридического контроля; Перевод происходит после того, как определена правильная и безопасная среда.

Таблица этических аспектов

Размер

Риск

предосторожность

Конфиденциальность

Утечка документа, нарушение NDA

Безопасный инструмент, политика данных

персональные данные

Нарушение KVKK/GDPR

Анонимизация/безопасная среда

авторское право

Несанкционированная производная работа

Проверьте разрешение/права

прозрачность

Скрытое использование машины

Будьте открыты для клиента

оригинальность

Галлюцинация, фальшивый источник

проверка источника

подотчетность

Оправдание «это сделал ИИ»

Возьмите на себя ответственность

Распространенные ошибки

  • Ввод секретного текста в общедоступный инструмент «чтобы сделать это быстрее». Необратимое нарушение.
  • Сокрытие использования машины от клиента. Когда доверие подорвано, его трудно восстановить.
  • Игнорирование авторских прав и прав на производные произведения. Юридический риск.
  • Размещение источника/цитаты, составленного ИИ, без его проверки. Потеря оригинальности и репутации.
  • Возложение ответственности на ИИ. Владельцем доставленного произведения является переводчик.

В заключение

В эпоху ИИ ответственность переводчика возрастает, как и его полномочия. Конфиденциальность неприкосновенна: конфиденциальный, личный и защищенный авторским правом текст не попадает на незащищенный носитель. Этика требует прозрачности и подотчетности: использование машин не скрывается, ответственность принимается. Авторское право и оригинальность воспринимаются серьезно; Источники и фразы, которые может составить ИИ, проверены. Человеческая проверка является незаменимым последним звеном работы. Будущее профессии принадлежит переводчику, который умело использует ИИ, но знает его пределы и меняет ситуацию благодаря своим культурным и экспертным суждениям.

Задача приложения

Проведите полную проверку «ответственного перевода» для выполняемой работы (или образца): Определите правильный инструмент с помощью шаблона «решение о конфиденциальности/пригодности инструмента»; Составьте список рисков с «предварительной проверкой этики/авторских прав»; подготовить «меморандум о прозрачности для клиента»; и извлеките «список источников/проверки фактов» из образца перевода и самостоятельно проверьте как минимум три пункта. Добавьте эти четыре шага в свой стандартный рабочий процесс.

контрольный список

  • [ ] Я оценил, является ли текст конфиденциальным/личным/защищенным авторскими правами, и выбрал правильный инструмент.
  • [ ] Я уделил дополнительное внимание данным в рамках KVKK/GDPR.
  • [ ] Я открыто рассказал клиенту об использовании оборудования и процессе.
  • [ ] Я независимо проверил источники, цитаты и факты, предоставленные YZ.
  • [ ] Я оставил ответственность за выполненную работу себе, а не ИИ.

Модульный экзамен

1. Что из перечисленного является наиболее точным позиционированием искусственного интеллекта в письменном и устном переводе?

  • А) Искусственный интеллект — это план, терминология и инструмент качества; Ответственность за смысл, тон, культуру и конечный результат лежит на человеке ✔
  • Б) Искусственный интеллект может напрямую выполнять юридические и медицинские переводы без одобрения человека.
  • В) Искусственный интеллект работает только при переводе слов, к качеству и терминологии он не имеет никакого отношения.
  • Г) Поскольку искусственный интеллект всегда точнее человека, все решения по переводу следует оставить на его усмотрение.

Описание: Искусственный интеллект; Это черновик перевода, терминология, краткое изложение и качественная помощь. Ответственность за смысл, тон, культуру, креативность и окончательную доставку лежит на компетентном переводчике; Непроверенные результаты могут привести к договорной ошибке, медицинской халатности или кризису товарного знака.

2. Что означает, если результат машинного перевода «быстрый, но неточный» и почему это опасно?

  • А) Беглый перевод всегда правильный, поэтому дополнительная проверка не требуется
  • Б) Даже если предложение кажется естественным на изучаемом языке, оно могло неправильно передать значение, число или отрицание; Беглость речи не гарантирует точность ✔
  • В) Неправильные переводы всегда грамматически неверны и их легко заметить.
  • Г) Беглость важна только в художественных текстах, в технических текстах она неважна.

Пояснение: Даже если машинный перевод создает идеальное, естественное предложение, он может исказить число, отрицание или значение в источнике. Беглость речи не является гарантией точности; Поэтому числа, даты, имена собственные и отрицания следует сверять отдельно с первоисточником, не обманываясь беглостью.

3. Что из следующего является основным различием между NMT (нейронным машинным переводом) и переводом на основе LLM?

  • А) NMT принимает инструкции, а LLM не может; так что LLM переводит только слово в слово
  • Б) Они совершенно одинаковы, практической разницы между ними нет.
  • C) LLM понимает такие инструкции, как тон, терминология и аудитория, и видит более широкий контекст; НМТ быстр и последователен, но плохо выполняет инструкции ✔
  • D) LLM всегда быстрее NMT и никогда не добавляет

Описание: NMT работает быстро и последовательно, но плохо воспринимает инструкции и видит более широкий контекст. LLM, с другой стороны, понимает такие инструкции, как тон, список терминов и аудиторию, и видит контекст более широко, но требует контроля над риском галлюцинаций, поскольку может вносить дополнения.

4. В чем разница между легким постредактированием и полным постредактированием?

  • А) Легкий постредактирование имеет лучшее качество, полный постредактирование — это просто быстрое сканирование.
  • Б) Между ними нет разницы, различаются только названия.
  • В) Полное постредактирование применяется только к текстам для внутреннего использования, легкое постредактирование применяется к текстам, подлежащим публикации.
  • Г) Легкий постредактирование делает текст точным и понятным; Полное постредактирование направлено на обеспечение качества человеческого перевода и готового к публикации результата ✔

Комментарий: Цель легкого постредактирования — сделать текст точным и понятным; Без стилистических штрихов, подходит для внутренних/временных текстов. При полном постредактировании цель состоит в том, чтобы результат был неотличим от человеческого перевода; Требуется для текстов с узнаваемостью бренда, которые будут опубликованы.

5. Почему «чрезмерное редактирование» является проблемой в MTPE?

  • А) Чрезмерная коррекция всегда делает перевод более точным, поэтому она приветствуется.
  • Б) Переписывание правильных и подходящих предложений без необходимости уничтожает преимущество MTPE во времени; Исправлять следует только дефектные места ✔
  • В) Гиперкоррекция только увеличивает скорость, совершенно не влияет на качество
  • Г) Чрезмерная коррекция — проблема не только машинного перевода, но и чернового перевода.

Пояснение: Гиперкоррекция — это переписывание правильного и подходящего предложения, выданного машиной, просто исходя из личных предпочтений. Это уничтожает все преимущество MTPE во времени. Правило: если результат работы машины точный, понятный и подходящий, не трогайте его; Просто исправьте это, если что-то не так.

6. Какова основная польза от указания «запрещенного положения» (перевода, который не следует использовать) в терминологической базе?

  • А) Нет необходимости указывать запрещенный ответ, поскольку машина и так никогда не допускает ошибок.
  • Б) Запрещенные эквиваленты полезны только в художественном переводе, в техническом тексте они не нужны.
  • В) Явный запрет неправильных альтернатив наряду с правильными аналогами предотвращает противоречивость и искажение языка бренда ✔
  • Г) Указание запрещенного эквивалента замедляет трансляцию и не дает никакой пользы.

Пояснение: Простое написание правильного ответа не предотвращает использование неправильных, но правдоподобных альтернатив. Явное указание запрещенных эквивалентов (используя только слова «учетная запись»; «профиль», «членство» вместо «учетная запись») — наиболее эффективный способ избежать несоответствий и неправильного языка бренда.

7. Что необходимо записывать в память переводов (ПМ) и почему?

  • А) Каждый вывод машины должен записываться в TM без проверки, поскольку скорость имеет первостепенное значение.
  • Б) В ТМ нельзя писать переводы, следует сохранять только исходные тексты
  • В) ТМ разных клиентов должны быть смешаны в одну большую ТМ.
  • D) Должны быть написаны только проверенные, заверенные переводы; Если необработанные выходные данные машины поступают в TM, ошибка будет перенесена на будущие задания и распространена ✔

Примечание. В ТМ следует отправлять только проверенные, заверенные переводы. Сохранение необработанных результатов машины в TM без их проверки приведет к тому, что ошибка будет возвращаться снова и снова в будущих заданиях, что будет выглядеть как «100% совпадение». Мусор на входе, мусор на выходе.

8. Как следует обрабатывать заполнители (например, {name}, %s) в текстах программного обеспечения при локализации?

  • А) Заполнитель сохраняется как есть; Не переводится, не удаляется, не форматируется, перемещается только при необходимости и проверяется QA ✔
  • Б) Заполнители, как и другие слова, должны быть переведены на целевой язык.
  • В) Заполнители следует удалить, поскольку они ухудшают читаемость.
  • Г) Плейсхолдеры не важны, их вообще не нужно учитывать при переводе

Описание. Заполнители — это знаки, которые заполняются переменными во время выполнения. Их перевод, удаление или форматирование приведет к сбою программного обеспечения или отображению необработанного текста. Заполнитель сохраняется как есть; только заполнитель можно перемещать в соответствии с синтаксисом целевого языка, и обязательно проводится тур по обеспечению качества заполнителя.

9. Что означает ограничение CPS (символов в секунду) при переводе субтитров?

  • А) Он определяет, сколько цветов будет использоваться, а не сколько секунд субтитры будут оставаться на экране.
  • Б) Справедливо только для дубляжа, к субтитрам отношения не имеет.
  • В) Это ограничение скорости субтитров, чтобы зрители могли легко их прочитать; поэтому субтитры требуют сокращения с сохранением смысла ✔
  • Г) Чем выше CPS, тем лучше субтитры, ограничений устанавливать не нужно

Описание: CPS — это ограничение скорости, необходимое зрителю для комфортного чтения субтитров (обычно ~17 символов в секунду для контента для взрослых). Поэтому перевод субтитров – это не дословный перевод, а вопрос подгонки и сокращения с сохранением смысла; Зритель одновременно смотрит и читает изображение.

10. Почему нельзя начинать перевод до проверки транскрипции, созданной автоматическим распознаванием речи (ASR)?

  • А) ASR всегда надежен, поэтому проверка — пустая трата времени
  • Б) ASR допускает только грамматические ошибки, никогда не искажает смысл
  • В) Вывод ASR уже переведен, дальше переводить не нужно
  • Г) АСР особенно ошибается в именах собственных, числах, ударениях и шумах; Неправильную транскрипцию необходимо подтвердить голосом, так как она будет перенесена в перевод ✔

Пояснение: ASR часто допускает ошибки в шуме, акценте, накладывании речи, именах собственных, числах и технических терминах. Неправильная транскрипция переносится непосредственно на перевод и субтитры. Поэтому особенно имена собственные, марки и числа следует проверять путем сравнения их со звуками.

11. Что дает система оценки ошибок, такая как MQM, при оценке качества перевода?

  • А) Это позволяет классифицировать каждую ошибку по категориям и серьезности (критическая/серьезная/незначительная) и оценивать качество объективным и сопоставимым образом ✔
  • Б) Автоматически исправляет перевод, полностью исключая человеческую оценку
  • В) Отлавливает только числовые ошибки, не занимается смысловыми и терминологическими ошибками.
  • Г) Не измеряет качество, а только рассчитывает длину перевода

Описание: MQM (многомерные показатели качества) присваивает каждой ошибке категорию (точность, терминология, беглость, стиль, формат) и вес (критическая/серьезная/незначительная). Таким образом, вместо субъективных оценок «хорошо/плохо» могут быть выставлены оценки ошибок, трансляторы/движки сравниваются объективно, а решение о доставке может быть привязано к числовому порогу.

12. Каков основной предел показателей автоматического перевода, таких как BLEU?

  • А) Это делает ненужной человеческую оценку, поскольку понимает смысл лучше, чем люди.
  • Б) Смотрит на совпадения слов, не совсем понимает их значение; поэтому система измеряет тенденцию, но не может принять решение о доставке одного текста ✔
  • В) Он всегда безупречен и один может решить, доставляем ли текст.
  • Г) Используется только при устном переводе, к письменному переводу не имеет никакого отношения.

Пояснение: BLEU оценивает перевод на основе совпадения слов с человеческим упоминанием, но на самом деле не понимает значения. Перевод, который отличается от эталонного, но правильный, может получить низкую оценку, а перевод, похожий на эталонный, но неправильный, может получить высокий балл; Критическая отрицательная ошибка мало влияет на оценку. Таким образом, метрическая система измеряет тенденцию, а не определяет доставку отдельного текста.

13. Какова самая сильная и подходящая роль искусственного интеллекта в устном переводе конференций?

  • А) Устранение необходимости в переводчиках за счет полного осуществления синхронного перевода в реальном времени.
  • Б) Автоматическая передача аудио конфиденциальных встреч на внешние сервисы.
  • В) Не несет никакой пользы ни на каком этапе перевода, включая подготовку.
  • D) Хорошая подготовка перед мероприятием (брифинг, двуязычный глоссарий, карточки с номерами и именами собственными); Живой синхронный перевод оставлен на усмотрение человека ✔

Описание: При устном переводе большая часть работы заключается в подготовке, и именно здесь ИИ силен: подготовка полевых брифингов, двуязычных глоссариев, тона говорящего, карточек с номерами и именами собственными. Сам по себе синхронный перевод в реальном времени является обязанностью переводчика-человека из-за задержек, ошибок, конфиденциальности и контекста.

14. Чем транскреация (творческий перевод) отличается от других видов перевода?

  • А) Это верность эмоциональному воздействию и цели источника, а не его словам; Можно отойти от источника, чтобы создать тот же эффект в целевой культуре ✔
  • Б) Всегда переводите исходный текст слово за словом, не меняя его.
  • В) Это тип дословного перевода, используемый только в юридических и медицинских текстах.
  • Г) Полностью игнорировать смысл и писать новый случайный текст

Описание: Транскреация, особенно в рекламных и брендовых текстах, заключается в воссоздании эмоционального воздействия и цели источника, а не слов, в целевой культуре; Иногда кто-то намеренно отходит от источника, потому что цель — не буквальная точность, а тот же эффект. ИИ здесь является мультипликатором идей; Окончательное культурное решение принимается людьми.

15. Каков правильный подход при переводе конфиденциального документа (например, неподписанного контракта или отчета пациента)?

  • А) Используйте наиболее практичный инструмент общедоступного перевода для обеспечения скорости, конфиденциальность — второстепенная мысль.
  • Б) Если документ все равно будет переведен, конфиденциальность не имеет значения, можно использовать любой инструмент.
  • В) Использование общественного транспорта запрещено; Используются только безопасные и корпоративные инструменты, не хранящие данные, в случае сомнений текст не передается внешним инструментам ✔
  • D) Риск конфиденциальности отсутствует, если конфиденциальные документы переводятся только голосом.

Раскрытие информации: Конфиденциальные, личные или неопубликованные тексты не вводятся в общедоступные инструменты, политика данных которых не обеспечивает гарантий; это нарушение NDA/конфиденциальности и юридический риск с точки зрения KVKK/GDPR. Используются только корпоративные и безопасные инструменты, не хранящие/обучающие данные; В случае сомнений текст не передается внешнему инструменту.