Единицы
1. Введение в искусственный интеллект в письменном и устном переводе: роли, границы, аутентификация, конфиденциальность и этика 2. Основы машинного перевода: NMT, LLM, выбор механизма и предварительная оценка 3. Постредактирование машинного перевода (MTPE): упрощенное и полное постредактирование 4. Управление терминологией и терминологической базой: согласованность и корпоративный язык 5. Интеграция искусственного интеллекта с CAT-инструментами и памятью переводов (TM) 6. Локализация (L10n): программное обеспечение, Интернет, игры и культурная адаптация 7. Субтитры, дубляж и аудиовизуальный перевод 8. Контроль качества (QA), метрики оценки и LQA 9. Подготовка к устному переводу: последовательный и синхронный перевод 10. Контекст, культура, тон и творческий перевод (транскреация) 11. Конфиденциальность, этика, авторское право, подлинность и будущее профессии
Единица 6 / 11

Локализация (L10n): программное обеспечение, Интернет, игры и культурная адаптация

Прибыль:

  • Умение отличать локализацию от перевода и правильно управлять целостностью заполнителей, длиной текста и форматом даты/денег/мер.
  • Возможность адаптировать технические функции, такие как правила множественного числа и языки с письмом справа налево, к целевому региону.
  • Способность оценивать культурные элементы с точки зрения местного эксперта и фиксировать заполнитель и культурные риски искусственного интеллекта с помощью QA.

Поворот кнопки «Сохранить» в приложении на «Сохранить» — это перевод; Но адаптация формата даты, валюты, написания справа налево, длины кнопок, культурных изображений и юридических текстов этого приложения к целевому рынку — это локализация. В этом модуле вы узнаете о локализации, ее технических особенностях (заполнитель, длина, кодирование), роли ИИ в этом процессе и культурной адаптации. Цель состоит в том, чтобы мыслить как эксперт по локализации, «создавая продукт, соответствующий целевой культуре, а не словам».

Основные понятия

Локализация (L10n — локализация; L10n, потому что между «l» и «n» 10 букв) — это процесс полной адаптации продукта (программного обеспечения, сети, игры, приложения) к определенному языку и культуре; Он включает в себя, но превосходит перевод. Интернационализация (i18n — интернационализация) — это процесс разработки продукта с нуля так, чтобы он был полностью готов к использованию языка (отделение текста от кода, что обеспечивает гибкость длины); Он предшествует локализации и обеспечивает ее.

Строка — это фрагмент текста, который необходимо перевести в программе. Заполнители — это метки внутри строки, которые заполняются переменной во время выполнения: «Привет, {имя}», «{count} элементов». Локаль — это комбинация языка + региона (tr-TR, en-US); Указывает дату, время, числовой и денежный формат.

Локализация отличается от перевода: вы передаете не только смысл, но также функцию и культурную адекватность. Дата «4 марта 2026 года» — 4 марта в США и бессмысленна в Турции (мы пишем 03.4.2026); «₺» вместо «$»; Красный цвет может быть предупреждением в одной культуре и праздником в другой.

Совет: При локализации переводчики чаще всего упускают из виду элементы вне текста: формат даты/времени/числа, валюту, единицу измерения (мили/км), порядок имен, формат адреса, формат телефона. Сканируйте их в каждом проекте с помощью «контрольного списка локали».

Заполнитель и техническая целостность

Самая опасная техническая ошибка при локализации — повреждение заполнителей и тегов. Если вы удалите {n} в предложении «У вас есть {n} сообщений», напишите его неправильно или поместите в неправильное место в соответствии с турецким синтаксисом, программа выйдет из строя или будет выглядеть грубо как «У вас {n} сообщений». Правила:

  • Никогда не поворачивайте, не удаляйте и не форматируйте заполнители. {name}, %s, {{count}} остаются прежними.
  • Турецкий синтаксис может заменить заполнитель; Переместите его на новое место, сохранив смысл, но не уничтожайте сам знак.
  • Правила множественного числа различаются в зависимости от языка: хотя в английском языке говорится «1 предмет / 2 предмета», в турецком нет суффикса множественного числа после числа («2 предмета»). Платформы локализации обрабатывают это отдельно.

ИИ здесь — двусторонний инструмент: он быстро переводит строки, но может случайно перевернуть или потерять заполнитель. Вот почему этап контроля качества имеет важное значение при локализации.

Внимание: расширение текста — это скрытая проблема локализации. Текст перевода с английского на турецкий часто бывает на 20-40% длиннее; «ОК» состоит из 2 букв, его аналог «ОК» — из 5 букв. Перевод, который не умещается в узкую кнопку, ломает интерфейс. Если есть возможность, посмотрите в реальном интерфейсе, подходит ли целевой текст.

Процесс локализации и культурная адаптация с помощью ИИ

ИИ ускоряет выполнение следующих задач по локализации: первоначальный перевод строк, проверка согласованности, предупреждение о длине («этот перевод на 35 % длиннее оригинала»), проверка культурной приемлемости («вызовет ли это изображение/пример проблемы в целевой культуре?»). Но культурное решение принадлежит человеку: местный эксперт знает, как шутка, праздник, пример, цвет будут восприняты в целевой культуре. ИИ может выдать общее предупреждение; Окончательное решение принимает переводчик, знающий местный рынок.

Примеры культурной адаптации: способы оплаты (местные карты), примеры имен (местные имена), единицы измерения, юридические обязательства (тексты KVKK/GDPR), праздники, форма адреса (вы/вы), цвет и значения символов.

три мини-кейса

Случай 1. Контроль качества заполнителя предотвратил сбой. При переводе 1200 строк мобильного приложения ИИ перевел заполнитель {count} как «{number}» в 18 местах. Раунд контроля качества Placeholder выявил это; Если бы это не было исправлено, приложение могло бы аварийно завершить работу на этих экранах.

Случай 2 — Длина сломала интерфейс. Меню одного программного обеспечения было разработано на английском языке; Когда турецкие переводы стали в среднем на 30% длиннее, три пункта меню были перемещены и вырезаны. Если бы команда получила предупреждение о длине заранее, они бы подготовили короткие альтернативы (при необходимости сокращение вместо «Настройки»); задание было переделано и обновлено с контролем длины процесса.

Случай 3. Культурная адаптация спасла продажу. В рекламной акции игры присутствовал знак отличия с фигуркой свиньи; на целевом рынке это было неприемлемо с культурной точки зрения. Местный переводчик предупредил, цифра изменена. ИИ перевел текст, но на культурный риск указал местный эксперт.

Четыре копируемых шаблона

1) Перевод строки (защищенный заполнитель):

Переведите следующие строки программного обеспечения на [целевой язык]. ПРАВИЛО: НИКОГДА не переводите, не удаляйте и не форматируйте заполнители, такие как {name}, %s, {{count}}; оставьте его как есть (вы можете переместить его в соответствии с турецким синтаксисом). Сохраняйте HTML/теги. Напишите его лаконично и подходящим для интерфейса. Формат: источник → перевод.Строки: [...]

2) Заполнитель/метка QA:

Ниже приведены исходные и переведенные строки. Помечать ТОЛЬКО проблемы с заполнителями и тегами: переведены/удалены/повреждены{...}, %s, {{...}}, <tag>. Укажите, сколько заполнителей в источнике, сколько в переводе и перечислите те, которые не совпадают. Источник: [...] | Перевод: [...]

3) Предупреждение о длине и интерфейсе:

Оцените длину следующих переводов пользовательского интерфейса. Для каждого перевода укажите процентное расширение согласно источнику и отметьте те, которые могут не помещаться в ограниченное пространство (кнопки, меню). Тем, кто не подходит, предложите более короткий вариант, сохраняющий смысл. Пары (источник | перевод): [...]

4) Проверка культурной пригодности:

Ваша роль: консультант по локализации [целевой рынок]. Отмечайте элементы в следующем контенте, которые могут вызвать проблемы в целевой культуре: изображение, пример, имя, цвет, символ, шутка, формат даты/измерения, юридический текст. Окончательное решение за мной; вы указываете на риск и предлагаете альтернативы. Содержание: [...]

Слабая подсказка / Сильная подсказка

Слабое: «Переведите эти тексты приложения». (Заполнитель, длина, без контекста интерфейса; машина переводит заполнитель, текст становится длиннее.)

Сильный: «Переведите эти строки мобильного приложения на турецкий язык. Оставьте заполнители {user} и %d такими, какие они есть. Эти тексты будут отображаться в узких кнопках; по возможности делайте их короткими. «Настройки» → «Настройки», «Профиль» → «Профиль». Следуйте турецким правилам для выражений во множественном числе (без суффикса множественного числа после числа)».

Разница: сильная подсказка дает условное обозначение заполнителя, длины, термина и множественного числа; результат будет близок к прямому входу в интерфейс.

Таблица размеров локализации

Размер

пример

Риск

Заполнитель/метка

{имя}, %s, <b>

Сбой программного обеспечения

длина

«ОК» → «ОК» (150%)

Переполнение интерфейса

Дата/номер/деньги

04.03.26, $, 1000,50

ложная информация

правило множественного числа

2 предмета → 2 предмета

плохая грамматика

культурный элемент

образ, цвет, юмор

репутация/продажи

юридический текст

КВКК/GDPR

юридический риск

Распространенные ошибки

  • Перевернуть/удалить заполнитель. Это приводит к сбою программного обеспечения или появлению необработанного текста.
  • Не учитывая растяжение текста. Интерфейс переполняется, элементы усекаются.
  • Не конвертируется формат даты/валюты/размеров. Осталось «5 миль», а не «8 км».
  • Передача культурного элемента без консультации с местным экспертом. Риск репутации и продаж.
  • Перевод правил множественного числа с помощью английской логики. Плохая грамматика типа «2 предмета».

Псевдолокализация и языки с письмом справа налево

Две технические проблемы определяют качество локализации. Первый — псевдолокализация: тестирование продукта с поддельным, но реалистичным текстом большой длины и специальными символами (например, «Настройки» → «[Ŝéttîngŝ~~]») перед фактическим переводом. Это показывает, может ли интерфейс обрабатывать длинные тексты и специальные символы, действительно ли строки извлекаются до начала перевода. Если переводчик, работающий с разработчиком, рекомендует этот тест, многие ошибки интерфейса будут обнаружены до того, как они возникнут.

Второй — языки с письмом справа налево (RTL): такие языки, как арабский, иврит, персидский, пишутся справа налево, а локализация требует зеркального отображения не только текста, но и всей компоновки интерфейса (положение меню, стрелки, выравнивание). В переводе с письмом справа налево цифры и термины, написанные латинскими буквами, могут вызвать путаницу; Эта проблема «текста биди» требует особого внимания. ИИ может переводить текст с письмом справа налево, но зеркальное отображение макета и решения о двустороннем потоке требуют технических и культурных знаний. Эти два вопроса показывают, что локализация — это инженерно-культурная работа, выходящая за рамки перевода.

В заключение

Локализация означает адаптацию продукта, а не слов, к целевому языку и культуре; включает перевод, а также целостность заполнителя, длину текста, формат даты/денег/меры, правила множественного числа и культурные элементы. ИИ ускоряет перевод строк, проверку длины и культурных рисков; Но тур по обеспечению качества необходим, поскольку он может нарушить структуру заполнителя, а культурное решение принимает эксперт, знающий местный рынок. Успех в локализации — это внимание к деталям, выходящим за рамки текста.

Задача приложения

Возьмите пример текста интерфейса из 15–20 строк (с заполнителями {...} или %s и примером даты/денег). Переведите с помощью шаблона «Перевод строк», затем проверьте целостность заполнителя с помощью «QA заполнителя» и проверьте риск переполнения с помощью «Предупреждения о длине». Адаптируйте формат даты и денег к целевому региону и выполните «сканирование культурной пригодности», если есть культурный элемент.

контрольный список

  • [ ] Я оставил заполнитель и метки в прежнем виде и подтвердил их с помощью отдела контроля качества.
  • [ ] Я контролировал растяжение текста и предотвращал переполнение в узких областях.
  • [ ] Я адаптировал дату, число, валюту и единицы измерения к целевой локали.
  • [ ] Я перевел выражения множественного числа в соответствии с правилами целевого языка.
  • [ ] Я оценил культурные элементы с точки зрения местного эксперта.