Единицы
1. Введение в искусственный интеллект в турецком языке и литературе: роли, границы, проверка, подлинность и этика 2. Анализ текста и внимательное чтение: анализ поэзии, рассказа и романа с помощью ИИ 3. Лингвистика и корпусный анализ: чтение словарного запаса с помощью чисел 4. Древние тексты, упрощение и транслитерация: работа с османскими и диванными текстами 5. Материалы курса и дизайн обучения: результат, эффективность и измерение 6. История литературы и исследования: обзор литературы, синтез и проверка 7. Редактирование, корректура и верстка: подготовка текста к публикации 8. Сотрудничество человека и искусственного интеллекта в писательстве и производстве 9. Оценка оригинальности, плагиата и текстов, написанных с помощью ИИ 10. Проверка источника, дисциплина галлюцинаций и атрибуции 11. Человек в литературной интерпретации: эстетическое суждение, этика, конфиденциальность и границы
Единица 4 / 11

Древние тексты, упрощение и транслитерация: работа с османскими и диванными текстами

Прибыль:

  • Знать разницу между упрощением и транскрипцией и уметь использовать ИИ только для ограниченных, поддающихся проверке задач (поддержка понимания, лексическая гипотеза, черновой вариант упрощения).
  • Возможность сверить каждый вывод с оригинальным текстом и надежными источниками, избегая таких ловушек, как дополнение недостающего текста и исправление содержания.
  • Способность понять, что филолог-человек незаменим в таких работах, как транскрипция, просодия и научное издание.

Большая часть турецкой литературы была написана на языке, который сегодняшние читатели не могут читать напрямую: османском турецком языке (османский турецкий язык — турецкий язык, написанный арабским алфавитом, использовавшийся во времена Османской империи, обогащенный арабскими и персидскими словами и фразами). Большая часть диванной поэзии, книг по истории, газет и архивных документов написана на этом языке. Чтобы сделать их доступными сегодняшнему читателю, необходимы два процесса: транскрипция (перевод текста с одного алфавита на другой с сохранением звуков специальными знаками; например, замена текста арабскими буквами на латинские буквы) и упрощение (замена старых и тяжелых слов текста словами, понятными сегодняшним читателям).

В этом модуле мы научимся использовать ИИ в качестве помощника в этих задачах, но здесь предупреждение сильнее, чем когда-либо: при работе с устаревшими текстами риск ошибок ИИ и галлюцинаций очень высок; Каждый вывод не может быть использован без проверки компетентным лицом в данной области путем сравнения его с исходным текстом. ИИ может неправильно прочитать слово, «дополнить» двустишие, придумать несуществующий смысл. Здесь ИИ — это схема и инструмент обсуждения; Он никогда не заменит специалиста-филолога.

Почему риск выше в этой области?

По трем причинам:

  1. Неоднозначное прочтение. В арабском письме короткие гласные часто не пишутся; Одна и та же строка букв может состоять из нескольких слов. Правильное чтение требует контекста и опыта. ИИ может представить наиболее вероятный прогноз как «верный».
  2. Тяжелый словарный запас. Тонкости арабо-персидских словосочетаний, метафор (стереотипных образов в классической поэзии) и аруз (меры, основанной на длине слога) в текстах Дивана теряются или искажаются при поверхностном упрощении.
  3. Склонность к завершению. ИИ может автоматически заполнять отсутствующий или устаревший текст в соответствии с тем, каким он «должен» быть. Это серьезная ошибка в филологии; состоит в том, чтобы придумать текст, которого не существует.
Внимание: сказать ИИ «перевести этот османский куплет» и опубликовать результат без его проверки — самая опасная ошибка в этой области. Результаты транскрипции и упрощения всегда следует сравнивать с исходным текстом, надежным словарем и, если возможно, существующим изданием (научной публикацией).

Как безопасно использовать ИИ

В старых текстах используйте ИИ для следующих ограниченных, но полезных задач:

  • Поддержка понимания (суть): Изучение современного эквивалента тяжелых слов текста латинскими буквами в виде черновика.
  • Словарная гипотеза: наличие перечисленных возможных значений слова, а затем проверка их по надежному словарю.
  • Упрощенный проект: делается черновой вариант параграфа на современном турецком языке, а затем эксперт редактирует его.
  • Сравнение: сравнение вашего упрощения с упрощением ИИ и выявление упущенных из виду областей.

С другой стороны, не позволяйте ИИ самостоятельно выполнять следующие задачи: транслитерация изображения арабского алфавита; научное издание; восполнение недостающего текста; претендуют на окончательное значение.

Совет: попросите два варианта упрощения: (1) близкое упрощение, сохраняющее смысл, (2) список, объясняющий эквиваленты слов. Второй список облегчает эксперту быстрое подтверждение и делает видимыми придуманные ответы ИИ.

три мини-кейса

Случай 1. Словарная гипотеза сэкономила время. Аспирант получил от AI проект, эквивалентный 30 тяжелым словам исторического текста латинскими буквами. 30 эквивалентов, подтвержденных надежным словарем; 4 были неправильными и были исправлены. Время просмотра словаря значительно сократилось, но этап проверки не был пропущен.

Случай 2 — Обнаружена ошибка завершения. Исследователь спросил AI о недостающей части затертого двустишия. ИИ придал просодии подходящее, беглое, но полностью сфабрикованное завершение. Когда исследователь посмотрел примечания к изданию, он увидел, что эта глава на самом деле другая. Ловушка «ИИ заполняет недостающий текст» стала конкретной.

Случай 3 — Упрощение искажает смысл. Редактор использовал ИИ-упрощение диванного куплета; Поскольку ИИ перевел метафору (стереотипный образ) буквально, первоначальный смысл двустишия был утерян. Редактор проконсультировался с отраслевым экспертом и сделал упрощение, сохранившее содержание.

Четыре копируемых шаблона

1) Эквивалент тяжелого слова (при условии подтверждения):

Приведите ниже СПИСОК возможных сегодня эквивалентов слов, обострённых в старом турецком тексте латинскими буквами. Для каждого слова сделайте пометку «не уверен, необходимо проверить по словарю». Добавление слов, которых нет в тексте, завершение текста.Текст: [вставьте текст сюда]

2) Двухвариантное упрощение:

Упростите следующий текст двумя способами: (1) близкую версию, сохраняющую смысл и образы, (2) таблицу, показывающую старый/новый эквивалент каждого измененного вами слова. Заполняем недостающие части, добавляем несуществующий смысл. Отметьте, где вы не уверены. Текст: [вставить текст]

3) Упрощение управления:

Ниже приведен фактический текст и мое упрощение. Отметьте места, где в моей версии смысл искажен, опущен или искажен. Не навязывайте свою собственную версию; просто укажите проблемные места и свяжите свои рассуждения с текстом. Оригинал: [...] Моя версия: [...]

4) Объяснение сюжета/концепции:

Объясните классические образы и метафоры в следующем куплете. Для каждого: возможное значение, использование в традициях и примечание «должно быть проверено экспертным источником». Не делайте однозначных суждений, а также изложите альтернативные варианты прочтения. Куплет: [напишите куплет]

Слабая подсказка / Сильная подсказка

Слабое: «Переведите этот османский текст на современный турецкий».

Строгое: «Упростите старый турецкий текст латинскими буквами ниже; сохраните изображения и метафоры, не сводите его к буквальному значению. Покажите каждое слово, которое вы изменили, в старой/новой таблице. Дополните недостающую или двусмысленную часть; отметьте ее как «неопределенную, должна быть проверена экспертом». Не добавляйте никаких слов или стихов, которых нет в тексте».

Мощная подсказка закрывает ловушку завершения, предотвращает потерю контента и предлагает таблицу, которая упрощает проверку. Слабая подсказка оставляет дверь открытой для ИИ, чтобы он мог подойти и сгладить ситуацию.

Таблица задач и безопасности

бизнес

только ИИ

Правильное использование

Значение слова тяжелый в тексте латинскими буквами

рискованный

Черновик + подтверждение словаря

транслитерация с арабской графики

не сделано

эксперт-филолог

Упрощение

проект

Экспертный ремонт

Полностью недостающий текст

Абсолютно не сделано

Редакция/эксперт

Объяснение

гипотеза

Подтверждение от экспертного источника

научное издание

не сделано

филолог

Аруз и метр: Почему у ИИ возникают особые трудности?

Большая часть классической турецкой поэзии была написана на языке аруз (система измерения, основанная на длине и краткости слогов, основанная на шаблонах). Чтобы определить, в каком образце аруз находится двустишие, необходимо расшифровать по отдельности, длинные или короткие слоги, и знать некоторые тонкости (например, считать один длинный слог за два коротких или отбрасывать гласную). Это обычная, но очень тонкая работа, и именно здесь ИИ часто ошибается: он может неправильно назвать шаблон, неправильно измерить слог или предложить шаблон, который «звучит хорошо», но ошибочен.

Поэтому определение счетчика аруз – это не та работа, которую может выполнить вслепую ИИ; В лучшем случае это дает «кандидата», и этот кандидат должен быть проверен на самом куплете кем-то, знающим размер. То же самое касается анализа остановок и закономерностей в слоговом размере (метр народной поэзии, основанный на количестве слогов в каждой строке); ИИ может даже ошибаться при подсчете слогов. Метр — это место, где проверяется точность литературного анализа: ложное утверждение о размере делает эссе с самого начала ненадежным.

Внимание: не вводите в исследование имя просодического паттерна, данное ИИ, без его проверки (например, «failatünfailatün...»). Измерение – это как техническое, так и культурное знание, и в этой области необходим человеческий опыт. Используйте ИИ максимум как подсказку к вопросу «где мне искать меру этого куплета, какие закономерности возможны?»

Распространенные ошибки

  • Публикация транскрипции/упрощения без ее проверки. Каждый вывод сравнивается с исходным текстом.
  • Попросите ИИ заполнить недостающий текст. Это создание несуществующего текста; Это определенно не сделано.
  • Чтобы свести смысл к буквальному значению. Классические образы должны быть сохранены.
  • Думая, что только чтение наверняка. В арабском алфавите часто встречается множественное чтение; Спросите об альтернативах.
  • Заключение критического текста без консультации со специалистом. Филолог в этой области незаменим.

В заключение

ИИ в старых текстах; Это полезный, но рискованный инструмент для поддержки понимания, построения лексических гипотез и упрощения эскизов. Такие задачи, как транскрипция, редактирование и восполнение недостающих текстов, принадлежат эксперту-филологу. Сверяйте каждую распечатку с оригинальным текстом, надежным словарем и текущими изданиями; Не попадайтесь в ловушки завершения и сглаживания. В этой области человеческий опыт важнее скорости.

Задача приложения

Найдите короткий, неупрощенный древний текст, написанный латинскими буквами (диванное двустишие или исторический параграф). Получите проект от ИИ с помощью шаблона «двухверсионного упрощения». Затем проверьте каждое слово в таблице слов с помощью надежного словаря; Отметьте неправильные. Проверьте, доводите ли вы изображение до его буквального значения, и при необходимости исправьте его.

контрольный список

  • [ ] У меня не было искусственного интеллекта, который самостоятельно выполнял бы транскрипцию арабского письма.
  • [ ] Я не заполнил недостающую/неясную часть.
  • [ ] Я подтвердил эквиваленты слов из надежного словаря.
  • [ ] Я проверил, что образы и образы сохранились.
  • [ ] Я консультировалась с филологом, специализирующимся на критическом тексте.