единици
1. Въведение в изкуствения интелект в турския език и литература: роли, граници, проверка, автентичност и етика 2. Анализ на текст и внимателно четене: Анализиране на поезия, разказ и роман с AI 3. Лингвистика и корпусен анализ: Четене на лексика с числа 4. Древни текстове, опростяване и транслитерация: Работа с османски и диванни текстове 5. Материали за курса и дизайн на обучението: Резултат, ефективност и измерване 6. Литературна история и изследване: литературен преглед, синтез и проверка 7. Редактиране, корекция и набор: Подготовка на текста за публикуване 8. Сътрудничество между човек и AI в творческото писане и продукция 9. Оценяване на оригиналност, плагиатство и текстове, написани с AI 10. Дисциплина за проверка на източника, халюцинации и приписване 11. Човекът в литературната интерпретация: естетическа преценка, етика, поверителност и граници
единица 4 / 11

Древни текстове, опростяване и транслитерация: Работа с османски и диванни текстове

Печалби:

  • Знайте разликата между опростяване и транскрипция и можете да използвате AI само за ограничени, проверими задачи (подкрепа за разбиране, хипотеза за лексикон, чернова за опростяване).
  • Възможност за проверка на всеки изход с оригиналния текст и надеждни източници, като се избягват капани като попълване на липсващия текст и изправяне на съдържанието
  • Да можеш да разбереш, че човешкият филолог е незаменим в произведения като транскрипция, прозодия и научно издание.

Голяма част от турската литература е написана на език, който днешните читатели не могат да четат директно: османотурски (османотурски - турски, написан с арабска азбука, използван по време на Османската империя, обогатен с арабски и персийски думи и изрази). Повечето от поезията на Дивана, историческите книги, вестниците и архивните документи са на този език. Предоставянето им на разположение на съвременните читатели изисква два процеса: транскрипция (превод на текст от една азбука на друга, запазване на звуците със специални знаци; например промяна на текста от арабски букви в латински букви) и опростяване (замяна на старите и тежки думи в текста с думи, които днешните читатели могат да разберат).

В тази част ще се научим да използваме AI като помощник в тези задачи — но тук предупреждението е по-силно от всякога: В работата с наследени текстове рискът от грешки и халюцинации с AI е много висок; Всеки изход не може да се използва без проверка от компетентно лице в областта чрез сравняване с оригиналния текст. AI може да разчете погрешно дума, да „завърши“ куплет, да създаде смисъл, който не съществува. Тук AI е инструмент за очертания и дискусии; Никога няма да замени експерта филолог.

Защо рискът е по-висок в тази област?

По три причини:

  1. Двусмислен прочит. В арабската писменост кратките гласни често не се пишат; Един и същ низ от букви може да бъде няколко думи. Правилното четене изисква контекст и опит. AI може да представи най-вероятната прогноза като „сигурна“.
  2. Тежък речник. Тънкостите на арабско-персийските фрази, метафори (стереотипни образи в класическата поезия) и аруз (мярка, базирана на дължината на сричката) в текстовете на Диван са загубени или изкривени при повърхностно опростяване.
  3. Склонност към завършване. AI може автоматично да попълни липсващ или износен текст според това, което „трябва“ да бъде. Това е тежка грешка във филологията; е да съставя текст, който не съществува.
Внимание: Да кажете на AI "да преведе този османски куплет" и да публикувате резултата, без да го проверите, е най-опасната грешка в тази област. Резултатите от транскрипцията и опростяването трябва винаги да се сравняват с оригиналния текст, надежден речник и, ако е възможно, съществуващо издание (научна публикация).

Как да използвате AI безопасно

В по-стари текстове използвайте AI за тези ограничени, но полезни задачи:

  • Подкрепа за разбиране (същност): Научаване на днешния еквивалент на тежки думи на текст с латински букви като чернова.
  • Хипотеза на речника: Наличието на възможните значения на изброената дума — след това проверено спрямо надежден речник.
  • Чернова за опростяване: Направете груба чернова на параграф на сегашния турски език — след това накарайте експерта да го преработи.
  • Сравнение: Сравняване на вашето опростяване с това на AI и виждане на пренебрегваните области.

От друга страна, не позволявайте на AI да изпълнява следните задачи сам: транслитерация от изображение на арабски шрифт; научно издание; допълване на липсващ текст; претенция за окончателно значение.

Съвет: Поискайте две версии на опростяване: (1) близко опростяване, което запазва значението, (2) списък, който обяснява еквивалентите на думите. Вторият списък улеснява бързото потвърждение на експерта и прави видими скалъпените отговори на AI.

три мини калъфа

Случай 1 — Хипотезата на речника спести време. Завършил студент получи еквивалента на черновата на 30 тежки думи в исторически текст с латински букви от AI. 30 еквивалента, потвърдени от надежден речник; 4 бяха грешни и бяха коригирани. Времето за сърфиране в речника беше значително съкратено, но стъпката за проверка не беше пропусната.

Случай 2 — Уловена грешка при завършване. Изследовател попита AI за липсващата част от изтъркан куплет. AI ​​придаде на прозодията подходящ, плавен, но напълно измислен завършек. Когато изследователят погледна бележките към изданието, той видя, че тази глава всъщност е различна. Капанът „AI попълва липсващия текст“ стана бетониран.

Случай 3 — Опростяване, изкривен смисъл. Редактор взе AI опростяване на куплет за диван; Тъй като AI преведе метафората (стереотипно изображение) буквално, първоначалното значение на куплета беше изгубено. Редакторът се консултира с полеви експерт и направи опростяване, което запази съдържанието.

Четири копируеми шаблона

1) Еквивалент на тежка дума (зависи от потвърждение):

Дайте СПИСЪК на днешните възможни еквиваленти на думите, утежнени в стария турски текст с латински букви отдолу. За всяка дума направете бележка „не е сигурно, трябва да се провери от речника“. Добавяне на думи, които не са в текста, допълване на текста. Текст: [поставете текст тук]

2) Опростяване с две версии:

Опростете следния текст по два начина: (1) близка версия, която запазва значението и изображенията, (2) таблица, показваща стария/новия еквивалент за всяка дума, която сте променили. Попълване на липсващите части, добавяне на смисъл, който не съществува. Маркирайте там, където не сте сигурни. Текст: [поставете текст]

3) Контрол на опростяването:

По-долу е действителният текст и моето опростяване. Маркирайте места, където значението е изкривено, пропуснато или неправилно представено в моята версия. Не налагайте своя собствена версия; просто посочете проблемните области и свържете разсъжденията си с текста. Оригинал: [...] Моята версия: [...]

4) Обяснение на сюжета/концепцията:

Обяснете класическите образи и метафори в следния куплет. За всеки: възможно значение, използване в традицията и забележка „трябва да бъде потвърдено от експертен източник“. Не правете окончателна преценка, посочете и алтернативни четения. Куплет: [напишете куплета]

Слаба подкана / Силна подкана

Слаб: "Преведете този османски текст на днешния турски."

Силно: „Опростете стария турски текст с латински букви по-долу; запазете изображенията и метафорите, не го свеждайте до буквално значение. Покажете всяка дума, която сте променили, в стара/нова таблица. Попълнете липсващата или двусмислена част; маркирайте я като „несигурно, трябва да се провери от експерт“. Не добавяйте думи или стихове, които не са в текста.“

Мощната подкана затваря капана за завършване, предотвратява загубата на съдържание и подканва таблица, която улеснява проверката. Слабата подкана оставя вратата отворена за AI ​​да се побере и изглади.

Таблица със задачи и сигурност

бизнес

AI сам

Правилна употреба

Значение на думата тежък в текст с латински букви

рисковано

Чернова + потвърждение на речника

транслитерация от арабски шрифт

не е направено

експерт филолог

Опростяване

проект

Експертни ремонти

Допълнете липсващия текст

Абсолютно не е направено

Издание/експерт

Обяснение

хипотеза

Потвърждение от експертен източник

научно издание

не е направено

филолог

Aruz и meter: Защо изкуственият интелект изпитва особени затруднения?

По-голямата част от класическата турска поезия е написана на аруз (система за измерване, базирана на дължината и краткостта на сричките, базирана на модели). Определянето в кой аруз модел е куплетът изисква дешифриране дали сричките са дълги или къси една по една и познаване на някои тънкости (като броене на една дълга сричка като две къси или изпускане на гласна). Това е редовна, но много фина работа и това е мястото, където AI често греши: може да назове погрешно модел, да измери погрешно сричка или да предложи модел, който „звучи добре“, но е грешен.

Следователно определянето на измервателния уред aruz не е работа, която може да се извърши сляпо от AI; В най-добрия случай дава "кандидат" и този кандидат трябва да бъде проверен на самия куплет от някой с познания по метъра. Същото важи и за анализа на спиранията и моделите в сричковия метър (фолклорен поетичен метър въз основа на броя на сричките във всеки ред); AI може дори да прави грешки при броенето на срички. Метърът е мястото, където се тества точността на литературния анализ: фалшивото твърдение за метър прави едно есе ненадеждно от самото начало.

Внимание: Не поставяйте име на прозодичен модел, дадено от AI ​​в изследване, без да го проверите (като „failatün failatün...“). Измерването е едновременно техническо и културно познание, а човешкият опит е незаменим в тази област. Използвайте AI най-много като ръководство за въпроса "къде да търся мярката на този куплет, какви модели са възможни?"

Често срещани грешки

  • Публикуване на транскрипция/опростяване без проверка. Всеки изход се сравнява с оригиналния текст.
  • Като AI ​​попълни липсващия текст. Това е измисляне на несъществуващ текст; Определено не се прави.
  • Да сведеш смисъла до буквален смисъл. Класическите образи трябва да се запазят.
  • Мислейки, че само четенето е сигурно. Множеството четения са често срещани в арабската писменост; Попитайте за алтернативи.
  • Завършване на критичен текст без консултация с експерт. Човешкият филолог е незаменим в тази област.

В обобщение

AI в стари текстове; Това е полезен, но високорисков инструмент за подпомагане на разбирането, лексикална хипотеза и опростено скициране. Задачи като преписване, редактиране и допълване на липсващи текстове принадлежат на експерта филолог. Проверете всяка разпечатка с оригиналния текст, надежден речник и актуални издания; Не попадайте в капаните на завършването и изглаждането. В тази област човешкият опит е преди скоростта.

Задача за приложение

Намерете кратък, неопростен древен текст с латински букви (стишие за диван или исторически параграф). Вземете чертежа от AI с шаблона „опростяване с две версии“. След това проверете всяка дума в таблицата с думи с надежден речник; Отбележете грешните. Проверете дали намалявате изображението до буквалното му значение и го коригирайте, ако е необходимо.

контролен списък

  • [ ] Нямах AI да направи транскрипцията на арабски скрипт самостоятелно.
  • [ ] Не попълних липсващата/двусмислената част.
  • [ ] Потвърдих еквивалента на думата от надежден речник.
  • [ ] Проверих дали изображенията и изображенията са запазени.
  • [ ] Консултирах се с филолога, който се занимава с критически текст.