Единици
1. Вовед во вештачката интелигенција во турскиот јазик и литература: улоги, граници, верификација, автентичност и етика 2. Анализа на текст и внимателно читање: анализа на поезија, расказ и роман со вештачка интелигенција 3. Лингвистика и анализа на корпус: Читање вокабулар со броеви 4. Антички текстови, поедноставување и транслитерација: Работа со отомански и дивански текстови 5. Материјали на курсот и наставен дизајн: исход, ефективност и мерење 6. Книжевна историја и истражување: Преглед на литература, синтеза и верификација 7. Уредување, лекторирање и типување: Подготовка на текстот за објавување 8. Соработка меѓу човекот и вештачката интелигенција во креативното пишување и продукција 9. Оценување на оригиналност, плагијат и текстови напишани со вештачка интелигенција 10. Потврда на изворот, халуцинација и дисциплина на атрибути 11. Човекот во книжевната интерпретација: естетски суд, етика, доверливост и граници
Единица 4 / 11

Антички текстови, поедноставување и транслитерација: Работа со отомански и дивански текстови

Добивки:

  • Знајте ја разликата помеѓу поедноставувањето и транскрипцијата и бидете во можност да користите ВИ само за ограничени, проверливи задачи (поддршка за разбирање, хипотеза на лексиката, нацрт за поедноставување).
  • Способност да се потврди секој излез со оригиналниот текст и сигурни извори, избегнувајќи замки како што се пополнување на текстот што недостасува и исправување на содржината
  • Да се биде способен да разбере дека човечкиот филолог е незаменлив во дела како што се транскрипција, прозодија и научно издание.

Голем дел од турската литература е напишана на јазик што денешните читатели не можат директно да го читаат: отомански турски (отомански турски - турски напишан со арапска азбука, користен за време на Отоманската империја, збогатен со арапски и персиски зборови и фрази). Повеќето од диванската поезија, историските книги, весниците и архивските документи се на овој јазик. За да се направат достапни за денешните читатели потребни се два процеса: транскрипција (преведување текст од една азбука во друга, зачувување на звуците со посебни знаци; на пример, менување на текстот со арапски букви во латиница) и поедноставување (замена на старите и тешки зборови од текстот со зборови што денешните читатели можат да ги разберат).

Во оваа единица ќе научиме да ја користиме вештачката интелигенција како помошник во овие задачи - но тука предупредувањето е посилно од кога и да било: во наследната текстуална работа, ризикот од грешки и халуцинации со вештачка интелигенција е многу висок; Секој излез не може да се користи без верификација од компетентно лице на терен со споредување со оригиналниот текст. Вештачката интелигенција може погрешно да прочита збор, да „заврши“ двојка, да направи значење што не постои. Овде вештачката интелигенција е алатка за преглед и дискусија; Никогаш нема да го замени стручниот филолог.

Зошто ризикот е поголем во оваа област?

Од три причини:

  1. Двосмислено читање. Во арапското писмо, кратките самогласки често не се пишуваат; Истата низа букви може да биде повеќе зборови. Правилното читање бара контекст и стручност. Вештачката интелигенција може да го претстави најверојатното предвидување како „сигурно“.
  2. Тежок речник. Суптилностите на арапско-персиските фрази, метафори (стереотипни слики во класичната поезија) и аруз (мерка врз основа на должината на слогот) во диванските текстови се изгубени или искривени во површно поедноставување.
  3. Тенденција за завршување. Вештачката интелигенција може автоматски да пополни текст што недостасува или истроши според тоа што „треба“ да биде. Ова е сериозна грешка во филологијата; е да се измисли текст кој не постои.
Внимание: Да се ​​каже на вештачката интелигенција да ја „преведе оваа османлиска двојка“ и да го објави излезот без да го потврди е најопасната грешка на теренот. Резултатите од транскрипцијата и поедноставувањето секогаш треба да се споредуваат со оригиналниот текст, сигурен речник и, ако е можно, постоечко издание (научна публикација).

Како безбедно да се користи вештачката интелигенција

Во постарите текстови, користете вештачка интелигенција за овие ограничени, но корисни задачи:

  • Поддршка за разбирање (главна): Учење на денешниот еквивалент на тешки зборови на текст со латински букви како нацрт.
  • Хипотеза за речник: Да се ​​има наведено можните значења на зборот - потоа потврдено со сигурен речник.
  • Нацрт за поедноставување: Земање груб нацрт на пасус на тековен турски - потоа да се побара од експертот да го ревидира.
  • Споредба: Споредување на вашето поедноставување со она на вештачката интелигенција и гледање на занемарените области.

Од друга страна, не дозволувајте вештачката интелигенција сама да ги извршува следните задачи: транслитерација од слика од арапско писмо; научно издание; пополнување на текстот што недостасува; тврдење за дефинитивно значење.

Совет: Побарајте две верзии на поедноставување: (1) блиско поедноставување што го зачувува значењето, (2) листа што објаснува еквиваленти на зборови. Втората листа му олеснува на експертот брзо да потврди и ги прави видливи измислените одговори на вештачката интелигенција.

три мини футроли

Случај 1 - Хипотезата за речникот заштеди време. Еден дипломиран студент доби нацрт еквивалент на 30 тешки зборови во историски текст со латински букви од AI. 30 еквивалентни потврдени од сигурен речник; 4 беа погрешни и се поправени. Времето на прелистување речник беше значително скратено, но чекорот за верификација не беше прескокнат.

Случај 2 - Уловена грешка при завршување. Истражувач ја праша вештачката интелигенција за исчезнатиот дел од истрошениот куплет. Вештачката интелигенција ѝ даде на прозодијата соодветно, течно, но целосно измислено комплетирање. Кога истражувачот ги погледнал белешките од изданието, видел дека ова поглавје е всушност различно. Замката „ВИ го пополнува текстот што недостасува“ стана конкретна.

Случај 3 - Поедноставување искривено значење. Еден уредник зеде поедноставување со вештачка интелигенција на дивански куплет; Бидејќи вештачката интелигенција буквално ја преведе метафората (стереотипната слика), првобитното значење на двојката беше изгубено. Уредникот се консултирал со теренски експерт и направил поедноставување со кое ја зачувал содржината.

Четири шаблони за копирање

1) Еквивалент на тежок збор (условно со потврда):

Наведете ЛИСТА на денешните можни еквиваленти на зборовите отежнати во стариот турски текст со латинични букви подолу. За секој збор, забележете „не е сигурно, треба да се потврди од речникот“. Додавање зборови што ги нема во текстот, комплетирање на текстот. Текст: [залепете го текстот овде]

2) Поедноставување со две верзии:

Поедноставете го следниов текст на два начина: (1) блиска верзија што ги зачувува значењето и сликите, (2) табела што го прикажува стариот/новиот еквивалент за секој збор што сте го промениле. Пополнување на деловите што недостасуваат, додавање на значење што не постои. Означете каде не сте сигурни. Текст: [залепете текст]

3) Контрола на поедноставување:

Подолу е вистинскиот текст и моето поедноставување. Обележете ги местата каде што значењето е искривено, испуштено или погрешно претставено во мојата верзија. Не наметнувајте своја сопствена верзија; само посочете ги проблематичните области и поврзете го вашето размислување со текстот. Оригинал: [...] Мојата верзија: [...]

4) Објаснување на заплетот/концептот:

Објасни ги класичните слики и метафори во следниот куплет. За секој од нив: можното значење, употребата во традицијата и забелешката „мора да се потврди од експертски извор“. Не донесувајте дефинитивен суд, наведете и алтернативни читања.

Слаб промпт / Силен промпт

Слаб: „Преведи го овој османлиски текст на денешниот турски јазик“.

Силно: „Поедноставете го стариот турски текст со латински букви подолу; зачувајте ги сликите и метафорите, не сведувајте го на буквално значење. Прикажете го секој збор што сте го промениле во стара/нова табела. Дополнете го делот што недостасува или двосмислениот дел; означете го како „неизвесен, мора да биде потврден од експерт“. Не додавајте зборови или стихови што ги нема во текстот“.

Моќното известување ја затвора замката за завршување, спречува губење на содржината и поттикнува табела што ја олеснува проверката. Слабиот сигнал ја остава вратата отворена за вештачката интелигенција да се вклопи и измазнува.

Табела за задачи и безбедност

бизнис

Сама вештачка интелигенција

Правилна употреба

Значењето на зборот тежок во текстот на латинска буква

ризично

Нацрт + потврда за речник

транслитерација од арапско писмо

не е направено

стручен филолог

Поедноставување

нацрт

Експертски ремонти

Комплетирајте го текстот што недостасува

Апсолутно не е направено

Издание/експерт

Објаснување

хипотеза

Потврда од експертски извор

научно издание

не е направено

филолог

Аруз и метар: Зошто вештачката интелигенција има посебни тешкотии?

Поголемиот дел од класичната турска поезија е напишана во аруз (систем на мерење заснован на должината и кратката на слогови, врз основа на обрасци). Определувањето на кој образец на аруз е двојката бара да се дешифрира дали слоговите се долги или кратки еден по еден и да се знаат некои суптилности (како броење на еден долг слог како два кратки или испуштање самогласка). Ова е редовна, но многу суптилна работа, и тука често ВИ греши: може погрешно да именува шема, погрешно да измери слог или да предложи шема што „звучи добро“, но не е во ред.

Затоа, одредувањето на аруз-метар не е работа што може слепо да ја врши вештачката интелигенција; Во најдобар случај дава „кандидат“, а овој кандидат мора да биде верификуван на самиот куплет од некој со познавање на мерачот. Истото важи и за анализата на запирањата и обрасците во слоговно метар (метар на народната поезија врз основа на бројот на слогови во секој ред); Вештачката интелигенција може дури и да направи грешки при броењето на слогови. Мерачот е местото каде што се тестира точноста на книжевната анализа: лажното тврдење за мерачот го прави есејот несигурен од самиот почеток.

Внимание: Не ставајте име на прозодична шема дадена од вештачката интелигенција во студија без да ја потврдите (како што е „failatün failatün...“). Мерењето е и техничко и културно знаење, а човечката експертиза е неопходна на ова поле. Користете вештачка интелигенција најмногу како водич за прашањето „Каде треба да ја барам мерката на оваа двојка, какви модели се можни?

Вообичаени грешки

  • Објавување на транскрипцијата/поедноставување без да се потврди. Секој излез се споредува со оригиналниот текст.
  • Имајќи ја вештачката интелигенција да го пополни текстот што недостасува. Ова е измислување непостоечки текст; Дефинитивно не е направено.
  • Да се ​​сведе значењето на буквално значење. Мора да се зачуваат класичните слики.
  • Мислејќи дека само читањето е сигурно. Повеќекратните читања се вообичаени во арапското писмо; Прашајте за алтернативи.
  • Заклучување критички текст без консултација со експерт. Човечкиот филолог е незаменлив на ова поле.

Сумирано

ВИ во стари текстови; Тоа е корисна, но високоризична алатка за поддршка за разбирање, лексичка хипотеза и поедноставување на скицирање. Задачите како што се транскрипција, издание и пополнување на текстови кои недостасуваат му припаѓаат на стручниот филолог. Потврдете го секој отпечаток со оригиналниот текст, сигурен речник и тековните изданија; Не паѓајте во замките на довршување и израмнување. На ова поле, човечката експертиза е пред брзината.

Задача за апликација

Најдете краток, неспроведен антички текст со латински букви (дивански куплет или историски параграф). Добијте го нацртот од вештачката интелигенција со шаблонот „поедноставување со две верзии“. Потоа проверете го секој збор во табелата со зборови со сигурен речник; Штиклирајте ги погрешните. Проверете дали ја сведувате сликата на нејзиното буквално значење и поправете ја доколку е потребно.

листа за проверка

  • [ ] Немав вештачка интелигенција сама да ја прави транскрипцијата на арапското писмо.
  • [ ] Не го пополнив делот што недостасува/двосмислениот дел.
  • [ ] Ги потврдив еквивалентите на зборовите од сигурен речник.
  • [ ] Проверив дали сликите и сликите се зачувани.
  • [ ] Се консултирав со филологот кој е специјализиран за критички текст.