Vahid 4 / 11

Qədim Mətnlər, Sadələşdirmə və Transliterasiya: Osmanlı və Divan Mətnləri ilə İş

Qazanclar:

  • Sadələşdirmə və transkripsiya arasındakı fərqi bilin və süni intellektdən yalnız məhdud, yoxlanıla bilən tapşırıqlar üçün istifadə edə bilərsiniz (anlama dəstəyi, leksikon hipotezi, sadələşdirmə layihəsi).
  • Hər bir çıxışı orijinal mətn və etibarlı mənbələrlə yoxlamaq, çatışmayan mətni tamamlamaq və məzmunu düzəltmək kimi tələlərdən qaçmaq bacarığı
  • Transkripsiya, prosodiya, elmi nəşr kimi əsərlərdə insan filoloqunun vazkeçilməz olduğunu anlaya bilmək.

Türk ədəbiyyatının böyük bir hissəsi indiki oxucuların birbaşa oxuya bilmədiyi dildə yazılmışdır: Osmanlı türkcəsi (Osmanlı türkcəsi - ərəb əlifbası ilə yazılmış, Osmanlı imperiyası dövründə istifadə edilən, ərəb və fars söz və birləşmələri ilə zənginləşdirilmiş türkcə). Divan şeirlərinin, tarix kitablarının, qəzetlərin, arxiv sənədlərinin çoxu bu dildədir. Onların bugünkü oxucuların ixtiyarına verilməsi iki proses tələb edir: transkripsiya (mətnin bir əlifbadan digər əlifbaya tərcüməsi, səslərin xüsusi işarələrlə qorunması; məsələn, ərəb hərfləri ilə yazılmış mətnin latın hərflərinə dəyişdirilməsi) və sadələşdirmə (mətnin köhnə və ağır sözlərini bugünkü oxucunun başa düşəcəyi sözlərlə əvəz etmək).

Bu bölmədə biz süni intellektdən bu tapşırıqlarda köməkçi kimi istifadə etməyi öyrənəcəyik — lakin burada xəbərdarlıq həmişəkindən daha güclüdür: Köhnə mətn işində AI xətaları və hallüsinasiya riski çox yüksəkdir; Hər bir çıxış, bu sahədə səlahiyyətli şəxs tərəfindən orijinal mətnlə müqayisə edilərək yoxlanılmadan istifadə edilə bilməz. Süni intellekt bir sözü səhv oxuya, bir kupeti “tamamlaya”, mövcud olmayan bir məna yarada bilər. Burada AI kontur və müzakirə vasitəsidir; O, heç vaxt ekspert filoloqu əvəz etməyəcək.

Niyə bu sahədə risk daha yüksəkdir?

Üç səbəbə görə:

  1. Qeyri-müəyyən oxu. Ərəb qrafikasında qısa saitlər çox vaxt yazılmır; Eyni hərf silsiləsi bir neçə söz ola bilər. Düzgün oxumaq kontekst və təcrübə tələb edir. Süni intellekt ən çox ehtimal olunan proqnozu “əmin” kimi təqdim edə bilər.
  2. Ağır söz ehtiyatı. Divan mətnlərində ərəb-fars ifadələrinin, metaforaların (klassik poeziyada stereotipləşdirilmiş obrazlar) və əruzun (heca uzunluğuna görə ölçü) incəlikləri səthi sadələşdirmədə itirilir və ya təhrif edilir.
  3. Tamamlama meyli. Süni intellekt çatışmayan və ya köhnəlmiş mətni "olmalı"sına uyğun olaraq avtomatik doldura bilər. Bu, filologiyada böyük bir səhvdir; mövcud olmayan mətni düzəltməkdir.
Diqqət: Süni intellektə "bu Osmanlı beytini tərcümə edin" demək və onu yoxlamadan çıxışı dərc etmək bu sahədə ən təhlükəli səhvdir. Transkripsiya və sadələşdirmə nəticələri həmişə orijinal mətn, etibarlı lüğət və mümkünsə, mövcud nəşr (elmi nəşr) ilə müqayisə edilməlidir.

AI-dən necə təhlükəsiz istifadə etmək olar

Köhnə mətnlərdə bu məhdud, lakin faydalı tapşırıqlar üçün AI-dan istifadə edin:

  • Anlama (məhz) dəstəyi: Latın hərfləri ilə mətnin ağır sözlərinin bugünkü ekvivalentini qaralama kimi öyrənmək.
  • Lüğət fərziyyəsi: Sadalanan bir sözün mümkün mənalarına sahib olmaq - sonra etibarlı lüğətə qarşı yoxlanılır.
  • Sadələşdirmə layihəsi: Mövcud türk dilində bir bəndin təxmini layihəsinin götürülməsi – sonra ekspertin ona yenidən baxılması.
  • Müqayisə: Sadələşdirmənizi AI ilə müqayisə edin və diqqətdən kənarda qalan sahələri görən.

Digər tərəfdən, AI-nin yalnız aşağıdakı vəzifələri yerinə yetirməsinə icazə verməyin: ərəb qrafikalı təsvirdən transliterasiya; elmi nəşr; çatışmayan mətnin tamamlanması; qəti məna iddiası.

İpucu: Sadələşdirmənin iki variantını soruşun: (1) mənasını qoruyan sadələşdirməni bağlayın, (2) söz ekvivalentlərini izah edən siyahı. İkinci siyahı ekspertin tez təsdiqlənməsini asanlaşdırır və süni intellektin uydurulmuş cavablarını görünən edir.

üç mini qutu

Case 1 — Lüğət fərziyyəsi vaxta qənaət etdi. Bir aspirant AI-dən latın hərfləri ilə tarix mətnində 30 ağır sözə ekvivalent qaralama aldı. Etibarlı lüğətdən təsdiqlənmiş 30 ekvivalent; 4 səhv idi və düzəldildi. Lüğətə baxış vaxtı əhəmiyyətli dərəcədə qısaldıldı, lakin doğrulama addımı atlanmadı.

Case 2 - Tamamlama xətası tutuldu. Bir tədqiqatçı süni intellektdən köhnəlmiş bir kupletin çatışmayan hissəsi barədə soruşdu. AI prosodiyaya uyğun, səlis, lakin tamamilə uydurulmuş bir tamamlama verdi. Tədqiqatçı nəşr qeydlərinə baxdıqda bu fəslin əslində fərqli olduğunu gördü. “Əskik mətni süni intellekt doldurur” tələsi konkretləşib.

3-cü hal – Sadələşdirmə təhrif olunmuş məna. Redaktor divan kupletinin süni intellektlə sadələşdirilməsini götürdü; Süni intellekt metaforanı (stereotipləşdirilmiş təsviri) hərfi tərcümə etdiyi üçün kupletin ilkin mənası itirdi. Redaktor sahə eksperti ilə məsləhətləşdi və məzmunu qoruyub saxlayan sadələşdirmə apardı.

Dörd kopyalana bilən şablon

1) Ağır söz ekvivalenti (təsdiqlə bağlı şərt):

Köhnə türkcə mətndə latın hərfləri ilə ağırlaşdırılmış sözlərin bugünkü mümkün qarşılıqlarının SİYAHISINI aşağıda verin. Hər bir söz üçün "müəyyən deyiləm, lüğətdən təsdiq edilməlidir" qeyd edin. Mətndə olmayan sözlərin əlavə edilməsi, mətnin tamamlanması. Mətn: [mətni bura yapışdırın]

2) İki versiyalı sadələşdirmə:

Aşağıdakı mətni iki yolla sadələşdirin: (1) məna və təsviri saxlayan yaxın versiya, (2) dəyişdirdiyiniz hər bir söz üçün köhnə/yeni ekvivalenti göstərən cədvəl. Çatışmayan hissələrin doldurulması, mövcud olmayan mənaların əlavə edilməsi. Əmin olmadığınız yeri qeyd edin. Mətn: [mətni yapışdırın]

3) Sadələşdirmə nəzarəti:

Aşağıda faktiki mətn və mənim sadələşdirməm var. Mənim versiyamda mənanın təhrif edildiyi, buraxılmadığı və ya təhrif edildiyi yerləri qeyd edin. Öz versiyanızı tətbiq etməyin; sadəcə problemli sahələri göstərin və əsaslandırmanızı mətnlə əlaqələndirin. Orijinal: [...] Mənim versiyam: [...]

4) Süjet/konsepsiya izahı:

Aşağıdakı qoşmada klassik obraz və metaforaları izah edin. Hər biri üçün: mümkün məna, ənənədə istifadə və qeyd "ekspert mənbədən yoxlanılmalıdır". Qəti mühakimə yürütməyin, alternativ oxunuşları da qeyd edin.

Zəif məlumat / Güclü göstəriş

Zəif: “Bu Osmanlı mətnini bugünkü türkcəyə çevirin”.

Güclü: "Aşağıdakı köhnə türkcə mətni latın hərfləri ilə sadələşdirin; şəkilləri və metaforaları qoruyun, hərfi mənaya salmayın. Dəyişdirdiyiniz hər sözü köhnə/yeni cədvəldə göstərin. Çatışmayan və ya çoxmənalı olan hissəni tamamlayın; "Qeyri-müəyyən, ekspert tərəfindən yoxlanılmalıdır" kimi qeyd edin. Mətndə olmayan söz və ya misra əlavə etməyin."

Güclü sorğu tamamlama tələsini bağlayır, məzmun itkisinin qarşısını alır və yoxlamanı asanlaşdıran cədvəli təklif edir. Zəif əmr, AI-nin uyğunlaşması və hamarlanması üçün qapını açıq qoyur.

Tapşırıq və təhlükəsizlik cədvəli

biznes

Tək AI

Düzgün istifadə

Latın hərfi mətnində ağır sözünün mənası

riskli

Qaralama + lüğət təsdiqi

ərəb qrafikasından transliterasiya

edilməmişdir

ekspert filoloq

Sadələşdirmə

qaralama

Ekspert əsaslı təmir

Çatışmayan mətni tamamlayın

Tamamilə edilməyib

Nəşr/ekspert

İzahat

fərziyyə

Ekspert mənbədən təsdiq

elmi nəşri

edilməmişdir

filoloq

Aruz və metr: Süni intellekt niyə xüsusi çətinlik çəkir?

Klassik türk poeziyasının çox hissəsi aruzla (hecaların uzun və qısalığına əsaslanan, naxışlara əsaslanan ölçü sistemi) yazılmışdır. Bir qoşmanın hansı əruz qəlibində olduğunu müəyyən etmək üçün hecaların uzun və ya qısa olduğunu tək-tək deşifrə etmək, bəzi incəlikləri bilmək (məsələn, bir uzun hecanı iki qısa saymaq və ya saiti endirmək) lazımdır. Bu, müntəzəm, lakin çox incə bir işdir və AI-nin tez-tez səhv etdiyi yer budur: nümunəni səhv adlandıra, hecanı səhv ölçə və ya "yaxşı səslənən", lakin səhv olan nümunə təklif edə bilər.

Odur ki, əruz sayğacının müəyyən edilməsi AI-nin kor-koranə görəcəyi iş deyil; Ən yaxşı halda “namizəd” verir və bu namizədi kupletin özündə sayğacdan xəbəri olan biri yoxlamalıdır. Eyni şey heca sayında dayanma və naxışların təhlilinə də aiddir (hər sətirdəki hecaların sayına görə xalq şeiri sayğacı); Süni intellekt hecaları sayarkən belə səhv edə bilər. Sayğac ədəbi təhlilin düzgünlüyünün yoxlanıldığı yerdir: sayğacla bağlı yalan iddia esseni əvvəldən etibarsız edir.

Diqqət: Süni intellekt tərəfindən verilən prosodik nümunə adını yoxlamadan araşdırmaya daxil etməyin (“failatün failatün...” kimi). Ölçmə həm texniki, həm də mədəni bilikdir və insan təcrübəsi bu sahədə əvəzolunmazdır. “Bu kupletin ölçüsünü harada axtarmaq lazımdır, hansı nümunələr mümkündür?” sualına ən çox AI-dan bələdçi kimi istifadə edin.

Ümumi səhvlər

  • Transkripsiyanı/sadələşdirməni təsdiq etmədən dərc etmək. Hər bir çıxış orijinal mətnlə müqayisə edilir.
  • AI-nin çatışmayan mətni doldurması. Bu, mövcud olmayan mətni təşkil edir; Mütləq edilmir.
  • Mənanı hərfi mənaya endirmək. Klassik şəkillər qorunmalıdır.
  • Yalnız oxumağın əmin olduğunu düşünmək. Ərəb qrafikasında çoxlu oxunuşlara rast gəlinir; Alternativlər haqqında soruşun.
  • Ekspertlə məsləhətləşmədən tənqidi mətni yekunlaşdırmaq. İnsan filoloqu bu sahədə əvəzolunmazdır.

Xülasə

köhnə mətnlərdə AI; Anlama dəstəyi, leksik fərziyyə və sadələşdirmə eskizləri üçün faydalı, lakin yüksək riskli vasitədir. Çatışmayan mətnlərin transkripsiyası, nəşri və tamamlanması kimi vəzifələr ekspert filoloqa aiddir. Hər çapı orijinal mətn, etibarlı lüğət və cari nəşrlərlə yoxlayın; Tamamlama və yastılaşma tələlərinə düşməyin. Bu sahədə insan təcrübəsi sürətdən əvvəl gəlir.

Tətbiq tapşırığı

Latın hərfləri ilə yazılmış qısa, sadələşdirilməmiş qədim mətni tapın (divan qoşması və ya tarix paraqrafı). “İki versiyalı sadələşdirmə” şablonu ilə süni intellektdən plan əldə edin. Sonra söz cədvəlindəki hər bir sözü etibarlı lüğətlə yoxlayın; Səhv olanları işarələyin. Şəkli hərfi mənasına endirdiyinizi yoxlayın və lazım olduqda onu düzəldin.

yoxlama siyahısı

  • [ ] Məndə ərəb qrafikası transkripsiyasını təkbaşına edən AI yox idi.
  • [ ] Mən çatışmayan/müəyyən olan hissəni doldurmadım.
  • [ ] Mən sözün ekvivalentlərini etibarlı lüğətdən təsdiqlədim.
  • [ ] Şəkillərin və şəkillərin qorunub saxlandığını yoxladım.
  • [ ] Mən tənqidi mətn üzrə ixtisaslaşmış filoloqla məsləhətləşdim.