Unit 4 / 11

Teks Purba, Penyederhanaan dan Transliterasi: Bekerja dengan Teks Uthmaniyyah dan Divan

Keuntungan:

  • Ketahui perbezaan antara penyederhanaan dan transkripsi dan boleh menggunakan AI hanya untuk tugasan yang terhad dan boleh disahkan (sokongan pemahaman, hipotesis leksikon, draf penyederhanaan).
  • Keupayaan untuk mengesahkan setiap output dengan teks asal dan sumber yang boleh dipercayai, mengelakkan perangkap seperti melengkapkan teks yang hilang dan meluruskan kandungan
  • Mampu memahami bahawa ahli filologi manusia amat diperlukan dalam karya seperti transkripsi, prosodi dan edisi saintifik.

Sebahagian besar kesusasteraan Turki ditulis dalam bahasa yang tidak dapat dibaca oleh pembaca hari ini secara langsung: Turki Uthmaniyyah (Turki Uthmaniyyah - Turki ditulis dalam abjad Arab, digunakan semasa Empayar Uthmaniyyah, diperkaya dengan perkataan dan frasa Arab dan Parsi). Kebanyakan puisi Divan, buku sejarah, surat khabar dan dokumen arkib adalah dalam bahasa ini. Untuk menyediakannya kepada pembaca hari ini memerlukan dua proses: transkripsi (menerjemahkan teks daripada satu abjad ke abjad lain, mengekalkan bunyi dengan tanda khas; contohnya, menukar teks dalam huruf Arab kepada huruf Latin) dan penyederhanaan (menggantikan perkataan lama dan berat teks dengan perkataan yang boleh difahami oleh pembaca hari ini).

Dalam unit ini kita akan belajar menggunakan AI sebagai pembantu dalam tugasan ini — tetapi di sini amarannya lebih kuat berbanding sebelum ini: Dalam kerja teks lama, risiko ralat AI dan halusinasi adalah sangat tinggi; Setiap output tidak boleh digunakan tanpa pengesahan oleh orang yang kompeten di lapangan dengan membandingkannya dengan teks asal. AI boleh salah membaca perkataan, "melengkapkan" bait, membentuk makna yang tidak wujud. Di sini AI ialah garis besar dan alat perbincangan; Ia tidak akan menggantikan ahli filologi pakar.

Mengapakah risiko lebih tinggi di kawasan ini?

Atas tiga sebab:

  1. Bacaan ambik. Dalam tulisan Arab, vokal pendek selalunya tidak ditulis; Rentetan huruf yang sama boleh terdiri daripada berbilang perkataan. Pembacaan yang betul memerlukan konteks dan kepakaran. AI boleh membentangkan ramalan yang paling mungkin sebagai "pasti."
  2. Perbendaharaan kata yang berat. Kehalusan frasa Arab-Parsi, metafora (imej stereotaip dalam puisi klasik) dan aruz (ukuran berdasarkan panjang suku kata) dalam teks Divan hilang atau diherotkan dalam penyederhanaan dangkal.
  3. Kecenderungan untuk menyelesaikan. AI secara automatik boleh mengisi teks yang hilang atau usang mengikut apa yang "sepatutnya". Ini adalah kesilapan besar dalam filologi; adalah untuk membuat teks yang tidak wujud.
Perhatian: Memberitahu AI untuk "terjemahkan kutipan Uthmaniyyah ini" dan menerbitkan output tanpa mengesahkannya adalah kesilapan paling berbahaya dalam bidang ini. Keluaran transkripsi dan penyederhanaan hendaklah sentiasa dibandingkan dengan teks asal, kamus yang boleh dipercayai dan, jika boleh, edisi sedia ada (penerbitan ilmiah).

Cara menggunakan AI dengan selamat

Dalam teks lama, gunakan AI untuk tugasan terhad tetapi berguna ini:

  • Sokongan kefahaman (intisari): Mempelajari padanan hari ini perkataan berat teks dalam huruf Latin sebagai draf.
  • Hipotesis kamus: Mempunyai kemungkinan makna perkataan yang disenaraikan — kemudian disahkan terhadap kamus yang boleh dipercayai.
  • Draf pemudahan: Mengambil draf kasar perenggan dalam bahasa Turki semasa — kemudian meminta pakar menyemaknya.
  • Perbandingan: Membandingkan pemudahan anda dengan AI dan melihat kawasan yang diabaikan.

Sebaliknya, jangan biarkan AI melakukan tugas berikut sendirian: transliterasi daripada imej tulisan Arab; edisi saintifik; penyiapan teks yang hilang; menuntut makna yang muktamad.

Petua: Minta dua versi penyederhanaan: (1) penyederhanaan rapat yang mengekalkan makna, (2) senarai yang menerangkan padanan perkataan. Senarai kedua memudahkan pakar untuk mengesahkan dengan cepat dan menjadikan respons rekaan AI kelihatan.

tiga kes mini

Kes 1 — Hipotesis kamus menjimatkan masa. Seorang pelajar siswazah menerima draf bersamaan 30 perkataan berat dalam teks sejarah dalam huruf Latin daripada AI. 30 setara disahkan daripada kamus yang boleh dipercayai; 4 adalah salah dan telah diperbetulkan. Masa menyemak imbas kamus telah dipendekkan dengan ketara, tetapi langkah pengesahan tidak dilangkau.

Kes 2 — Ralat penyiapan ditangkap. Seorang penyelidik bertanya kepada AI tentang bahagian yang hilang pada bait yang usang. AI ​​memberikan prosodi penyelesaian yang sesuai, lancar, tetapi direka sepenuhnya. Apabila pengkaji melihat nota edisi, dia melihat bahawa bab ini sebenarnya berbeza. Perangkap "AI mengisi teks yang hilang" telah menjadi konkrit.

Kes 3 — Penyederhanaan makna terpesong. Seorang editor mengambil penyederhanaan AI bagi kuplet divan; Memandangkan AI menterjemah metafora (imej stereotaip) secara literal, makna asal kuplet telah hilang. Editor berunding dengan pakar bidang dan membuat penyederhanaan yang mengekalkan kandungan.

Empat templat yang boleh disalin

1) Setara perkataan berat (bersyarat pada pengesahan):

Berikan SENARAI kemungkinan padanan hari ini bagi perkataan yang diburukkan dalam teks Turki lama dengan huruf Latin di bawah. Untuk setiap perkataan, buat nota "tidak pasti, harus disahkan daripada kamus". Menambah perkataan yang tiada dalam teks, melengkapkan teks.Teks: [tampal teks di sini]

2) Penyederhanaan dua versi:

Permudahkan teks berikut dalam dua cara: (1) versi rapat yang mengekalkan makna dan imejan, (2) jadual yang menunjukkan padanan lama/baharu untuk setiap perkataan yang anda ubah. Mengisi bahagian yang hilang, menambah makna yang tidak wujud. Tandai di mana anda tidak pasti.Teks: [tampal teks]

3) Kawalan penyederhanaan:

Di bawah ialah teks sebenar dan pemudahan saya. Tandai tempat yang maknanya diputarbelitkan, ditinggalkan atau disalah nyatakan dalam versi saya. Jangan mengenakan versi anda sendiri; hanya tunjukkan kawasan yang bermasalah dan hubungkan penaakulan anda kepada teks. Asal: [...] Versi saya: [...]

4) Penjelasan plot/konsep:

Terangkan imej dan metafora klasik dalam kuplet berikut. Untuk setiap: kemungkinan makna, penggunaan dalam tradisi, dan nota "mesti disahkan daripada sumber pakar". Jangan membuat pertimbangan muktamad, nyatakan juga bacaan alternatif. Couplet: [tuliskan kuplet]

Gesaan lemah / Gesaan kuat

Lemah: "Terjemah teks Uthmaniyyah ini ke dalam bahasa Turki hari ini."

Kuat: "Ringkaskan teks Turki lama dengan huruf Latin di bawah; pelihara imej dan metafora, jangan kurangkan kepada makna literal. Tunjukkan setiap perkataan yang telah anda ubah dalam jadual lama/baru. Lengkapkan bahagian yang hilang atau samar-samar; tandakannya sebagai 'tidak pasti, mesti disahkan oleh pakar'. Jangan tambah sebarang perkataan atau ayat yang tiada dalam teks."

Gesaan kuat menutup perangkap penyiapan, menghalang kehilangan kandungan dan menggesa jadual yang memudahkan pengesahan. Gesaan yang lemah membiarkan pintu terbuka untuk AI muat dan lancar.

Meja tugas dan keselamatan

perniagaan

AI sahaja

Penggunaan yang betul

Maksud perkataan berat dalam teks huruf Latin

berisiko

Draf + pengesahan kamus

alih huruf daripada tulisan Arab

belum selesai

ahli filologi

Penyederhanaan

draf

Baik pulih pakar

Lengkapkan teks yang hilang

Sama sekali tidak dilakukan

Edisi/pakar

Penjelasan

hipotesis

Pengesahan daripada sumber pakar

edisi ilmiah

belum selesai

ahli filologi

Aruz dan meter: Mengapa AI mempunyai kesukaran tertentu?

Kebanyakan puisi Turki klasik ditulis dalam aruz (sistem ukuran berdasarkan panjang dan pendek suku kata, berdasarkan corak). Menentukan corak aruz yang terdapat pada sesuatu gandingan memerlukan pentafsiran sama ada suku kata itu panjang atau pendek satu demi satu, dan mengetahui beberapa kehalusan (seperti mengira satu suku kata panjang sebagai dua suku kata pendek atau menjatuhkan vokal). Ini adalah kerja biasa tetapi sangat halus, dan di sinilah AI sering menjadi salah: ia boleh salah menamakan corak, salah mengukur suku kata, atau mencadangkan corak yang "kedengarannya bagus" tetapi salah.

Oleh itu, menentukan meter aruz bukanlah kerja yang boleh dilakukan secara membuta tuli oleh AI; Paling baik ia memberikan "calon", dan calon ini mesti disahkan pada kuplet itu sendiri oleh seseorang yang mempunyai pengetahuan tentang meter. Begitu juga dengan analisis hentian dan pola dalam meter suku kata (meter puisi rakyat berdasarkan bilangan suku kata dalam setiap baris); AI juga boleh membuat kesilapan dalam mengira suku kata. Meter ialah tempat di mana ketepatan analisis sastera diuji: tuntutan palsu terhadap meter menjadikan esei tidak boleh dipercayai dari awal.

Awas: Jangan letakkan nama pola prosodik yang diberikan oleh AI ke dalam kajian tanpa mengesahkannya (seperti "failatün failatün..."). Pengukuran adalah pengetahuan teknikal dan budaya, dan kepakaran manusia amat diperlukan dalam bidang ini. Gunakan AI paling banyak sebagai panduan kepada soalan "di manakah saya harus mencari ukuran kuplet ini, apakah corak yang mungkin?"

Kesilapan biasa

  • Menerbitkan transkripsi/pemudahan tanpa mengesahkannya. Setiap output dibandingkan dengan teks asal.
  • Mempunyai AI mengisi teks yang hilang. Ini membentuk teks yang tidak wujud; Ia pasti tidak dilakukan.
  • Untuk mengurangkan makna kepada makna literal. Imej klasik mesti dikekalkan.
  • Berfikir bahawa hanya membaca adalah pasti. Bacaan berbilang adalah biasa dalam tulisan Arab; Tanya tentang alternatif.
  • Menyimpulkan teks kritikal tanpa berunding dengan pakar. Ahli filologi manusia sangat diperlukan dalam bidang ini.

Secara ringkasnya

AI dalam teks lama; Ia adalah alat yang berguna tetapi berisiko tinggi untuk sokongan pemahaman, hipotesis leksikal dan lakaran penyederhanaan. Tugas seperti transkripsi, edisi dan penyiapan teks yang hilang adalah milik ahli filologi pakar. Sahkan setiap cetakan dengan teks asal, kamus yang boleh dipercayai dan edisi semasa; Jangan jatuh ke dalam perangkap penyiapan dan meratakan. Dalam bidang ini, kepakaran manusia diutamakan sebelum kepantasan.

Tugasan permohonan

Cari teks purba yang pendek dan tidak mudah dalam huruf Latin (gandingan divan atau perenggan sejarah). Dapatkan pelan tindakan daripada AI dengan templat "pemudahan dua versi". Kemudian sahkan setiap perkataan dalam jadual perkataan dengan kamus yang boleh dipercayai; Tandakan yang salah. Semak sama ada anda mengurangkan imej kepada makna literalnya dan betulkan jika perlu.

senarai semak

  • [ ] Saya tidak mempunyai AI melakukan transkripsi skrip Arab sendiri.
  • [ ] Saya tidak mengisi bahagian yang hilang/samar-samar.
  • [ ] Saya mengesahkan perkataan yang setara daripada kamus yang boleh dipercayai.
  • [ ] Saya telah menyemak sama ada imej dan imej itu dipelihara.
  • [ ] Saya berunding dengan ahli filologi yang pakar dalam teks kritikal.