Jedinica 4 / 11

Drevni tekstovi, pojednostavljenje i transliteracija: rad s osmanskim i divanskim tekstovima

Dobici:

  • Znati razliku između pojednostavljenja i transkripcije i moći koristiti AI samo za ograničene zadatke koji se mogu provjeriti (podrška razumijevanju, hipoteza leksikona, nacrt pojednostavljenja).
  • Sposobnost provjere svakog izlaza s izvornim tekstom i pouzdanim izvorima, izbjegavajući zamke kao što je dovršavanje teksta koji nedostaje i ispravljanje sadržaja
  • Biti u stanju razumjeti da je ljudski filolog neophodan u djelima kao što su transkripcija, prozodija i znanstveno izdanje.

Veliki dio turske književnosti napisan je na jeziku koji današnji čitatelji ne mogu direktno čitati: osmanski turski (osmanski turski - turski napisan arapskim pismom, korišten za vrijeme Osmanskog carstva, obogaćen arapskim i perzijskim riječima i frazama). Većina divanske poezije, povijesnih knjiga, novina i arhivskih dokumenata je na ovom jeziku. Za njihovu dostupnost današnjim čitateljima potrebna su dva procesa: transkripcija (prevođenje teksta s jedne abecede na drugu, uz očuvanje zvukova posebnim znakovima; npr. zamjena teksta arapskih slova latiničnim slovima) i pojednostavljenje (zamjena starih i teških riječi teksta riječima koje današnji čitatelji mogu razumjeti).

U ovoj jedinici naučit ćemo koristiti umjetnu inteligenciju kao pomoćnika u ovim zadacima — ali ovdje je upozorenje jače nego ikad: u radu s naslijeđenim tekstom, rizik od pogrešaka umjetne inteligencije i halucinacija je vrlo visok; Svaki izlaz ne može se koristiti bez provjere od strane stručne osobe usporedbom s izvornim tekstom. Umjetna inteligencija može pogrešno pročitati riječ, "dovršiti" dvostih, smisliti značenje koje ne postoji. Ovdje je umjetna inteligencija alat za pregled i raspravu; Nikada neće zamijeniti stručnjaka filologa.

Zašto je rizik veći u ovom području?

Iz tri razloga:

  1. Dvosmisleno čitanje. U arapskom pismu kratki se samoglasnici često ne pišu; Isti niz slova može biti više riječi. Ispravno čitanje zahtijeva kontekst i stručnost. AI može prikazati najvjerojatnije predviđanje kao "sigurno".
  2. Težak vokabular. Suptilnosti arapsko-perzijskih fraza, metafora (stereotipne slike u klasičnoj poeziji) i aruz (mjera temeljena na duljini sloga) u tekstovima Divana izgubljene su ili iskrivljene u površnom pojednostavljenju.
  3. Sklonost dovršetku. AI može automatski popuniti nedostajući ili istrošeni tekst u skladu s onim što "treba" biti. Ovo je teška pogreška u filologiji; je izmisliti tekst koji ne postoji.
Pažnja: Reći umjetnoj inteligenciji da "prevede ovaj otomanski dvostih" i objaviti izlaz bez provjere je najopasnija pogreška na terenu. Rezultate transkripcije i pojednostavljenja uvijek treba usporediti s izvornim tekstom, pouzdanim rječnikom i, ako je moguće, postojećim izdanjem (znanstvenom publikacijom).

Kako sigurno koristiti AI

U starijim tekstovima koristite AI za ove ograničene, ali korisne zadatke:

  • Podrška razumijevanju (suštine): Učenje današnjeg ekvivalenta teških riječi teksta napisanog latiničnim slovima kao nacrta.
  • Hipoteza rječnika: Navedena moguća značenja riječi — zatim provjerena u pouzdanom rječniku.
  • Pojednostavljeni nacrt: Uzmite grubi nacrt odlomka na trenutnom turskom jeziku — a zatim neka ga stručnjak revidira.
  • Usporedba: Uspoređivanje vašeg pojednostavljenja s onim AI ​​i uočavanje previđenih područja.

S druge strane, ne dopustite AI-u da sam radi sljedeće zadatke: transliteracija sa slike arapskog pisma; znanstveno izdanje; dopunjavanje teksta koji nedostaje; polagati pravo na konačno značenje.

Savjet: Zatražite dvije verzije pojednostavljenja: (1) blisko pojednostavljenje koje čuva značenje, (2) popis koji objašnjava ekvivalente riječi. Drugi popis stručnjaku olakšava brzu potvrdu i čini vidljivima izmišljene odgovore umjetne inteligencije.

tri mini kućišta

Slučaj 1 — Hipoteza iz rječnika uštedjela je vrijeme. Student diplomskog studija dobio je nacrt ekvivalenta 30 teških riječi u povijesnom tekstu latiničnim slovima od umjetne inteligencije. 30 ekvivalenta potvrđeno iz pouzdanog rječnika; 4 su bile pogrešne i ispravljene su. Vrijeme pregledavanja rječnika značajno je skraćeno, ali korak provjere nije preskočen.

Slučaj 2 — Uočena je pogreška pri dovršetku. Istraživač je pitao AI o dijelu izlizanog kupleta koji nedostaje. AI je prozodiji dao prikladan, tečan, ali potpuno izmišljen završetak. Kad je istraživač pogledao bilješke o izdanju, vidio je da je ovo poglavlje zapravo drugačije. Zamka "AI popunjava tekst koji nedostaje" postala je konkretna.

Slučaj 3 — Pojednostavljenje iskrivljeno značenje. Urednik je uzeo AI pojednostavljenje divanskog dvostiha; Budući da je umjetna inteligencija doslovno prevela metaforu (stereotipnu sliku), izvorno značenje dvostiha je izgubljeno. Urednik se konzultirao s terenskim stručnjakom i napravio pojednostavljenje koje je sačuvalo sadržaj.

Četiri predloška za kopiranje

1) Ekvivalent teške riječi (uvjetuje se potvrdom):

Dolje navedite POPIS današnjih mogućih ekvivalenata riječi otežanih u starom turskom tekstu latiničnim slovima. Za svaku riječ zabilježite "nije sigurno, treba provjeriti u rječniku". Dodavanje riječi kojih nema u tekstu, dopunjavanje teksta.Tekst: [zalijepi tekst ovdje]

2) Pojednostavljenje dvije verzije:

Pojednostavite sljedeći tekst na dva načina: (1) bliskom verzijom koja čuva značenje i slike, (2) tablicom koja prikazuje stari/novi ekvivalent za svaku riječ koju ste promijenili. Popunjavanje dijelova koji nedostaju, dodavanje značenja koje ne postoji. Označite gdje niste sigurni.Tekst: [zalijepite tekst]

3) Kontrola pojednostavljenja:

Ispod je stvarni tekst i moje pojednostavljenje. Označite mjesta gdje je značenje iskrivljeno, izostavljeno ili pogrešno predstavljeno u mojoj verziji. Ne nameći svoju verziju; samo ukažite na problematična područja i povežite svoje razmišljanje s tekstom. Izvornik: [...] Moja verzija: [...]

4) Objašnjenje zapleta/koncepta:

Objasnite klasične slike i metafore u sljedećem dvostihu. Za svaki: moguće značenje, uporaba u tradiciji i napomena "mora biti provjereno iz stručnog izvora". Nemojte donositi konačnu prosudbu, također navedite alternativna čitanja. Par: [napišite spoj]

Slab upit / Jak upit

Slab: "Prevedite ovaj osmanski tekst na današnji turski."

Jako: "Pojednostavite stari turski tekst latiničnim slovima u nastavku; sačuvajte slike i metafore, nemojte ga svoditi na doslovno značenje. Pokažite svaku riječ koju ste promijenili u staroj/novoj tablici. Dopunite dio koji nedostaje ili je dvosmislen; označite ga kao 'nesiguran, mora biti provjeren od strane stručnjaka'. Nemojte dodavati riječi ili stihove koji nisu u tekstu."

Moćni prompt zatvara zamku završetka, sprječava gubitak sadržaja i traži tablicu koja olakšava provjeru. Slab upit ostavlja otvorena vrata za AI ​​da se uklopi i izgladi.

Tablica zadataka i sigurnosti

poslovanje

AI sama

Ispravna uporaba

Značenje riječi težak u latiničnom tekstu

riskantno

Skica + potvrda rječnika

transliteracija s arapskog pisma

nije učinjeno

stručnjak filolog

Pojednostavljenje

nacrt

Stručni remonti

Dovršite tekst koji nedostaje

Apsolutno nije učinjeno

Izdanje/struč

Objašnjenje

hipoteza

Potvrda iz stručnog izvora

znanstveno izdanje

nije učinjeno

filolog

Aruz i mjerač: Zašto umjetna inteligencija ima posebne poteškoće?

Većina klasične turske poezije napisana je u aruzu (sustav mjerenja koji se temelji na duljini i kratkoći slogova, na temelju obrazaca). Utvrđivanje u kojem aruz obrascu je dvostih zahtijeva dešifriranje jesu li slogovi jedan po jedan dugi ili kratki i poznavanje nekih suptilnosti (kao što je brojanje jednog dugog sloga kao dva kratka ili ispuštanje samoglasnika). Ovo je redovit, ali vrlo suptilan posao, i tu umjetna inteligencija često pogriješi: može krivo nazvati uzorak, krivo izmjeriti slog ili predložiti obrazac koji "zvuči dobro", ali je pogrešan.

Stoga određivanje aruz metra nije posao koji može slijepo obavljati AI; U najboljem slučaju daje "kandidata", a tog kandidata na samom kupletu mora provjeriti netko tko poznaje metar. Isto vrijedi i za analizu zastoja i obrazaca u slogovnom metru (metru narodne poezije na temelju broja slogova u svakom retku); AI može čak i pogriješiti u brojanju slogova. Metar je mjesto gdje se testira točnost književne analize: lažna tvrdnja o metru čini esej nepouzdanim od samog početka.

Oprez: Ne stavljajte naziv prozodijskog uzorka koji je dao AI u studiju bez provjere (kao što je "failatün failatün..."). Mjerenje je i tehničko i kulturološko znanje, a ljudska je stručnost nezamjenjiva u ovom području. Koristite AI najviše kao vodič za pitanje "gdje trebam tražiti mjeru ovog dvostiha, koji su uzorci mogući?"

Uobičajene greške

  • Objavljivanje prijepisa/pojednostavljenja bez provjere. Svaki izlaz se uspoređuje s izvornim tekstom.
  • Uz AI ​​ispunite tekst koji nedostaje. Ovo je izmišljanje nepostojećeg teksta; Definitivno se ne radi.
  • Svesti značenje na doslovno značenje. Klasične slike moraju se sačuvati.
  • Misleći da je jedino čitanje sigurno. Višestruko čitanje je uobičajeno u arapskom pismu; Raspitajte se o alternativama.
  • Zaključivanje kritičkog teksta bez savjetovanja sa stručnjakom. Ljudski filolog je nezaobilazan u ovoj oblasti.

Ukratko

AI u starim tekstovima; To je koristan, ali visokorizičan alat za podršku razumijevanju, leksičke hipoteze i pojednostavljeno skiciranje. Poslovi kao što su prijepis, redakcija i dopuna nedostajućih tekstova pripadaju stručnjaku filologu. Provjerite svaki ispis izvornim tekstom, pouzdanim rječnikom i aktualnim izdanjima; Ne upadajte u zamke dovršavanja i izravnavanja. U ovom području ljudska stručnost je ispred brzine.

Zadatak aplikacije

Pronađite kratak, nepojednostavljen drevni tekst napisan latiničnim slovima (divanski dvostih ili povijesni paragraf). Uzmite nacrt od umjetne inteligencije s predloškom "pojednostavljenje dvije verzije". Zatim provjerite svaku riječ u tablici riječi pouzdanim rječnikom; Označite pogrešne. Provjerite reducirate li sliku na njezino doslovno značenje i ispravite je ako je potrebno.

popis za provjeru

  • [ ] Nisam dao umjetnoj inteligenciji da samostalno izvrši transkripciju arapskog pisma.
  • [ ] Nisam ispunio dio koji nedostaje/dvosmislen.
  • [ ] Potvrdio sam ekvivalente riječi iz pouzdanog rječnika.
  • [ ] Provjerio sam jesu li slike i slike sačuvani.
  • [ ] Konzultirao sam filologa koji se bavi kritičkim tekstom.