Dobici:
- Znati razliku između pojednostavljenja i transkripcije i moći koristiti AI samo za ograničene zadatke koji se mogu provjeriti (podrška razumijevanju, hipoteza leksikona, nacrt pojednostavljenja).
- Sposobnost provjere svakog izlaza s izvornim tekstom i pouzdanim izvorima, izbjegavajući zamke kao što je dovršavanje teksta koji nedostaje i ispravljanje sadržaja
- Biti u stanju razumjeti da je ljudski filolog neophodan u djelima kao što su transkripcija, prozodija i znanstveno izdanje.
Veliki dio turske književnosti napisan je na jeziku koji današnji čitatelji ne mogu direktno čitati: osmanski turski (osmanski turski - turski napisan arapskim pismom, korišten za vrijeme Osmanskog carstva, obogaćen arapskim i perzijskim riječima i frazama). Većina divanske poezije, povijesnih knjiga, novina i arhivskih dokumenata je na ovom jeziku. Za njihovu dostupnost današnjim čitateljima potrebna su dva procesa: transkripcija (prevođenje teksta s jedne abecede na drugu, uz očuvanje zvukova posebnim znakovima; npr. zamjena teksta arapskih slova latiničnim slovima) i pojednostavljenje (zamjena starih i teških riječi teksta riječima koje današnji čitatelji mogu razumjeti).
U ovoj jedinici naučit ćemo koristiti umjetnu inteligenciju kao pomoćnika u ovim zadacima — ali ovdje je upozorenje jače nego ikad: u radu s naslijeđenim tekstom, rizik od pogrešaka umjetne inteligencije i halucinacija je vrlo visok; Svaki izlaz ne može se koristiti bez provjere od strane stručne osobe usporedbom s izvornim tekstom. Umjetna inteligencija može pogrešno pročitati riječ, "dovršiti" dvostih, smisliti značenje koje ne postoji. Ovdje je umjetna inteligencija alat za pregled i raspravu; Nikada neće zamijeniti stručnjaka filologa.
Zašto je rizik veći u ovom području?
Iz tri razloga:
- Dvosmisleno čitanje. U arapskom pismu kratki se samoglasnici često ne pišu; Isti niz slova može biti više riječi. Ispravno čitanje zahtijeva kontekst i stručnost. AI može prikazati najvjerojatnije predviđanje kao "sigurno".
- Težak vokabular. Suptilnosti arapsko-perzijskih fraza, metafora (stereotipne slike u klasičnoj poeziji) i aruz (mjera temeljena na duljini sloga) u tekstovima Divana izgubljene su ili iskrivljene u površnom pojednostavljenju.
- Sklonost dovršetku. AI može automatski popuniti nedostajući ili istrošeni tekst u skladu s onim što "treba" biti. Ovo je teška pogreška u filologiji; je izmisliti tekst koji ne postoji.
Pažnja: Reći umjetnoj inteligenciji da "prevede ovaj otomanski dvostih" i objaviti izlaz bez provjere je najopasnija pogreška na terenu. Rezultate transkripcije i pojednostavljenja uvijek treba usporediti s izvornim tekstom, pouzdanim rječnikom i, ako je moguće, postojećim izdanjem (znanstvenom publikacijom).
Kako sigurno koristiti AI
U starijim tekstovima koristite AI za ove ograničene, ali korisne zadatke:
- Podrška razumijevanju (suštine): Učenje današnjeg ekvivalenta teških riječi teksta napisanog latiničnim slovima kao nacrta.
- Hipoteza rječnika: Navedena moguća značenja riječi — zatim provjerena u pouzdanom rječniku.
- Pojednostavljeni nacrt: Uzmite grubi nacrt odlomka na trenutnom turskom jeziku — a zatim neka ga stručnjak revidira.
- Usporedba: Uspoređivanje vašeg pojednostavljenja s onim AI i uočavanje previđenih područja.
S druge strane, ne dopustite AI-u da sam radi sljedeće zadatke: transliteracija sa slike arapskog pisma; znanstveno izdanje; dopunjavanje teksta koji nedostaje; polagati pravo na konačno značenje.
Savjet: Zatražite dvije verzije pojednostavljenja: (1) blisko pojednostavljenje koje čuva značenje, (2) popis koji objašnjava ekvivalente riječi. Drugi popis stručnjaku olakšava brzu potvrdu i čini vidljivima izmišljene odgovore umjetne inteligencije.
tri mini kućišta
Slučaj 1 — Hipoteza iz rječnika uštedjela je vrijeme. Student diplomskog studija dobio je nacrt ekvivalenta 30 teških riječi u povijesnom tekstu latiničnim slovima od umjetne inteligencije. 30 ekvivalenta potvrđeno iz pouzdanog rječnika; 4 su bile pogrešne i ispravljene su. Vrijeme pregledavanja rječnika značajno je skraćeno, ali korak provjere nije preskočen.
Slučaj 2 — Uočena je pogreška pri dovršetku. Istraživač je pitao AI o dijelu izlizanog kupleta koji nedostaje. AI je prozodiji dao prikladan, tečan, ali potpuno izmišljen završetak. Kad je istraživač pogledao bilješke o izdanju, vidio je da je ovo poglavlje zapravo drugačije. Zamka "AI popunjava tekst koji nedostaje" postala je konkretna.
Slučaj 3 — Pojednostavljenje iskrivljeno značenje. Urednik je uzeo AI pojednostavljenje divanskog dvostiha; Budući da je umjetna inteligencija doslovno prevela metaforu (stereotipnu sliku), izvorno značenje dvostiha je izgubljeno. Urednik se konzultirao s terenskim stručnjakom i napravio pojednostavljenje koje je sačuvalo sadržaj.
Četiri predloška za kopiranje
1) Ekvivalent teške riječi (uvjetuje se potvrdom):
Dolje navedite POPIS današnjih mogućih ekvivalenata riječi otežanih u starom turskom tekstu latiničnim slovima. Za svaku riječ zabilježite "nije sigurno, treba provjeriti u rječniku". Dodavanje riječi kojih nema u tekstu, dopunjavanje teksta.Tekst: [zalijepi tekst ovdje]
2) Pojednostavljenje dvije verzije:
Pojednostavite sljedeći tekst na dva načina: (1) bliskom verzijom koja čuva značenje i slike, (2) tablicom koja prikazuje stari/novi ekvivalent za svaku riječ koju ste promijenili. Popunjavanje dijelova koji nedostaju, dodavanje značenja koje ne postoji. Označite gdje niste sigurni.Tekst: [zalijepite tekst]
3) Kontrola pojednostavljenja:
Ispod je stvarni tekst i moje pojednostavljenje. Označite mjesta gdje je značenje iskrivljeno, izostavljeno ili pogrešno predstavljeno u mojoj verziji. Ne nameći svoju verziju; samo ukažite na problematična područja i povežite svoje razmišljanje s tekstom. Izvornik: [...] Moja verzija: [...]
4) Objašnjenje zapleta/koncepta:
Objasnite klasične slike i metafore u sljedećem dvostihu. Za svaki: moguće značenje, uporaba u tradiciji i napomena "mora biti provjereno iz stručnog izvora". Nemojte donositi konačnu prosudbu, također navedite alternativna čitanja. Par: [napišite spoj]
Slab upit / Jak upit
Slab: "Prevedite ovaj osmanski tekst na današnji turski."
Jako: "Pojednostavite stari turski tekst latiničnim slovima u nastavku; sačuvajte slike i metafore, nemojte ga svoditi na doslovno značenje. Pokažite svaku riječ koju ste promijenili u staroj/novoj tablici. Dopunite dio koji nedostaje ili je dvosmislen; označite ga kao 'nesiguran, mora biti provjeren od strane stručnjaka'. Nemojte dodavati riječi ili stihove koji nisu u tekstu."
Moćni prompt zatvara zamku završetka, sprječava gubitak sadržaja i traži tablicu koja olakšava provjeru. Slab upit ostavlja otvorena vrata za AI da se uklopi i izgladi.
Tablica zadataka i sigurnosti
poslovanje
AI sama
Ispravna uporaba
Značenje riječi težak u latiničnom tekstu
riskantno
Skica + potvrda rječnika
transliteracija s arapskog pisma
nije učinjeno
stručnjak filolog
Pojednostavljenje
nacrt
Stručni remonti
Dovršite tekst koji nedostaje
Apsolutno nije učinjeno
Izdanje/struč
Objašnjenje
hipoteza
Potvrda iz stručnog izvora
znanstveno izdanje
nije učinjeno
filolog
Aruz i mjerač: Zašto umjetna inteligencija ima posebne poteškoće?
Većina klasične turske poezije napisana je u aruzu (sustav mjerenja koji se temelji na duljini i kratkoći slogova, na temelju obrazaca). Utvrđivanje u kojem aruz obrascu je dvostih zahtijeva dešifriranje jesu li slogovi jedan po jedan dugi ili kratki i poznavanje nekih suptilnosti (kao što je brojanje jednog dugog sloga kao dva kratka ili ispuštanje samoglasnika). Ovo je redovit, ali vrlo suptilan posao, i tu umjetna inteligencija često pogriješi: može krivo nazvati uzorak, krivo izmjeriti slog ili predložiti obrazac koji "zvuči dobro", ali je pogrešan.
Stoga određivanje aruz metra nije posao koji može slijepo obavljati AI; U najboljem slučaju daje "kandidata", a tog kandidata na samom kupletu mora provjeriti netko tko poznaje metar. Isto vrijedi i za analizu zastoja i obrazaca u slogovnom metru (metru narodne poezije na temelju broja slogova u svakom retku); AI može čak i pogriješiti u brojanju slogova. Metar je mjesto gdje se testira točnost književne analize: lažna tvrdnja o metru čini esej nepouzdanim od samog početka.
Oprez: Ne stavljajte naziv prozodijskog uzorka koji je dao AI u studiju bez provjere (kao što je "failatün failatün..."). Mjerenje je i tehničko i kulturološko znanje, a ljudska je stručnost nezamjenjiva u ovom području. Koristite AI najviše kao vodič za pitanje "gdje trebam tražiti mjeru ovog dvostiha, koji su uzorci mogući?"
Uobičajene greške
- Objavljivanje prijepisa/pojednostavljenja bez provjere. Svaki izlaz se uspoređuje s izvornim tekstom.
- Uz AI ispunite tekst koji nedostaje. Ovo je izmišljanje nepostojećeg teksta; Definitivno se ne radi.
- Svesti značenje na doslovno značenje. Klasične slike moraju se sačuvati.
- Misleći da je jedino čitanje sigurno. Višestruko čitanje je uobičajeno u arapskom pismu; Raspitajte se o alternativama.
- Zaključivanje kritičkog teksta bez savjetovanja sa stručnjakom. Ljudski filolog je nezaobilazan u ovoj oblasti.
Ukratko
AI u starim tekstovima; To je koristan, ali visokorizičan alat za podršku razumijevanju, leksičke hipoteze i pojednostavljeno skiciranje. Poslovi kao što su prijepis, redakcija i dopuna nedostajućih tekstova pripadaju stručnjaku filologu. Provjerite svaki ispis izvornim tekstom, pouzdanim rječnikom i aktualnim izdanjima; Ne upadajte u zamke dovršavanja i izravnavanja. U ovom području ljudska stručnost je ispred brzine.
Zadatak aplikacije
Pronađite kratak, nepojednostavljen drevni tekst napisan latiničnim slovima (divanski dvostih ili povijesni paragraf). Uzmite nacrt od umjetne inteligencije s predloškom "pojednostavljenje dvije verzije". Zatim provjerite svaku riječ u tablici riječi pouzdanim rječnikom; Označite pogrešne. Provjerite reducirate li sliku na njezino doslovno značenje i ispravite je ako je potrebno.
popis za provjeru
- [ ] Nisam dao umjetnoj inteligenciji da samostalno izvrši transkripciju arapskog pisma.
- [ ] Nisam ispunio dio koji nedostaje/dvosmislen.
- [ ] Potvrdio sam ekvivalente riječi iz pouzdanog rječnika.
- [ ] Provjerio sam jesu li slike i slike sačuvani.
- [ ] Konzultirao sam filologa koji se bavi kritičkim tekstom.