Gevinster:
- Kjenn forskjellen mellom forenkling og transkripsjon og kunne bruke AI kun for begrensede, verifiserbare oppgaver (forståelsesstøtte, leksikonhypotese, forenklingsutkast).
- Evne til å verifisere hver utgang med originalteksten og pålitelige kilder, unngå feller som å fullføre den manglende teksten og rette opp innholdet
- Å kunne forstå at menneskefilologen er uunnværlig i verk som transkripsjon, prosodi og vitenskapelig utgave.
En stor del av tyrkisk litteratur ble skrevet på et språk som dagens lesere ikke kan lese direkte: ottomansk tyrkisk (ottomansk tyrkisk – tyrkisk skrevet i det arabiske alfabetet, brukt under det osmanske riket, beriket med arabiske og persiske ord og uttrykk). Det meste av Divan-poesi, historiebøker, aviser og arkivdokumenter er på dette språket. Å gjøre dem tilgjengelige for dagens lesere krever to prosesser: transkripsjon (oversette en tekst fra et alfabet til et annet, bevare lydene med spesielle tegn; for eksempel å endre teksten med arabiske bokstaver til latinske bokstaver) og forenkling (erstatte de gamle og tunge ordene i teksten med ord som dagens lesere kan forstå).
I denne enheten skal vi lære å bruke AI som en hjelper i disse oppgavene — men her er advarselen sterkere enn noen gang: I legacy tekstarbeid er risikoen for AI-feil og hallusinasjoner svært høy; Hver utgang kan ikke brukes uten verifisering av en kompetent person på området ved å sammenligne den med originalteksten. AI kan feillese et ord, "fullføre" en kuplett, lage en mening som ikke eksisterer. Her er AI et disposisjons- og diskusjonsverktøy; Det vil aldri erstatte ekspertfilologen.
Hvorfor er risikoen høyere i dette området?
Av tre grunner:
- Tvetydig lesning. I arabisk skrift skrives ofte ikke korte vokaler; Den samme bokstavstrengen kan være flere ord. Riktig lesing krever kontekst og ekspertise. AI kan presentere den mest sannsynlige spådommen som "sikker".
- Tungt ordforråd. Finessene til arabisk-persiske fraser, metaforer (stereotype bilder i klassisk poesi) og aruz (mål basert på stavelseslengde) i Divan-tekster går tapt eller forvrengt i en overfladisk forenkling.
- Tendens til å fullføre. AI kan automatisk fylle ut manglende eller slitt tekst i henhold til hva den "skal" være. Dette er en alvorlig feil i filologien; er å lage en tekst som ikke eksisterer.
Oppmerksomhet: Å fortelle AI om å "oversette denne osmanske kupletten" og publisere resultatet uten å bekrefte det er den farligste feilen i feltet. Transkripsjons- og forenklingsutdata bør alltid sammenlignes med originalteksten, en pålitelig ordbok og om mulig en eksisterende utgave (vitenskapelig publikasjon).
Hvordan bruke AI trygt
I eldre tekster, bruk AI for disse begrensede, men nyttige oppgavene:
- Forståelse (gist) støtte: Lære dagens ekvivalent av tunge ord i en tekst med latinske bokstaver som et utkast.
- Ordbokhypotese: Å ha de mulige betydningene til et ord oppført - deretter verifisert mot en pålitelig ordbok.
- Forenklingsutkast: Ta et grovt utkast til et avsnitt på gjeldende tyrkisk – og la eksperten revidere det.
- Sammenligning: Sammenligning av forenklingen din med AI og se de oversett områdene.
På den annen side, ikke la AI gjøre følgende oppgaver alene: translitterasjon fra arabisk skriftbilde; vitenskapelig utgave; fullføring av manglende tekst; krav på definitiv mening.
Tips: Be om to versjoner av forenkling: (1) nær forenkling som bevarer mening, (2) en liste som forklarer ordekvivalenter. Den andre listen gjør det lettere for eksperten å bekrefte raskt og synliggjør AIs sammendiktede svar.
tre minisaker
Tilfelle 1 — Ordbokhypotesen sparte tid. En hovedfagsstudent mottok utkastet tilsvarende 30 tunge ord i en historietekst med latinske bokstaver fra AI. 30 tilsvarende bekreftet fra pålitelig ordbok; 4 tok feil og er rettet. Lesetiden for ordboken ble betydelig forkortet, men bekreftelsestrinnet ble ikke hoppet over.
Tilfelle 2 — Fullføringsfeil fanget. En forsker spurte AI om den manglende delen av en utslitt kuplett. AI gav prosodien en passende, flytende, men fullstendig fabrikkert komplettering. Da forskeren så på utgavenotatene, så han at dette kapittelet faktisk var annerledes. «AI fyller ut den manglende teksten»-fellen har blitt konkret.
Tilfelle 3 — Forenkling forvrengt mening. En redaktør tok en AI-forenkling av en divankuplett; Siden AI oversatte metaforen (stereotypt bilde) bokstavelig, gikk den opprinnelige betydningen av kupletten tapt. Redaktøren rådførte seg med en feltekspert og gjorde en forenkling som bevarte innholdet.
Fire kopierbare maler
1) Ekvivalent med tungt ord (betinget bekreftelse):
Gi en LISTE over dagens mulige ekvivalenter av ordene forverret i den gamle tyrkiske teksten med latinske bokstaver nedenfor. Noter "ikke sikker, bør verifiseres fra ordboken" for hvert ord. Legge til ord som ikke er i teksten, fullføre teksten.Tekst: [lim inn tekst her]
2) To-versjonsforenkling:
Forenkle følgende tekst på to måter: (1) en nær versjon som bevarer betydningen og bildene, (2) en tabell som viser den gamle/nye ekvivalenten for hvert ord du endret. Fylle ut de manglende delene, legge til mening som ikke eksisterer. Merk hvor du ikke er sikker.Tekst: [lim inn tekst]
3) Forenklingskontroll:
Nedenfor er selve teksten og min forenkling. Marker steder der betydningen er forvrengt, utelatt eller feilpresentert i min versjon. Ikke påtving din egen versjon; bare påpek de problematiske områdene og koble resonnementet ditt til teksten. Original: [...] Min versjon: [...]
4) Plott/konseptforklaring:
Forklar de klassiske bildene og metaforene i følgende kuplett. For hver: mulig betydning, bruk i tradisjon, og merknad "må verifiseres fra ekspertkilde". Ikke foreta en endelig dom, angi også alternative avlesninger. Kobling: [skriv koblingen]
Svak forespørsel / Sterk forespørsel
Svak: "Oversett denne osmanske teksten til dagens tyrkisk."
Sterkt: "Forenkle den gamle tyrkiske teksten med latinske bokstaver nedenfor; bevar bildene og metaforene, ikke reduser det til bokstavelig betydning. Vis hvert ord du har endret i en gammel/ny tabell. Fyll ut den manglende eller tvetydige delen; merk den som 'usikker, må verifiseres av en ekspert'. Ikke legg til noen ord eller vers som ikke er i teksten."
Den kraftige ledeteksten lukker fullføringsfellen, forhindrer tap av innhold og ber om en tabell som gjør verifiseringen enklere. Den svake meldingen lar døren stå åpen for AI for å passe og jevne.
Oppgave- og sikkerhetstabell
virksomhet
AI alene
Riktig bruk
Betydningen av ordet tung i latinsk bokstavtekst
risikabelt
Utkast + ordbok bekreftelse
translitterasjon fra arabisk skrift
ikke gjort
ekspert filolog
Forenkling
utkast
Ekspertoverhalinger
Fullfør manglende tekst
Absolutt ikke gjort
Utgave/ekspert
Forklaring
hypotese
Bekreftelse fra ekspertkilde
vitenskapelig utgave
ikke gjort
filolog
Aruz og meter: Hvorfor har AI spesielle problemer?
Det meste av den klassiske tyrkiske poesien ble skrevet i aruz (et målesystem basert på lengden og kortheten til stavelser, basert på mønstre). Å bestemme hvilket aruz-mønster en kuplett er i, krever å tyde om stavelsene er lange eller korte én etter én, og kjenne til noen finesser (som å telle en lang stavelse som to korte eller slippe en vokal). Dette er en vanlig, men veldig subtil jobb, og det er her AI-en ofte går galt: den kan feilnavne et mønster, feilmåle en stavelse eller foreslå et mønster som "høres bra ut", men som er feil.
Derfor er å bestemme aruz-måleren ikke en jobb som blindt kan gjøres av AI; I beste fall gir det en "kandidat", og denne kandidaten må verifiseres på selve kupletten av noen med kunnskap om måleren. Det samme gjelder for analyse av stopp og mønstre i stavelse meter (folkediktmåler basert på antall stavelser i hver linje); AI kan til og med gjøre feil ved å telle stavelser. Meter er stedet hvor nøyaktigheten av litterær analyse testes: en falsk påstand om å måle gjør et essay upålitelig fra starten av.
Forsiktig: Ikke legg inn et prosodisk mønsternavn gitt av AI i en studie uten å bekrefte det (for eksempel "failatün failatün..."). Måling er både teknisk og kulturell kunnskap, og menneskelig ekspertise er uunnværlig på dette feltet. Bruk AI på det meste som en veiledning til spørsmålet "hvor skal jeg se etter målet til denne kupletten, hvilke mønstre er mulige?"
Vanlige feil
- Publiserer transkripsjonen/forenklingen uten å verifisere den. Hver utgang sammenlignes med originalteksten.
- Å la AI fylle ut den manglende teksten. Dette utgjør ikke-eksisterende tekst; Det er definitivt ikke gjort.
- Å redusere betydningen til bokstavelig betydning. Klassiske bilder skal bevares.
- Tenker at bare lesing er sikkert. Flere lesninger er vanlig i arabisk skrift; Spør om alternativer.
- Avslutte kritisk tekst uten å konsultere en ekspert. Menneskefilologen er uunnværlig på dette feltet.
Oppsummert
AI i gamle tekster; Det er et nyttig, men høyrisikoverktøy for forståelsesstøtte, leksikalske hypoteser og forenklingsskisser. Oppgaver som transkripsjon, utgave og ferdigstillelse av manglende tekster tilhører den sakkyndige filologen. Bekreft hver utskrift med originalteksten, pålitelig ordbok og gjeldende utgaver; Ikke gå i fellene av fullføring og utflating. På dette feltet kommer menneskelig ekspertise før hastighet.
Søknadsoppgave
Finn en kort, uforenklet gammel tekst med latinske bokstaver (en divankuplett eller et historieavsnitt). Få blåkopien fra AI med malen "to-versjonsforenkling". Bekreft deretter hvert ord i ordtabellen med en pålitelig ordbok; Kryss av for feil. Sjekk om du reduserer et bilde til dets bokstavelige betydning og korriger det om nødvendig.
sjekkliste
- [ ] Jeg fikk ikke AI til å transkribere den arabiske skriptet alene.
- [ ] Jeg fylte ikke ut den manglende/tvetydige delen.
- [ ] Jeg bekreftet ordet ekvivalenter fra en pålitelig ordbok.
- [ ] Jeg sjekket at bildene og bildene er bevart.
- [ ] Jeg konsulterte filologen som har spesialisert seg på den kritiske teksten.