Jednostka 4 / 11

Teksty starożytne, uproszczenie i transliteracja: praca z tekstami osmańskimi i dywanowymi

Zyski:

  • Znać różnicę między uproszczeniem a transkrypcją i umieć wykorzystywać sztuczną inteligencję tylko do ograniczonych, weryfikowalnych zadań (wsparcie rozumienia, hipoteza leksykonu, projekt uproszczenia).
  • Możliwość weryfikacji każdego wyjścia z oryginalnym tekstem i wiarygodnymi źródłami, unikając pułapek typu uzupełnianie brakującego tekstu i prostowanie treści
  • Umiejętność zrozumienia, że filolog humanistyczny jest niezbędny w pracach takich jak transkrypcja, prozodia i edycja naukowa.

Duża część literatury tureckiej została napisana w języku, którego dzisiejsi czytelnicy nie potrafią czytać bezpośrednio: turecki osmański (turecki osmański – turecki pisany alfabetem arabskim, używany w czasach Imperium Osmańskiego, wzbogacony słowami i zwrotami arabskimi i perskimi). Większość poezji Divan, książek historycznych, gazet i dokumentów archiwalnych jest w tym języku. Udostępnienie ich dzisiejszym czytelnikom wymaga dwóch procesów: transkrypcji (przetłumaczenie tekstu z jednego alfabetu na inny, zachowanie dźwięków specjalnymi znakami, np. zamiana tekstu pisanego literami arabskimi na litery łacińskie) i uproszczenia (zastąpienie starych i ciężkich słów tekstu słowami, które dzisiejszy czytelnik może zrozumieć).

W tej części nauczymy się wykorzystywać sztuczną inteligencję jako pomoc w tych zadaniach — ale w tym przypadku ostrzeżenie jest silniejsze niż kiedykolwiek: w przypadku starszych prac nad tekstem ryzyko błędów i halucynacji AI jest bardzo wysokie; Żaden wynik nie może zostać wykorzystany bez sprawdzenia przez kompetentną osobę w terenie poprzez porównanie go z tekstem oryginalnym. Sztuczna inteligencja może błędnie odczytać słowo, „dokończyć” dwuwiersz, wymyślić znaczenie, które nie istnieje. Tutaj sztuczna inteligencja jest narzędziem zarysu i dyskusji; Nigdy nie zastąpi eksperta filologa.

Dlaczego ryzyko jest wyższe w tym obszarze?

Z trzech powodów:

  1. Niejednoznaczna lektura. W piśmie arabskim często nie zapisuje się krótkich samogłosek; Ten sam ciąg liter może składać się z wielu słów. Prawidłowe odczytanie wymaga kontekstu i wiedzy. Sztuczna inteligencja może przedstawić najbardziej prawdopodobną prognozę jako „pewną”.
  2. Ciężkie słownictwo. Subtelności arabsko-perskich zwrotów, metafor (stereotypowych obrazów w poezji klasycznej) i aruz (miara oparta na długości sylaby) w tekstach Divan zostają utracone lub zniekształcone w powierzchownym uproszczeniu.
  3. Tendencja do uzupełnienia. Sztuczna inteligencja może automatycznie uzupełnić brakujący lub zużyty tekst zgodnie z tym, co „powinno”. Jest to poważny błąd w filologii; polega na stworzeniu tekstu, który nie istnieje.
Uwaga: Nakazanie sztucznej inteligencji, aby „przetłumaczyła ten osmański dwuwiersz” i opublikowanie wyników bez sprawdzenia, jest najniebezpieczniejszym błędem w tej dziedzinie. Wyniki transkrypcji i uproszczeń należy zawsze porównywać z tekstem oryginalnym, wiarygodnym słownikiem i, jeśli to możliwe, z istniejącym wydaniem (publikacją naukową).

Jak bezpiecznie korzystać z AI

W starszych tekstach używaj sztucznej inteligencji do następujących ograniczonych, ale przydatnych zadań:

  • Wsparcie w zrozumieniu (istot): Nauka współczesnego odpowiednika ciężkich słów tekstu zapisanego literami łacińskimi w formie roboczej.
  • Hipoteza słownikowa: posiadanie wymienionych możliwych znaczeń słowa – następnie zweryfikowanie ich w wiarygodnym słowniku.
  • Projekt uproszczenia: sporządzenie wstępnej wersji akapitu w języku tureckim, a następnie zlecenie jej sprawdzenia przez eksperta.
  • Porównanie: porównanie uproszczenia z uproszczeniem AI i sprawdzenie przeoczonych obszarów.

Z drugiej strony nie pozwól sztucznej inteligencji samodzielnie wykonywać następujących zadań: transliteracja z obrazu pisma arabskiego; wydanie naukowe; uzupełnienie brakującego tekstu; domagać się ostatecznego znaczenia.

Wskazówka: Poproś o dwie wersje uproszczenia: (1) dokładne uproszczenie, które zachowuje znaczenie, (2) listę wyjaśniającą odpowiedniki słów. Druga lista ułatwia ekspertowi szybkie potwierdzenie i sprawia, że ​​wymyślone odpowiedzi AI stają się widoczne.

trzy mini etui

Przypadek 1 — Hipoteza słownikowa pozwoliła zaoszczędzić czas. Absolwent otrzymał od AI projekt odpowiednika 30 ciężkich słów w tekście historycznym zapisanym literami łacińskimi. 30 odpowiedników potwierdzonych z wiarygodnego słownika; 4 były błędne i zostały poprawione. Czas przeglądania słownika został znacznie skrócony, ale nie pominięto kroku weryfikacji.

Przypadek 2 — wykryto błąd zakończenia. Badacz zapytał sztuczną inteligencję o brakującą część zużytego kupletu. Sztuczna inteligencja nadała prozodii dopasowane, płynne, ale całkowicie sfabrykowane zakończenie. Kiedy badacz spojrzał na notatki redakcyjne, zobaczył, że ten rozdział faktycznie był inny. Pułapka „AI uzupełnia brakujący tekst” stała się konkretna.

Przypadek 3 — Uproszczenie zniekształca znaczenie. Redaktor zastosował uproszczenie AI dwuwiersza kanapowego; Ponieważ AI przetłumaczyła metaforę (stereotypowy obraz) dosłownie, pierwotne znaczenie dwuwiersza zostało utracone. Redakcja skonsultowała się ze specjalistą z danej dziedziny i dokonała uproszczenia, które pozwoliło zachować treść.

Cztery szablony do kopiowania

1) Odpowiednik ciężkiego słowa (pod warunkiem potwierdzenia):

Podaj LIstę możliwych współczesnych odpowiedników słów zaostrzonych w starym tekście tureckim z poniższymi literami łacińskimi. Przy każdym słowie zanotuj „niepewne, należy sprawdzić w słowniku”. Dodanie słów, których nie ma w tekście, uzupełnienie tekstu.Tekst: [tu wklej tekst]

2) Uproszczenie w dwóch wersjach:

Uprość następujący tekst na dwa sposoby: (1) wersja zbliżona, która zachowuje znaczenie i obrazowość, (2) tabela pokazująca stary/nowy odpowiednik każdego zmienionego słowa. Uzupełnianie brakujących części, dodawanie znaczenia, które nie istnieje. Zaznacz, gdzie nie jesteś pewien. Tekst: [wklej tekst]

3) Kontrola uproszczona:

Poniżej faktyczny tekst i moje uproszczenie. Zaznacz miejsca, w których znaczenie w mojej wersji zostało zniekształcone, pominięte lub błędnie przedstawione. Nie narzucaj własnej wersji; po prostu wskaż problematyczne obszary i powiąż swoje rozumowanie z tekstem. Oryginał: [...] Moja wersja: [...]

4) Wyjaśnienie fabuły/koncepcji:

Wyjaśnij klasyczne obrazy i metafory w poniższym dwuwierszu. Dla każdego: możliwe znaczenie, zastosowanie w tradycji i uwaga „należy zweryfikować na podstawie źródła eksperckiego”. Nie wydawaj ostatecznego osądu, podaj także alternatywne odczytania. Łącznik: [napisz dwuwiersz]

Słaba zachęta/silna zachęta

Słabe: „Przetłumacz ten tekst osmański na dzisiejszy turecki”.

Mocne: „Uprość stary tekst turecki, dodając poniżej litery łacińskie; zachowaj obrazy i metafory, nie redukuj ich do dosłownego znaczenia. Pokaż każde zmienione słowo w starej/nowej tabeli. Uzupełnij brakującą lub niejednoznaczną część; oznacz jako „niepewne, wymaga sprawdzenia przez eksperta”. Nie dodawaj żadnych słów ani wersetów, których nie ma w tekście.

Potężny monit zamyka pułapkę zakończenia, zapobiega utracie treści i wyświetla tabelę ułatwiającą weryfikację. Słaby monit pozostawia otwarte drzwi dla AI, aby dopasować się i wygładzić.

Tabela zadań i zabezpieczeń

biznes

Sama sztuczna inteligencja

Prawidłowe użycie

Znaczenie słowa ciężki w tekście łacińskim

ryzykowne

Wersja robocza + potwierdzenie słownika

transliteracja z pisma arabskiego

nie zrobione

specjalista filolog

Uproszczenie

projekt

Fachowe remonty

Uzupełnij brakujący tekst

Absolutnie nie zrobione

Wydanie/ekspert

Wyjaśnienie

hipoteza

Potwierdzenie ze źródła eksperckiego

wydanie naukowe

nie zrobione

filolog

Aruz i miernik: Dlaczego sztuczna inteligencja ma szczególne trudności?

Większość klasycznej poezji tureckiej została napisana w języku aruz (system miar oparty na długości i krótkości sylab, oparty na wzorach). Określenie, w jakim wzorze aruz występuje dwuwiersz, wymaga rozszyfrowania, czy sylaby są długie, czy krótkie, jedna po drugiej, oraz znajomości pewnych subtelności (takich jak liczenie jednej długiej sylaby jako dwóch krótkich lub opuszczanie samogłoski). Jest to zwykła, ale bardzo subtelna praca i w tym właśnie miejscu sztuczna inteligencja często popełnia błędy: może błędnie nazwać wzór, źle zmierzyć sylabę lub zasugerować wzór, który „brzmi dobrze”, ale jest błędny.

Dlatego określenie licznika aruz nie jest zadaniem, które sztuczna inteligencja może wykonać na ślepo; W najlepszym razie daje „kandydata”, a kandydat ten musi zostać zweryfikowany na samym kuplecie przez osobę znającą licznik. To samo dotyczy analizy zwartych i wzorców w metrum sylabicznym (metr poezji ludowej oparty na liczbie sylab w każdym wersie); Sztuczna inteligencja może nawet popełniać błędy w liczeniu sylab. Metr to miejsce, w którym sprawdzana jest trafność analizy literackiej: fałszywe twierdzenie o metrum sprawia, że ​​esej od początku jest niewiarygodny.

Uwaga: Nie należy umieszczać w badaniu prozodycznej nazwy wzorca nadanej przez sztuczną inteligencję bez jej weryfikacji (np. „failatün fallatün…”). Pomiar to zarówno wiedza techniczna, jak i kulturowa, a wiedza ludzka jest w tej dziedzinie niezbędna. Użyj sztucznej inteligencji co najwyżej jako wskazówki w odpowiedzi na pytanie „gdzie powinienem szukać miary tego kupletu, jakie wzorce są możliwe?”

Typowe błędy

  • Publikacja transkrypcji/uproszczenia bez weryfikacji. Każdy wynik jest porównywany z oryginalnym tekstem.
  • Poproś sztuczną inteligencję o uzupełnienie brakującego tekstu. Jest to tworzenie nieistniejącego tekstu; Na pewno nie jest to zrobione.
  • Aby zredukować znaczenie do dosłownego znaczenia. Należy zachować klasyczne obrazy.
  • Myśląc, że pewne jest tylko czytanie. W piśmie arabskim powszechne jest wielokrotne czytanie; Zapytaj o alternatywy.
  • Zakończenie tekstu krytycznego bez konsultacji z ekspertem. Filolog humanistyczny jest w tej dziedzinie niezastąpiony.

Podsumowując

AI w starych tekstach; Jest to przydatne, ale obarczone wysokim ryzykiem narzędzie do wspomagania zrozumienia, stawiania hipotez leksykalnych i szkicowania uproszczeń. Zadania takie jak transkrypcja, redakcja i uzupełnienie brakujących tekstów należą do biegłego filologa. Sprawdzaj każdy wydruk z oryginalnym tekstem, wiarygodnym słownikiem i aktualnymi wydaniami; Nie wpadaj w pułapki ukończenia i spłaszczenia. W tej dziedzinie ludzka wiedza jest ważniejsza od szybkości.

Zadanie aplikacji

Znajdź krótki, nieuproszczony starożytny tekst zapisany literami łacińskimi (kuplet kanapy lub akapit historyczny). Uzyskaj plan od AI za pomocą szablonu „uproszczenia w dwóch wersjach”. Następnie zweryfikuj każde słowo w tabeli słów za pomocą wiarygodnego słownika; Zaznacz niewłaściwe. Sprawdź, czy nie redukujesz obrazu do jego dosłownego znaczenia i w razie potrzeby popraw go.

lista kontrolna

  • [ ] Nie miałem AI, która samodzielnie dokonała transkrypcji pisma arabskiego.
  • [ ] Nie uzupełniłem brakującej/niejednoznacznej części.
  • [ ] Potwierdziłem odpowiedniki słów z wiarygodnego słownika.
  • [ ] Sprawdziłem, czy obrazy i obrazy zostały zachowane.
  • [ ] Konsultowałem się z filologiem specjalizującym się w tekście krytycznym.