이득:
- 단순화와 전사의 차이점을 알고 제한적이고 검증 가능한 작업(이해 지원, 어휘 가설, 단순화 초안)에만 AI를 사용할 수 있습니다.
- 누락된 텍스트를 완성하고 내용을 바로잡는 등의 함정을 피하면서 원본 텍스트와 신뢰할 수 있는 소스로 각 출력을 검증하는 기능
- 필사본, 운율, 학술판 등의 작업에 인간 언어학자가 없어서는 안 될 존재임을 이해할 수 있다.
터키 문학의 상당 부분은 오늘날 독자들이 직접 읽을 수 없는 언어로 작성되었습니다. 오스만 터키어(오스만 터키어 - 아랍어 알파벳으로 작성된 터키어, 오스만 제국 시대에 사용되었으며 아랍어 및 페르시아어 단어와 문구가 풍부함). 대부분의 디반 시, 역사서, 신문, 기록 보관 문서가 이 언어로 되어 있습니다. 오늘날의 독자가 이를 사용할 수 있도록 하려면 전사(텍스트를 한 알파벳에서 다른 알파벳으로 번역하고 특수 기호로 소리를 보존합니다. 예를 들어 아랍어 문자의 텍스트를 라틴 문자로 변경)와 단순화(텍스트의 오래되고 무거운 단어를 오늘날의 독자가 이해할 수 있는 단어로 대체)라는 두 가지 프로세스가 필요합니다.
이 단원에서는 AI를 이러한 작업의 도우미로 사용하는 방법을 배우게 됩니다. 하지만 여기서 경고는 그 어느 때보다 강력합니다. 레거시 텍스트 작업에서는 AI 오류 및 환각의 위험이 매우 높습니다. 각 출력물은 원문과의 비교를 통한 현장 유자격자의 검증 없이는 사용할 수 없습니다. AI는 단어를 잘못 읽을 수도 있고, 한 쌍을 "완성"할 수도 있고, 존재하지 않는 의미를 만들어낼 수도 있습니다. 여기서 AI는 개요 및 토론 도구입니다. 그것은 결코 전문 문헌학자를 대체할 수 없습니다.
이 영역에서 위험이 더 높은 이유는 무엇입니까?
세 가지 이유:
- 모호한 읽기. 아랍어 문자에서는 단모음을 쓰지 않는 경우가 많습니다. 동일한 문자열이 여러 단어가 될 수 있습니다. 올바른 읽기에는 맥락과 전문 지식이 필요합니다. AI는 가장 가능성 있는 예측을 '확실함'으로 제시할 수 있습니다.
- 무거운 어휘. Divan 텍스트의 아랍어-페르시아어 문구, 은유(고전 시의 고정형 이미지) 및 아루즈(음절 길이에 따른 측정)의 미묘함은 피상적인 단순화로 인해 손실되거나 왜곡됩니다.
- 완료하려는 경향. AI는 "해야 하는" 내용에 따라 누락되거나 낡은 텍스트를 자동으로 채울 수 있습니다. 이것은 문헌학의 심각한 오류입니다. 존재하지 않는 텍스트를 만들어내는 것입니다.
주의: AI에게 "이 오스만 대련을 번역하라"고 지시하고 이를 검증하지 않고 출력물을 게시하는 것은 현장에서 가장 위험한 실수입니다. 전사 및 단순화 결과는 항상 원본 텍스트, 신뢰할 수 있는 사전 및 가능하다면 기존 판(학술 출판물)과 비교되어야 합니다.
AI를 안전하게 사용하는 방법
오래된 텍스트에서는 제한적이지만 유용한 작업에 AI를 사용합니다.
- 이해력(요점) 지원: 라틴 문자로 된 텍스트의 무거운 단어에 해당하는 오늘날의 초안을 학습합니다.
- 사전 가설: 나열된 단어의 가능한 의미를 파악한 다음 신뢰할 수 있는 사전에 대해 검증합니다.
- 단순화 초안: 현재 터키어로 된 문단의 초안을 작성한 후 전문가에게 수정을 요청합니다.
- 비교: 단순화를 AI의 단순화와 비교하고 간과된 영역을 확인합니다.
반면, AI가 다음 작업을 혼자 수행하도록 두지 마십시오. 아랍어 스크립트 이미지에서 음역; 과학판; 누락된 텍스트 완성; 확실한 의미를 주장합니다.
팁: 두 가지 버전의 단순화를 요청하세요. (1) 의미를 유지하는 긴밀한 단순화, (2) 단어에 해당하는 단어를 설명하는 목록. 두 번째 목록을 사용하면 전문가가 더 쉽게 신속하게 확인할 수 있고 AI의 조작된 응답을 볼 수 있습니다.
세 개의 미니 케이스
사례 1 - 사전 가설이 시간을 절약했습니다. 한 대학원생이 AI로부터 라틴 문자로 된 역사 교과서의 무거운 단어 30개에 해당하는 초안을 받았습니다. 신뢰할 수 있는 사전에서 확인된 30개 상당의 항목; 4개는 틀려서 수정했습니다. 사전 검색 시간이 대폭 단축됐지만, 검증 단계도 건너뛰지 않았습니다.
사례 2 - 완료 오류가 발생했습니다. 한 연구원이 AI에게 낡은 대련의 없어진 부분에 대해 물었습니다. AI는 운율에 적합하고 유창하지만 완전히 조작된 완성을 제공했습니다. 연구자는 판본을 살펴보면서 이 장이 실제로는 다르다는 것을 알았습니다. "AI가 누락된 텍스트를 채웁니다" 트랩이 구체화되었습니다.
사례 3 - 단순화로 인해 의미가 왜곡되었습니다. 편집자는 소파 겸 커플을 AI로 단순화했습니다. AI가 은유(정형화된 이미지)를 문자 그대로 번역했기 때문에 대련의 원래 의미는 상실됐다. 편집자는 현장 전문가와 협의하여 내용을 보존하는 단순화 작업을 수행했습니다.
복사 가능한 템플릿 4개
1) 무거운 단어 상당(확인 조건):
아래 라틴 문자가 포함된 오래된 터키어 텍스트에서 agravated 단어에 대해 오늘날 가능한 대응 항목 목록을 제공하세요. 각 단어에 대해 "확실하지 않음, 사전에서 확인해야 함"을 기록해 두십시오. 본문에 없는 단어를 추가하여 본문을 완성합니다. 본문: [여기에 본문 붙여넣기]
2) 두 가지 버전 단순화:
다음 텍스트를 두 가지 방법으로 단순화합니다. (1) 의미와 이미지를 유지하는 가까운 버전, (2) 변경한 각 단어에 대한 이전/새 동등어를 표시하는 표. 부족한 부분을 채우고, 존재하지 않는 의미를 더하는 것. 확실하지 않은 부분을 표시하세요.텍스트: [텍스트 붙여넣기]
3) 단순화 제어:
아래는 실제 텍스트와 단순화된 내용입니다. 내 버전에서 의미가 왜곡되거나 생략되거나 잘못 표현된 부분을 표시하세요. 자신만의 버전을 강요하지 마세요. 문제가 있는 부분을 지적하고 추론을 텍스트에 연결하면 됩니다. 원본: [...] 내 버전: [...]
4) 플롯/콘셉트 설명:
다음 대련의 고전적인 이미지와 은유를 설명하십시오. 각각에 대해 가능한 의미, 전통적 사용법 및 "전문가 소스에서 확인해야 함"을 참고하세요. 최종적인 판단을 내리지 말고 대안적인 해석도 제시하십시오. 커플렛: [커플릿 작성]
약한 프롬프트 / 강한 프롬프트
약함: "이 오스만 문서를 오늘날의 터키어로 번역하세요."
Strong: "아래의 라틴 문자로 오래된 터키어 텍스트를 단순화하십시오. 이미지와 은유를 보존하고 문자 그대로의 의미로 축소하지 마십시오. 변경한 각 단어를 이전/새 표에 표시하십시오. 누락되거나 모호한 부분을 완성하고 '불확실함, 전문가가 확인해야 함'으로 표시하십시오. 텍스트에 없는 단어나 구절을 추가하지 마십시오."
강력한 프롬프트는 완료 트랩을 닫고 콘텐츠 손실을 방지하며 확인을 더 쉽게 해주는 테이블을 표시합니다. 약한 프롬프트는 AI가 적합하고 원활하게 작동할 수 있도록 문을 열어 둡니다.
작업 및 보안 테이블
사업
AI 혼자
올바른 사용
라틴 문자 텍스트에서 무거운 단어의 의미
위험한
초안 + 사전 확인
아랍어 문자의 음역
안 끝났어
전문 언어학자
단순화
초안
전문적인 점검
누락된 텍스트를 완성하세요
절대 이루어지지 않음
에디션/전문가
설명
가설
전문가 출처의 확인
과학 에디션
안 끝났어
언어학자
아루즈와 미터: AI가 왜 특별한 어려움을 겪는가?
대부분의 고전 터키 시는 아루즈(패턴을 기반으로 음절의 길이와 짧음을 기반으로 한 측정 시스템)로 작성되었습니다. 한 쌍의 아루즈 패턴을 결정하려면 음절이 긴지 짧은지 하나씩 해독하고 몇 가지 미묘한 사항(예: 긴 음절을 두 개의 짧은 음절로 계산하거나 모음을 삭제하는 등)을 알아야 합니다. 이것은 규칙적이지만 매우 미묘한 작업이며 AI가 종종 잘못되는 부분입니다. 패턴의 이름을 잘못 지정하거나 음절을 잘못 측정하거나 "좋은 소리"이지만 잘못된 패턴을 제안할 수 있습니다.
따라서 아루즈 미터를 결정하는 것은 AI가 맹목적으로 할 수 있는 작업이 아닙니다. 기껏해야 "후보"를 제공하며 이 후보는 미터에 대한 지식이 있는 사람이 커플릿 자체에서 확인해야 합니다. 음절 운율(각 줄의 음절 수를 기준으로 한 민요 운율)의 정지 및 패턴 분석에도 동일하게 적용됩니다. AI는 음절 계산에서 실수를 할 수도 있습니다. 미터는 문학적 분석의 정확성을 테스트하는 곳입니다. 미터에 대한 잘못된 주장은 에세이를 처음부터 신뢰할 수 없게 만듭니다.
주의: AI가 부여한 운율 패턴 이름을 검증 없이 연구에 입력하지 마세요(예: "failatün fallatün..."). 측정은 기술적이고 문화적인 지식이며, 이 분야에서는 인간의 전문 지식이 필수적입니다. "이 쌍의 척도를 어디서 찾아야 하며, 어떤 패턴이 가능한가?"라는 질문에 대한 지침으로 AI를 기껏해야 사용합니다.
일반적인 실수
- 확인하지 않고 전사/간소화를 게시합니다. 각 출력은 원본 텍스트와 비교됩니다.
- AI가 누락된 텍스트를 채우도록 합니다. 이것은 존재하지 않는 텍스트를 구성하고 있습니다. 확실히 끝나지 않았습니다.
- 의미를 문자 그대로의 의미로 축소합니다. 고전적인 이미지는 보존되어야 합니다.
- 독서만이 확실하다고 생각하는 것. 아랍어 문자에서는 다중 읽기가 일반적입니다. 대안에 대해 물어보세요.
- 전문가와 상담하지 않고 중요한 텍스트를 마무리합니다. 인간 문헌학자는 이 분야에서 없어서는 안 될 존재입니다.
요약하면
오래된 텍스트의 AI; 이해력 지원, 어휘 가설 및 단순화 스케치를 위한 유용하지만 위험도가 높은 도구입니다. 필사, 편집, 누락된 텍스트 완성 등의 작업은 전문 문헌학자의 몫입니다. 원본 텍스트, 신뢰할 수 있는 사전 및 최신 버전으로 각 인쇄물을 확인합니다. 완성과 평탄화의 함정에 빠지지 마세요. 이 분야에서는 인간의 전문성이 속도보다 우선합니다.
응용과제
라틴 문자로 된 짧고 단순화되지 않은 고대 텍스트(디반 커플릿 또는 역사 단락)를 찾으십시오. "2가지 버전 단순화" 템플릿을 사용하여 AI로부터 청사진을 얻으세요. 그런 다음 신뢰할 수 있는 사전을 사용하여 단어 테이블의 각 단어를 확인합니다. 잘못된 것을 선택하십시오. 이미지를 문자 그대로의 의미로 축소했는지 확인하고 필요한 경우 수정하세요.
체크리스트
- [ ] AI가 아랍어 문자 전사를 스스로 수행하도록 하지 않았습니다.
- [ ] 누락된/불명확한 부분을 작성하지 않았습니다.
- [ ] 믿을 수 있는 사전에서 해당 단어를 확인했습니다.
- [ ] 이미지와 이미지가 보존되는 것을 확인하였습니다.
- [ ] 나는 비평 텍스트를 전문으로 하는 언어학자와 상담했습니다.