이득:
- 위험 수준에 따라 인공지능이 기록 및 보관 작업(기록, 편집, 스캐닝, 초안)에서 시간을 절약하는 부분과 해석, 소스 비평 및 최종 결정을 전문가에게 맡기는 부분을 구별할 수 있습니다.
- 각 출력을 소스에 연결하고 이를 교차 확인하고 시대착오적으로 필터링하여 환각에 대한 검증 규율을 적용하는 기능입니다.
- 역사와 아카이브 자료에서 처음부터 기밀성, 저작권, 문화적 민감성을 고려해야 하는 이유를 이해합니다.
역사가나 기록 보관인이 책상에 앉으면 그 앞에는 누런 공책, 마이크로필름으로 처리된 신문, 수천 장의 디지털 사진, 손으로 쓴 편지, 공식 서신, 토지 기록 등이 쌓여 있는 경우가 많습니다. 이 더미를 읽고, 구성하고, 정의하고, 이해하는 것은 수년이 걸리는 노동입니다. 인공 지능(간단히 AI, 패턴을 학습하고 대량의 텍스트와 이미지에서 텍스트를 생성 및 분류하는 컴퓨터 시스템)은 이러한 노동의 기계적이고 반복적인 부분을 극적으로 가속화할 수 있습니다. 하지만 증거, 출처, 정확성에 의존하는 역사나 아카이브 같은 분야에서는 AI가 어디에 도움이 되고, 어디에 위험한지 처음부터 알아야 합니다.
이 단위는 전체 모듈의 나침반입니다. 여기에서는 AI가 역사 및 아카이브 작업에서 시간을 절약하는 부분, 인간 전문가의 판단이 반드시 필요한 부분, 모든 출력물을 검증해야 하는 이유, 이 분야의 구체적인 윤리적 경계에 대해 논의합니다.
AI의 올바른 위치 지정: 의사결정자가 아닌 보조자
가장 기본적인 규칙은 다음과 같습니다. AI는 역사가나 기록 보관자가 아닌 보조자입니다. 일체 포함; 문서를 복사하고, 컬렉션을 요약하고, 텍스트를 번역하고, 컬렉션에 대한 메타데이터를 제안하고, 패턴에 플래그를 지정하는 빠른 도우미입니다. 그러나 "이 문서가 진짜인가", "이 사건이 무엇을 의미하는가", "이 출처는 신뢰할 수 있는가", "이 컬렉션을 어떻게 구성해야 하는가" 등 판단과 해석, 책임이 필요한 결정은 전문가의 몫입니다.
표를 통해 이 차이점을 명확히 해보겠습니다.
사업 유형
AI는 강력한가?
누구의 책임입니까?
인쇄된 텍스트를 기계 텍스트(OCR)로 변환
네, 매우 빠릅니다
인간이 맞다
원고 전사 초안
부분적으로 오차범위가 높다
사람들은 반드시 고칠 것이다
수천 개의 문서를 요약/스캔하세요
예
인간은 근원으로 내려온다
메타데이터(날짜, 위치, 제목) 개요
예
인간이 승인한다
문서의 진위 여부 결정
아니
전문가 전용
역사적 해석과 원인과 결과의 확립
아니
역사가 전용
소스 신뢰성 평가
아니
전문가 전용
이 그림을 한 문장으로 요약하면 다음과 같습니다. AI가 데이터를 준비하고, 전문가가 이해하고 결정을 내립니다.
검증이 필수적인 이유: 환각과 시대착오
인문사회과학에서 AI를 활용할 때 가장 큰 위험은 환각이다. 환각은 AI가 실제로 존재하지 않는 정보, 출처 또는 인용문을 자신있게 조작하는 경우입니다. AI는 “모르겠어요”라고 말하는 대신, 믿을 수 있을 것 같은 꾸며낸 답변으로 빈칸을 채우는 경향이 있다. 역사상 이것은 치명적입니다. 존재하지 않는 문서에 대한 언급, 조작된 역사, 실제로 말하지 않은 단어, 일어나지 않은 사건입니다.
두 번째 큰 위험은 시대 착오입니다. 시대착오주의는 한 시대의 요소(단어, 제도, 기술, 개념)를 다른 시대에 잘못 배치하는 것입니다. AI는 오늘날의 언어와 개념으로 훈련되기 때문에 오늘날의 렌즈를 통해 과거를 설명하고 존재하지 않는 제도나 용어를 과거로 옮기는 경향이 있다. 예를 들어 16세기 문서를 요약할 때 당시 존재하지 않았던 제목이나 행정 단위를 사용할 수도 있다.
주의: AI가 생성하는 모든 날짜, 이름, 번호, 견적 및 출처는 귀하가 독립적으로 확인할 때까지 사실이 아닌 주장입니다. “AI가 그렇게 말했다”는 역사서의 출처가 아닙니다. 그것은 단지 실제 소스를 알려주는 단서일 뿐입니다.
검증 규율: 3단계
이 모듈 전체에서 반복할 검증 습관을 제안해 보겠습니다.
1. 소스에 연결합니다. AI에 대한 모든 주요 주장은 원본 문서, 보관 참고 자료 또는 신뢰할 수 있는 출판물을 기반으로 합니다. 출처가 없는 주장을 사용하지 마세요.
2. 교차 확인. 중요한 사실(날짜, 이름, 사건)에 대해서는 최소한 두 개의 독립적인 출처를 참조하세요. AI 요약이 실제 문서에 적힌 내용과 똑같나요?
3. 시대착오와 일관성을 통해 필터링하세요. 기간에 맞지 않는 용어, 불가능한 날짜, 출력되는 이름이 일치하지 않는 경우가 있나요? "이 시기에 어울리나요?"라고 물어보세요. 전문가의 관점에서.
세 개의 미니 케이스
사례 1 - 조작된 아카이브 참조. 한 대학원생이 AI에게 특정 주제에 대한 "아카이브 소스"를 요청했습니다. YZ는 형식이 완벽해 보이는 6개의 아카이브 참조(펀드 이름, 파일 번호, 날짜)를 반환했습니다. 학생이 아카이브 카탈로그를 검색했을 때 참고문헌 6개 중 4개가 전혀 존재하지 않는다는 것을 발견했습니다. 나머지 2개는 숫자가 틀렸습니다. 교훈: AI가 생성한 어떠한 참고자료도 카탈로그 검증 없이는 사용할 수 없습니다.
사례 2 - OCR이 40시간에서 6시간으로 단축되었습니다. 한 시 기록 보관소는 1950년부터 1970년 사이에 인쇄된 의회 의사록 3,200페이지를 디지털화했습니다. 수동 재작성은 영업일 기준으로 40일로 추정됩니다. OCR을 사용하면 원시 텍스트가 몇 분 안에 나옵니다. 직원이 영업일 기준 6일 이내에 문자를 수정하고 확인했습니다. AI는 기계적 작업을 85% 줄였지만 최종 읽기와 편집은 여전히 인간의 몫이었습니다.
사례 3 - 시대착오적인 요약. 한 기록 보관자는 YZ에게 18세기 기초 기록을 요약하도록 했습니다. 요약은 유창했지만 문서에는 나오지 않고 시대에도 속하지 않는 현대 행정용어를 사용했다. 기록 보관인이 원본 문서를 확인하지 않았다면 이 시대착오적 내용은 목록 기록에 기록되었을 것입니다. 교훈: 초록은 항상 기본 문서와 비교됩니다.
복사 가능한 템플릿 4개
1) 역할과 경계를 결정하는 개방:
귀하의 역할: 역사 및 기록 보관소에서 일하는 조수. 작업에는 텍스트 편집, 윤곽선 생성 및 패턴 표시가 포함됩니다. 엄격한 규칙: (1) 내가 제공한 텍스트에만 의존하고 자신의 "기억"에 있는 사실, 날짜 또는 출처를 추가하지 마십시오. (2) 확실하지 않은 경우에는 "불확실함"이라고 기재하고, 꾸며내지 마십시오. (3) 출처가 없는 주장을 하지 마십시오. 이해했는지 확인해주시면 문자 드리겠습니다.
2) 환각 방지 지침:
아래의 내용을 요약하세요. 규칙: 본문에 명확하게 언급되지 않은 이름, 날짜, 장소 또는 숫자를 추가하지 마십시오. 본문에 없는 "아마도" 정보도 추가하지 마세요. 본문에 해당 정보가 포함되어 있지 않은 경우에는 “본문에 명시되지 않음”이라고 기재합니다. 텍스트: [여기]
3) 시대착오적 점검:
아래의 [학기] 논문 요약 초안을 검토하세요. 이 기간에 속하지 않을 수 있는 용어, 기관, 제목 및 개념에 플래그를 지정하세요. 각 항목에 대해 의심스러운 이유를 간략하게 적어주세요. 최종 판단을 내리지 마십시오. 인간 전문가가 확인해야 할 사항만 나열합니다. 초안: [여기]
4) 소스-클레임 파서:
다음 텍스트의 각 문장을 두 가지 범주로 나눕니다. (A) 출처에 직접 작성된 사실, (B) 해석/추론. 또한 출처가 불분명한 각 진술에는 "확인 필요"로 표시하십시오. 텍스트: [여기]
약한 프롬프트 / 강한 프롬프트
약함:
이 오스만 문서에 대해 말해주세요.
이 프롬프트는 AI가 자신의 "기억"에서 말하고 조작된 세부 사항과 시대착오를 추가하도록 유도합니다.
강한:
귀하의 역할은 역사 조수입니다. 문서에만 근거하여 아래 사본을 붙여넣었습니다. (1) 문서에 언급된 사람, 장소 및 날짜를 나열합니다. (2) 문서 유형을 추측하지만 "잘 모르겠습니다"라고 말할 수 있습니다. (3) 텍스트에 없는 정보를 추가하고, (4) 의심스럽거나 읽을 수 없는 부분을 [?]로 표시합니다. 문서: [여기]
차이점은 분명합니다. 역할, 단일 소스에 대한 의존성, 제작 금지, 모호성을 표시할 수 있는 허용, 명확한 출력 구조가 출력을 신뢰할 수 있게 만듭니다.
윤리, 개인 정보 보호 및 문화적 감수성
역사와 아카이브 자료는 순진한 텍스트 더미가 아닙니다. 여기에는 사람들의 개인 데이터(민사 기록, 건강 파일, 법원 문서), 민감한 커뮤니티 추억, 저작권이 있는 저작물 및 문화적으로 민감한 자료가 포함될 수 있습니다. 몇 가지 원칙:
- 개인 정보 보호: 살아있는 사람을 식별할 수 있게 만드는 민감한 문서(개인 데이터)를 공용 AI 도구에 업로드하는 것은 법적 및 윤리적 위반이 될 수 있습니다. 해당 기관의 데이터 정책 및 관련 법률을 준수하십시오.
- 저작권: 디지털화한 모든 문서가 공개 도메인에 속할 수는 없습니다. AI에 권리를 부여하기 전에 권리를 고려하십시오.
- 문화적 민감성: 일부 공동체는 역사적 자료가 어떻게 사용되는지에 대해 발언권을 갖고 있습니다. AI의 "효율적인" 제안은 커뮤니티의 민감성을 무시할 수 없습니다.
- 투명성: AI가 생성한 전사 또는 메타데이터가 AI의 도움으로 생성되었음을 기록합니다. 이는 후속 연구자들이 검증할 수 있도록 하기 위해 필요합니다.
팁: 클라우드 기반 AI 도구에 문서를 업로드하기 전에 "이 문서의 내용이 인터넷에 나타나면 누가 피해를 입을까요?"라는 질문을 던져보세요. 대답이 "아무도 없음"이라면 먼저 회사 승인과 안전한 도구를 찾으십시오.
일반적인 실수
- AI를 역사학자로 착각합니다. AI는 해석하거나 결정하지 않습니다. 그들은 준비되었습니다. 그 의미와 책임은 당신에게 있습니다.
- 출력을 검증하지 않고 사용합니다. 모든 날짜, 이름, 인용문 및 참조는 하나의 주장입니다. 출처가 확인되기 전까지는 사실이 아닙니다.
- 조작된 소스에 의존합니다. AI는 신뢰할 수 있지만 존재하지 않는 참조를 생성할 수 있습니다. 카탈로그에서 검색하세요.
- 시대 착오를 간과합니다. 시대적 관점을 사용하여 오늘날의 언어로 과거를 설명하는 출력을 필터링합니다.
- 민감한 문서를 함부로 업로드하는 행위. 처음부터 개인 데이터, 저작권, 문화적 민감성을 고려하세요.
요약하면
역사와 보관 분야에서 AI는 기계적이고 반복적인 작업(메타데이터 기록, 편집, 스캔, 초안 작성) 속도를 엄청나게 높이는 강력한 보조자입니다. 그러나 환각과 시대 착오가 실제로 위험하다는 것은 바로 이 증거 분야에서입니다. 각 출력을 소스, 교차 검증, 기간 필터에 연결합니다. 해석, 결정 및 최종 책임은 항상 본인에게 있습니다. 첫날부터 개인 정보 보호, 저작권 및 문화적 민감성을 관찰하십시오. 이 분야를 통해 AI는 역사 연구 속도를 늦추는 것이 아니라 가속화하는 도구가 됩니다.
응용과제
인쇄 또는 디지털 중 보유하고 있는 역사적 문서를 선택하세요. 먼저 “개방 설정 역할 및 경계” 템플릿으로 AI를 배치합니다. 그런 다음 문서를 요약할 때 "환각 방지 지침"을 사용하세요. 출력에 "source-claim parser"라는 태그를 지정하고 "반드시 확인해야 함"이라고 표시된 각 설명을 실제 문서와 비교합니다. AI가 얼마나 많은 포인트를 추가하거나 왜곡했는지 확인하세요.
체크리스트
- [ ] 나는 AI를 의사결정자가 아닌 보조자로 포지셔닝했습니다.
- [ ] 단지 제가 제공한 소스를 기반으로 작성하고 싶었을 뿐입니다.
- [ ] 각 날짜, 이름 및 참조를 독립적으로 확인했습니다.
- [ ] 시대착오적인 내용이 있는지 출력을 필터링했습니다.
- [ ] 나는 민감한 문서의 기밀성, 저작권 및 문화적 민감성을 관찰했습니다.