zisky:
- Umět rozlišit, kde umělá inteligence šetří čas v historii a archivní práci (přepis, editace, skenování, návrh) a kde je interpretace, kritika zdroje a konečné rozhodnutí ponecháno na odborníkovi v závislosti na míře rizika.
- Schopnost aplikovat ověřovací disciplínu proti halucinacím připojením každého výstupu ke zdroji, křížovým potvrzením a filtrováním na anachronismus.
- Abychom pochopili, proč by měla být důvěrnost, autorská práva a kulturní citlivost zohledňována v historii a archivních materiálech od samého počátku.
Když historik nebo archivář sedí u svého stolu, často je před ním obrovská hromada: zažloutlé sešity, mikrofilmované noviny, tisíce digitálních fotografií, ručně psané dopisy, úřední korespondence, pozemkové knihy. Číst, organizovat, definovat a dávat smysl této hromadě je práce, která trvá roky. Umělá inteligence (zkráceně AI; počítačové systémy, které se učí vzory, generují a klasifikují text z velkého množství textu a obrázků) může dramaticky urychlit mechanickou a opakující se část této práce. Ale právě v oboru, jako je historie a archivnictví, které se spoléhá na důkazy, zdroje a přesnost, musíte od začátku vědět, kde je AI užitečná a kde je nebezpečná.
Tato jednotka je kompasem celého modulu. Zde probereme, kde AI šetří čas v historii a archivní práci, kde je nepostradatelný úsudek lidského experta, proč musí být každý výstup ověřen a jaké jsou specifické etické hranice tohoto oboru.
Správné umístění AI: asistent, nikoli osoba s rozhodovací pravomocí
Nejzákladnější pravidlo je toto: AI je asistent, nikoli historik nebo archivář. AI; Je to rychlý pomocník, který přepíše dokument, shrne kolekci, přeloží text, navrhne metadata pro kolekci a označí vzory. Ale rozhodnutí, která vyžadují úsudek, interpretaci a odpovědnost, jako „je tento dokument skutečný“, „co tato událost znamená“, „je tento zdroj spolehlivý“, „jak by měla být tato sbírka organizována“, náleží odborníkovi.
Pojďme si tento rozdíl objasnit tabulkou:
obchodní typ
Je AI výkonná?
Čí odpovědnost?
Převod tištěného textu na strojový text (OCR)
Ano, velmi rychle
lidské bytosti správně
Návrh transkripce rukopisu
Částečně je míra chyb vysoká
Lidé to určitě opraví
Shrňte/naskenujte tisíce dokumentů
Ano
Člověk přichází ke zdroji
Nástin metadat (datum, místo, předmět).
Ano
člověk schvaluje
Rozhodování o pravosti dokumentu
ne
Pouze odborník
Historický výklad a stanovení příčiny a následku
ne
pouze historik
Vyhodnoťte důvěryhodnost zdroje
ne
Pouze odborník
Abychom tento obrázek shrnuli do jedné věty: AI připraví data, expert dává smysl a rozhodne.
Proč je ověřování zásadní: halucinace a anachronismus
Největším nebezpečím používání AI v humanitních a společenských vědách jsou halucinace. Halucinace je, když AI sebevědomě vymýšlí informace, zdroj nebo citát, který ve skutečnosti neexistuje. Namísto toho, aby řekla „nevím“, má AI tendenci vyplnit prázdné místo vymyšlenou odpovědí, která vypadá věrohodně. V historii je to fatální: odkaz na neexistující dokument, vykonstruovaná historie, slovo, které se ve skutečnosti nevyslovilo, událost, která se nestala.
Druhým velkým nebezpečím je anachronismus. Anachronismus je nesprávné umístění prvku jednoho období (slova, instituce, technologie, konceptu) do jiného období. Vzhledem k tomu, že umělá inteligence je školena s dnešním jazykem a koncepty, je náchylná k vysvětlování minulosti dnešními objektivy a přenášení neexistujících institucí nebo termínů do minulosti. Například při shrnutí dokumentu ze 16. století může použít název nebo administrativní jednotku, která v té době neexistovala.
Upozornění: Každé datum, jméno, číslo, citace a zdroj, které AI produkuje, je tvrzení, nikoli fakt, dokud si to nezávisle neověříte. „Umělá inteligence to řekla“ není zdrojem v historiografii; je to pouze vodítko, které vás nasměruje ke skutečnému zdroji.
Ověřovací disciplína: tři kroky
Pojďme navrhnout zvyk ověřování, který budeme opakovat v tomto modulu:
1. Připojte se ke zdroji. Založte každé hlavní tvrzení AI na původním dokumentu, archivním odkazu nebo spolehlivé publikaci. Nepoužívejte tvrzení, které nemá žádný zdroj.
2. Křížově potvrďte. Pro kritickou skutečnost (datum, jméno, událost) vyhledejte alespoň dva nezávislé zdroje. Je shrnutí AI stejné jako to, co říká skutečný dokument?
3. Filtrujte přes anachronismus a konzistenci. Existuje termín, který neodpovídá období, nemožné datum, nekonzistentní název ve výstupu? Zeptejte se "Vyhovuje to tomuto období?" z pohledu odborníka.
tři mini pouzdra
Případ 1 – Vymyšlená archivní reference. Postgraduální student požádal AI o „archivní zdroje“ k tématu. YZ vrátil 6 archivních odkazů, jejichž formát se zdál být perfektní: název fondu, číslo souboru, datum. Když student prohledal archivní katalog, zjistil, že 4 ze 6 referencí vůbec neexistují. Zbývající 2 měly špatná čísla. Poučení: Žádnou referenci vygenerovanou AI nelze použít bez ověření v katalogu.
Případ 2 – OCR zkráceno ze 40 hodin na 6 hodin. Městský archiv v letech 1950 až 1970 zdigitalizoval 3200 stran tištěných radních zápisů. Ruční přepis se odhadoval na 40 pracovních dnů. S OCR vyšel nezpracovaný text během několika minut; Zaměstnanci text opravili a ověřili do 6 pracovních dnů. AI snížila mechanickou práci o 85 %, ale konečné čtení a úpravy zůstaly na člověku.
Případ 3 – Anachronické shrnutí. Archivář nechal YZ shrnout záznam o založení z 18. století. Resumé bylo plynulé, ale používal moderní administrativní termín, který se v dokumentu nevyskytuje a do doby nepatří. Pokud by archivář nešel až k původnímu dokumentu, byl by tento anachronismus zaznamenán v katalogizačním záznamu. Lekce: abstrakt je vždy porovnáván s hlavním dokumentem.
Čtyři kopírovatelné šablony
1) Otevření, které určuje role a hranice:
Vaše role: asistent pracující v historii a archivech. Mezi vaše úkoly patří úprava textu, vytváření obrysů a označování vzorů. Přísná pravidla: (1) Spoléhejte se pouze na text, který jsem vám dal, nepřidávejte fakta, data ani zdroje z vlastní „paměti“. (2) Pokud si nejste jisti, napište "nejistý", nevymýšlejte. (3) Neuvádějte žádná tvrzení, která nemají žádný zdroj. Potvrďte, jestli rozumíte, pak dám text.
2) Antihalucinační instrukce:
Shrňte text níže. Pravidla: nepřidávejte žádná jména, data, místa nebo čísla, která nejsou JASNĚ uvedena v textu. Nepřidávejte ani „pravděpodobně“ informace, které v textu nejsou. Není-li informace v textu obsažena, napište „v textu neuvedeno“. Text: [zde]
3) Kontrola anachronismu:
Přečtěte si níže uvedený návrh shrnutí [semestrálního] příspěvku. Označte termíny, instituce, názvy a koncepty, které do tohoto období nepatří. U každého stručně napište, proč je to podezřelé. Nedělejte konečný soud; Uveďte pouze body, které by měl odborník na člověka zkontrolovat. Koncept: [zde]
4) Analyzátor nároků na zdroj:
Rozdělte každou větu v následujícím textu do dvou kategorií: (A) Fakt zapsaný přímo ve zdroji, (B) Interpretace/inference. Označte také každé prohlášení, jehož zdroj není jasný, jako „potřebuje ověření“. Text: [zde]
Slabá výzva / Silná výzva
slabé:
Řekněte mi o tomto osmanském dokumentu.
Tato výzva vyzývá AI, aby mluvila ze své vlastní „paměti“ a přidala vymyšlené detaily a anachronismus.
Silný:
Vaše role je asistent historie. POUZE na základě dokumentu jsem vložil níže uvedený přepis: (1) vyjmenujte osoby, místa a data uvedená v dokumentu, (2) odhadněte typ dokumentu, ale můžete říci „nejsem si jistý“, (3) přidejte jakékoli informace, které nejsou v textu, (4) označte podezřelé/nečitelné oblasti pomocí [?]. Dokument: [zde]
Rozdíl je jasný: role, závislost na jediném zdroji, zákaz výroby, povolení označit nejednoznačnost a jasná struktura výstupu činí výstup spolehlivým.
Etika, soukromí a kulturní citlivost
Historie a archivní materiál není nevinná hromádka textu. Může obsahovat osobní údaje lidí (občanské záznamy, zdravotní záznamy, soudní dokumenty), citlivé vzpomínky komunity, díla chráněná autorským právem a kulturně citlivé materiály. Několik zásad:
- Soukromí: Nahrávání citlivých dokumentů, které umožňují identifikovat živé osoby (osobní údaje) do veřejných nástrojů umělé inteligence, by mohlo být právním i etickým porušením. Dodržujte datovou politiku vaší instituce a příslušnou legislativu.
- Autorská práva: Ne každý dokument, který digitalizujete, může být volným dílem. Než je dáte AI, zvažte práva.
- Kulturní citlivost: Některé komunity mají slovo v tom, jak se používají jejich historické materiály. „Účinný“ návrh AI nemůže ignorovat citlivost komunity.
- Transparentnost: Zaznamenejte, že přepis nebo metadata generovaná AI byly vytvořeny pomocí AI. To je nezbytné, aby si to mohli ověřit další výzkumníci.
Tip: Před nahráním dokumentu do cloudového nástroje AI si položte jednu otázku: „Kdo by byl poškozen, kdyby se obsah tohoto dokumentu objevil na internetu?“ Pokud je odpověď „nikdo“, vyhledejte nejprve firemní schválení a bezpečné nástroje.
Časté chyby
- Záměna AI za historika. AI nevykládá ani nerozhoduje; jsou připraveni. Smysl a zodpovědnost leží na vás.
- Použití výstupu bez jeho ověření. Každé datum, jméno, citace a reference jsou nárokem; Není to fakt, dokud to nepotvrdí zdroj.
- Spoléhat se na vymyšlené zdroje. AI může produkovat důvěryhodné, ale neexistující reference; Hledejte v katalogu.
- Přehlédnutí anachronismu. Filtrujte výstupy, které popisují minulost dnešním jazykem s dobovou perspektivou.
- Nahrávání citlivých dokumentů nahodile. Od začátku zvažte osobní údaje, autorská práva a kulturní citlivost.
V souhrnu
V historii a archivaci je umělá inteligence výkonným pomocníkem, který ohromně urychluje mechanickou a opakující se práci (přepis, úpravy, skenování, navrhování metadat). Ale právě na tomto poli důkazů jsou halucinace a anachronismus skutečným nebezpečím. Propojit každý výstup se zdrojem, křížově ověřit, filtrovat období; Výklad, rozhodnutí a konečnou odpovědnost si vždy nechte pro sebe. Od prvního dne dodržujte soukromí, autorská práva a kulturní citlivost. S touto disciplínou se AI stává nástrojem, který historický výzkum urychluje, nikoli zpomaluje.
Aplikační úkol
Vyberte historický dokument, který máte, tištěný nebo digitální. Nejprve umístěte AI pomocí šablony „Otevření role a hranice nastavení“. Při shrnutí dokumentu pak použijte „antihalucinační instrukce“. Označte výstup "source-claim parser" a porovnejte každé prohlášení označené "musí být ověřeno" se skutečným dokumentem. Všimněte si, kolik bodů bylo přidáno nebo zkresleno AI.
kontrolní seznam
- [ ] Umělou inteligenci jsem umístil jako asistenta, ne jako osobu s rozhodovací pravomocí.
- [ ] Jen jsem chtěl, aby to bylo založeno na zdroji, který jsem uvedl.
- [ ] Každé datum, jméno a odkaz jsem nezávisle ověřil.
- [ ] Filtroval jsem výstup na anachronismy.
- [ ] V citlivých dokumentech jsem pozoroval důvěrnost, autorská práva a kulturní citlivost.