Enhet 1 / 12

Introduktion till artificiell intelligens i historia och arkivering: roller, gränser, validering och etik

Vinster:

  • Att kunna urskilja var artificiell intelligens sparar tid i historik och arkivarbete (transkription, redigering, scanning, utkast) och var tolkning, källkritik och slutgiltigt beslut lämnas till experten beroende på risknivå.
  • Förmåga att tillämpa en verifieringsdisciplin mot hallucination genom att ansluta varje utgång till källan, korsbekräfta den och filtrera den för anakronism.
  • För att förstå varför sekretess, upphovsrätt och kulturell känslighet bör beaktas i historia och arkivmaterial från allra första början.

När en historiker eller arkivarie sitter vid hans skrivbord ligger det ofta en stor hög framför honom: gulnade anteckningsböcker, mikrofilmade tidningar, tusentals digitala fotografier, handskrivna brev, officiell korrespondens, jordeböcker. Att läsa, organisera, definiera och förstå denna hög är ett arbete som tar år. Artificiell intelligens (AI förkortat; datorsystem som lär sig mönster, genererar och klassificerar text från stora massor av text och bilder) kan dramatiskt påskynda den mekaniska och repetitiva delen av detta arbete. Men just inom ett område som historia och arkivering, som förlitar sig på bevis, källor och noggrannhet, måste man redan från början veta var AI är till hjälp och var det är farligt.

Denna enhet är kompassen för hela modulen. Här kommer vi att diskutera var AI sparar tid i historia och arkivarbete, där bedömningen av en mänsklig expert är oumbärlig, varför varje utdata måste verifieras och de specifika etiska gränserna för detta område.

Placera AI på rätt sätt: assistent, inte beslutsfattare

Den mest grundläggande regeln är denna: AI är en assistent, inte en historiker eller arkivarie. AI; Det är en snabbhjälp som transkriberar ett dokument, sammanfattar en samling, översätter text, föreslår metadata för en samling och flaggar mönster. Men beslut som kräver omdöme, tolkning och ansvar, som "är detta dokument på riktigt", "vad betyder denna händelse", "är denna källa tillförlitlig", "hur ska denna samling organiseras" tillhör experten.

Låt oss förtydliga denna distinktion med en tabell:

affärstyp

Är AI kraftfull?

Vems ansvar?

Konvertera utskriven text till maskintext (OCR)

Ja, väldigt snabbt

människor rätt

Utkast till manuskripttranskription

Delvis är felmarginalen hög

Folk kommer definitivt att fixa det

Sammanfatta/skanna tusentals dokument

Ja

Människan kommer ner till källan

Metadata (datum, plats, ämne) översikt

Ja

människan godkänner

Besluta om ett dokuments äkthet

nej

Endast expert

Historisk tolkning och fastställande av orsak och verkan

nej

endast historiker

Utvärdera källans trovärdighet

nej

Endast expert

För att sammanfatta denna bild i en mening: AI förbereder data, experten är vettig och fattar beslutet.

Varför verifiering är viktigt: hallucinationer och anakronism

Den största faran med att använda AI inom humaniora och samhällsvetenskap är hallucinationer. En hallucination är när en AI med tillförsikt tillverkar information, en källa eller ett citat som faktiskt inte existerar. Istället för att säga "Jag vet inte", tenderar AI att fylla i tomrummet med ett påhittat svar som verkar trovärdigt. I historien är detta ödesdigert: en referens till ett icke-existerande dokument, en påhittad historia, ett ord som faktiskt inte talas, en händelse som inte hände.

Den andra stora faran är anakronism. Anakronism är felplaceringen av en del av en period (ett ord, institution, teknologi, koncept) i en annan period. Eftersom AI är tränad med dagens språk och begrepp är den benägen att förklara det förflutna genom dagens linser och överföra icke-existerande institutioner eller termer till det förflutna. När han till exempel sammanfattar ett 1500-talsdokument kan han använda en titel eller administrativ enhet som inte fanns vid den tiden.

Varning: Varje datum, namn, nummer, citat och källa som AI producerar är ett påstående, inte ett faktum, tills du självständigt verifierar det. "AI:n sa det" är inte en källa i historieskrivning; det är bara en ledtråd som leder dig till den verkliga källan.

Verifieringsdisciplin: tre steg

Låt oss föreslå en valideringsvana som vi kommer att upprepa under hela denna modul:

1. Anslut till källan. Basera alla större påståenden från AI på originaldokumentet, arkivreferensen eller tillförlitlig publikation. Använd inte ett påstående som inte har någon källa.

2. Korsbekräfta. För ett kritiskt faktum (ett datum, ett namn, en händelse), konsultera minst två oberoende källor. Är sammanfattningen av AI densamma som vad det faktiska dokumentet säger?

3. Filtrera genom anakronism och konsekvens. Finns det en term som inte passar in i perioden, ett omöjligt datum, ett inkonsekvent namn i utgången? Fråga "passar det den här perioden?" ur ett expertperspektiv.

tre minifodral

Fall 1 — Tillverkad arkivreferens. En doktorand bad AI om "arkivkällor" om ett ämne. YZ returnerade 6 arkivreferenser vars format verkade vara perfekt: fondnamn, filnummer, datum. När studenten sökte i arkivkatalogen fann han att 4 av 6 referenser inte existerade alls. De återstående 2 hade fel nummer. Lektion: Ingen referens genererad av AI kan användas utan verifiering i katalogen.

Fall 2 — OCR reducerad 40 timmar till 6 timmar. Ett kommunalt arkiv har digitaliserat 3 200 sidor tryckta fullmäktigeprotokoll mellan 1950 och 1970. Manuell omskrivning beräknades till 40 arbetsdagar. Med OCR kom råtext ut på några minuter; En anställd korrigerade och verifierade texten inom 6 arbetsdagar. AI minskade det mekaniska arbetet med 85 %, men den slutliga läsningen och redigeringen förblev hos människan.

Fall 3 — Anakronistisk sammanfattning. En arkivarie lät YZ sammanfatta en stiftelseuppteckning från 1700-talet. Sammanfattningen var flytande, men den använde en modern administrativ term som inte förekommer i dokumentet och som inte hör till perioden. Om inte arkivarien hade gått ner till originaldokumentet skulle denna anakronism ha antecknats i katalogregistret. Lektion: abstraktet jämförs alltid med huvuddokumentet.

Fyra kopierbara mallar

1) Öppning som bestämmer roller och gränser:

Din roll: assistent som arbetar inom historia och arkiv. Dina uppgifter inkluderar att redigera text, producera konturer och markera mönster. Strikta regler: (1) Lita bara på texten jag gav dig, lägg inte till fakta, datum eller källor från ditt eget "minne". (2) Om du inte är säker, skriv "osäker", hitta inte på det. (3) Gör inga påståenden som inte har någon källa. Bekräfta om du förstår, så ger jag texten.

2) Anti-hallucinationsinstruktion:

Sammanfatta texten nedan. Regler: lägg inte till några namn, datum, platser eller nummer som inte TYDLIGT nämns i texten. Lägg inte ens till "förmodligen" information som inte finns i texten. Om en uppgift inte finns med i texten, skriv "ej specificerad i texten". Text: [här]

3) Anakronismkontroll:

Granska utkastet till sammanfattningen av [termin]uppsatsen nedan. Flaggtermer, institutioner, titlar och begrepp som kanske inte hör till denna period. För varje, skriv kort varför det är misstänkt. Gör inte en slutgiltig bedömning; Lista endast de punkter som den mänskliga experten bör kontrollera. Utkast: [här]

4) Källanspråkstolkare:

Dela in varje mening i följande text i två kategorier: (A) Fakta skrivet direkt i källan, (B) Tolkning/slutledning. Markera också varje påstående vars källa är otydlig som "behöver verifiering". Text: [här]

Svag prompt / Stark prompt

Svag:

Berätta för mig om detta osmanska dokument.

Denna uppmaning uppmanar AI att tala från sitt eget "minne", lägga till påhittade detaljer och anakronism.

Stark:

Din roll är historieassistent. Baserat ENDAST på dokumentet har jag klistrat in utskriften nedan: (1) lista de personer, platser och datum som nämns i dokumentet, (2) gissa typen av dokument men du kan säga "Jag är inte säker", (3) lägg till all information som inte finns i texten, (4) markera misstänkta/oläsbara områden med [?]. Dokument: [här]

Skillnaden är tydlig: roll, beroende av enskild källa, förbud mot tillverkning, tillåtelse att flagga tvetydighet och tydlig utdatastruktur gör utdata tillförlitlig.

Etik, integritet och kulturell känslighet

Historia och arkivmaterial är ingen oskyldig texthög. Det kan innehålla människors personuppgifter (civilregister, hälsohandlingar, domstolshandlingar), känsliga gemenskapsminnen, upphovsrättsskyddade verk och kulturellt känsligt material. Några principer:

  • Sekretess: Att ladda upp känsliga dokument som gör levande personer identifierbara (personuppgifter) till offentliga AI-verktyg kan vara både en juridisk och etisk kränkning. Observera din institutions datapolicy och relevant lagstiftning.
  • Upphovsrätt: Alla dokument du digitaliserar kanske inte är allmän egendom. Tänk på rättigheter innan du ger dem till AI.
  • Kulturell känslighet: Vissa samhällen har att säga till om hur deras historiska material används. AI:s "effektiva" förslag kan inte ignorera känsligheten hos en gemenskap.
  • Transparens: Registrera att en AI-genererad transkription eller metadata producerades med hjälp av AI. Detta är nödvändigt så att efterföljande forskare kan verifiera.
Tips: Innan du laddar upp ett dokument till ett molnbaserat AI-verktyg, ställ en fråga: "Vem skulle skadas om innehållet i det här dokumentet dök upp på Internet?" Om svaret är "ingen", leta först efter företagets godkännande och säkra verktyg.

Vanliga misstag

  • Misstag AI för en historiker. AI tolkar eller beslutar inte; de är redo. Meningen och ansvaret ligger hos dig.
  • Använda utgången utan att validera den. Varje datum, namn, citat och referens är ett påstående; Det är inte ett faktum förrän det är bekräftat av källan.
  • Förlitar sig på påhittade källor. AI kan producera trovärdiga men obefintliga referenser; Sök i katalogen.
  • Med utsikt över anakronismen. Filtrera de utdata som beskriver det förflutna i dagens språk med ett periodperspektiv.
  • Ladda upp känsliga dokument på måfå. Tänk på personuppgifter, upphovsrätt och kulturell känslighet från början.

Sammanfattningsvis

Inom historia och arkivering är AI en kraftfull assistent som enormt snabbar på mekaniskt och repetitivt arbete (transkribera, redigera, skanna, rita metadata). Men det är just inom detta bevisfält som hallucinationer och anakronism är verkliga faror. Länka varje utgång till källan, korsvalidera, period-filter; Håll alltid tolkningen, beslutet och slutansvaret för dig själv. Observera integritet, upphovsrätt och kulturell känslighet från dag ett. Med denna disciplin blir AI ett verktyg som accelererar historisk forskning, inte saktar ner den.

Applikationsuppgift

Välj ett historiskt dokument du har, antingen tryckt eller digitalt. Placera först AI med mallen "Öppningsinställningsroll och gräns". Använd sedan "anti-hallucinationsinstruktionen" när du har dokumentet sammanfattat. Tagga utdata med "source-claim parser" och jämför varje påstående märkt "måste verifieras" med det faktiska dokumentet. Notera hur många poäng som har lagts till eller förvrängts av AI.

checklista

  • [ ] Jag placerade AI som en assistent, inte som en beslutsfattare.
  • [ ] Jag ville bara att det skulle baseras på källan jag gav.
  • [ ] Jag har självständigt verifierat varje datum, namn och referens.
  • [ ] Jag filtrerade utdata för anakronismer.
  • [ ] Jag har iakttagit sekretess, upphovsrätt och kulturell känslighet i känsliga dokument.