Enhet 1 / 11

Introduktion till artificiell intelligens i biblioteksverksamhet och informationshantering: roller, gränser, autentisering, integritet och etik

Vinster:

  • Att kunna urskilja var artificiell intelligens sparar tid i bibliotekararbetets arbetsflöde (metadata, sammanfattning, sökning, förslag) och var noggrannhet, källtillförlitlighet och integritetsbeslut överlåts till människor, beroende på risknivån.
  • Möjlighet att tillämpa en disciplin som verifierar varje utdata genom att länka den till källan, bekräfta den i en oberoende källa och skicka den genom ett biasfilter.
  • Att förstå varför hallucinationer, påhittade källor och användarnas integritet är risker som måste beaktas i detta yrke redan från början.

När en katalogiseringsspecialist sätter sig vid sitt skrivbord på morgonen kan han ha dussintals nyanlända böcker, hundratals dokument från en donationssamling och en arkivlåda som väntar på att bli digitaliserad. En referensbibliotekarie (experten som hjälper användare att hitta information) svarar på frågor under dagen som "var finns den tillförlitliga källan om detta ämne?" En informationsansvarig är ansvarig för att hålla en organisations tusentals dokument upptäckbara och tillförlitliga. I denna enhet kommer vi att klargöra var exakt artificiell intelligens (AI kort sagt; stora språkmodeller och liknande verktyg) sparar tid i dessa uppgifter, och var omdömet, valet och ansvaret ligger kvar hos människan.

Låt oss börja med en definition: artificiell intelligens, med vilket vi menar språkgenererande och mönsterigenkännande mjukvaruverktyg som tränas på stora mängder text. Dessa verktyg sammanfattar, översätter, föreslår klassificering, genererar utkast till text och flaggar mönster i stora bitar av data. Men den vet inte om en källa verkligen existerar, om en information är korrekt eller om en användares integritet skyddas. Det är därför som inom biblioteks- och informationshantering är AI en assistent, inte en beslutsfattare.

Var fungerar artificiell intelligens och var fungerar det inte?

Låt oss dela upp bibliotekararbetet i tre lager. Det första lagret är mekaniska och repetitiva uppgifter: extrahera utkast till metadata från byline i en bok, sammanfatta en lång rapport, översätta text från ett språk till ett annat, rensa en tabell med data. AI är kraftfull här och sparar mycket tid.

Det andra lagret är kvasi-rättsligt arbete: vilken ämnesrubrik man ska ge ett dokument, om man ska inkludera en resurs i en samling, vilken resurs man ska rekommendera till en användare. AI tar fram förslag här, men experten som känner till institutionens policy och användarens verkliga behov har sista ordet.

Det tredje lagret är ren bedömning och ansvarsskyldighet: bekräfta att informationen är korrekt, besluta om upphovsrätt, om känsliga personuppgifter ska avslöjas, bekräfta tillförlitligheten hos en källa. Vid detta lager är AI:s utdata bara en startpunkt; Ansvaret ligger helt och hållet på människan.

Tips: Innan du ger en uppgift till AI, fråga dig själv: "Vad händer om denna utdata är fel?" Om svaret är "Jag ska slösa lite tid", använd gärna AI. Om svaret är "en falsk källa sprids, en användare vilseleds eller personlig data läcker", var noga med att verifiera resultatet.

Hallucinationer: bibliotekariens största fara

Hallucination är när AI producerar obefintlig information, källa eller citat som om det vore verkligt, och på ett extremt övertygande språk. Detta är särskilt farligt för biblioteksverksamhet och informationshantering; eftersom kärnan i vårt yrke är källans äkthet och tillförlitlighet.

När du säger till AI att "föreslå fem akademiska artiklar om detta ämne", kan det generera titlar, författare och tidskriftsnamn som verkar riktiga men som inte existerar alls. Dessa påhittade källor är så övertygande att en patron eller till och med en bibliotekarie kan lägga till dem i en bibliografi utan att verifiera dem. Inom humaniora och samhällsvetenskap är faran ännu större: när "det där dokumentet från 1897" är fabricerat för en historiker eller "det där domstolsbeslutet" för en jurist blir resultatet allvarlig desinformation.

Observera: Ingen källhänvisning, citat eller referens som producerats av AI bör överföras någonstans utan verifiering i en riktig katalog, databas eller själva källan. Bara för att det "ser övertygande ut" betyder det inte att det är sant.

Verifieringsdisciplin: tre steg

Den grundläggande disciplinen som bibliotekarien måste tillämpa när han arbetar med AI är denna:

1. Anslut till källan. Varje fakta, figur, datum och avtryck måste baseras på en originalkälla. Fråga AI:en "berätta för mig från vilken källa du fick denna information" och kontrollera den källan oberoende.

2. Bekräfta oberoende. Verifiera kritisk information i minst en pålitlig källa utanför AI (autentisk katalog, officiell databas, primärt dokument).

3. För den genom förspänningsfiltret. AI bär fördomarna i data den tränas på. Ett föreslaget ämne, en lista med förslag eller en sammanfattning kan lyfta fram vissa synpunkter och skymma andra. Fråga vem som är utanför, vilket perspektiv som saknas.

Sekretess och användarintegritet

En av de mest grundläggande etiska principerna för bibliotekarieyrket är användarnas integritet: vad en person läser, vad han söker efter och vilket ämne han är intresserad av är konfidentiellt. Att mata in data i AI-verktyg, särskilt offentliga verktyg som fungerar över Internet, som inkluderar användarnas identiteter, sökhistorik eller lånade resurser kan bryta mot denna princip; eftersom dessa data kan gå till tredje parts system.

På samma sätt, i en organisation, bör oklassificerade men känsliga dokument (personalinformation, kontrakt, intern korrespondens) inte laddas upp till ett allmänt AI-verktyg. Verktyg som körs på institutionens eget säkra, slutna system är att föredra för denna typ av data.

Tips: Innan du anger någon data i AI, fråga "Är denna information offentlig?" be. Om svaret är nej, eller om du inte är säker, lägg dessa uppgifter i ett avpersonifierat, anonymt format eller använd endast säkra verktyg som godkänts av institutionen.

tre minifodral

Fall 1 — Utkast till metadata för 400 dokument. Ett universitetsbibliotek var tvungen att katalogisera ett arkiv med 400 dokument som donerats av en professor. Experten extraherade ett utkast till titel, datum och ämnesförslag från första sidan i varje dokument med AI: genomsnittlig tid per dokument minskade från 12 minuter till 4 minuter. Men varje utkast till avtryck jämfördes med originaldokumentet och godkändes av experten; 17 felaktiga datum gjorda av AI fångades i detta steg.

Fall 2 — Falsk källa fångad. En rådgivande bibliotekarie fick sex artikelförslag från YZ när han sökte efter resurser om "klimatmigrering" för en student på grundutbildningen. Bibliotekarien sökte i dem alla i institutionens databas: 2 av 6 artiklar fanns inte alls. Verifieringssteget förhindrade att studenten fick en påhittad källa.

Fall 3 – Sekretessbrott förhindras. Ett bibliotek övervägde att använda ett allmänt AI-verktyg för att analysera "vilken användare som är intresserad av vilket ämne" från kassaposter. Informationschefen insåg att det skulle vara en kränkning av integriteten för denna data att gå ut med användar-ID; uppgifterna anonymiserades först och bearbetades enbart som aggregerad, avidentifierad statistik.

Fyra kopierbara mallar

1) Börja definiera roller och gränser:

Din roll: erfaren assistent katalogisering och informationshantering specialist. Din uppgift: att ta fram ett utkast från informationen i källan jag gav dig. Regler: (1) Använd endast informationen i texten jag gav dig, lägg inte till din egen information. (2) Markera "[måste verifieras]" där du inte är säker. (3) Hitta inga datum, namn eller avtryck. Om du förstår, börja. Källa: [här]

2) Valideringskontrollfråga:

Lista varje sakpåstående (datum, namn, nummer, källhänvisning) i texten nedan. För varje: var i texten fick du denna information? Om det inte står tydligt i texten, skriv "inte i texten". Text: [här]

3) Bias och saknade perspektivkontroll:

Vilka perspektiv lyfter följande sammanfattning/rekommendation fram och vilka utelämnar den? Vilka grupper, regioner eller åsikter kan saknas? Lita bara på texten, spekulera inte. Text: [här]

4) Förhandskontroll av sekretess:

Innehåller texten nedan personuppgifter (namn, ID-nummer, kontakt, läs-/sökhistorik) eller känslig företagsinformation? Om så är fallet, lista det och föreslå hur det kan anonymiseras. Text: [här]

Svag prompt / Stark prompt

Svag uppmaning:

Hitta mig några resurser om detta ämne.

Denna uppmaning uppmanar AI att generera falska resurser. Det finns inga roller, gränser, valideringsregler och resurser. AI kan producera trovärdiga men obefintliga taggar.

Kraftfull uppmaning:

Din roll: referensbibliotekarieassistent. Välj de som är relaterade till ämnet "klimatmigrering" från katalogposterna jag har gett dig nedan och förklara varför de är relevanta. Lägg inte till några källor som inte finns på listan, fabricera inte källor. När du inte är säker, säg "det finns inga lämpliga källor listade." Katalogposter: [här]

Skillnaden är tydlig: stark uppmaning tvingar AI att arbeta från den givna verkliga källan, inte från sitt eget minne, och förhindrar tillverkning.

Skikt- och ansvarstabell

affärslager

exempeluppgift

AI:s roll

mannens beslut

mekaniska

Utkast till metadata, sammanfattning, översättning

Ger snabbt utkast

verifiering, godkännande

kvasi-rättslig

Ämnestitel, källförslag

ger förslag

Urval enligt policy

rent omdöme

Autentisering, upphovsrättsbeslut

Endast preliminär information

Det fulla ansvaret ligger på personen

Vanliga misstag

  • Ersätter AI-utgången för källan. AI är en assistent, inte en resurs; Varje utgång är validerad.
  • Accepterar den påhittade källan som övertygande. Bara för att det ser bra ut betyder det inte att det är rätt.
  • Ange personliga/känsliga uppgifter i det offentliga verktyget. Användarnas integritet och företagssekretess respekteras från första början.
  • Ignorera fördomar. AI bär perspektiven på de data som den är tränad på; Fråga vad som saknas.
  • Överlåter bedömningen till AI. Beslut om noggrannhet, upphovsrätt och integritet tillhör människor.

Sammanfattningsvis

artificiell intelligens; Det är en kraftfull assistent för att sammanfatta, rita, översätta och markera mönster inom biblioteks- och informationshantering. Det sparar mycket tid i mekaniskt arbete; ger råd i kvasi-rättsliga frågor; Men verifiering av noggrannhet, källans tillförlitlighet, användarintegritet och etiska beslut tillhör människor. Hallucinationer är den största faran för detta yrke: inga källor eller citat används utan verifiering. Kör AI med tydliga roll-, gräns- och valideringsregler; Bekräfta varje kritisk utgång med en oberoende källa.

Applikationsuppgift

Välj ett riktigt ämne från ditt område. Fråga AI om 5 resursrekommendationer om det ämnet, sök sedan i var och en i en faktisk katalog eller databas och notera hur många som faktiskt finns. Sedan, med mallen "Startup definierar roller och gränser", berätta för AI:en att endast arbeta utifrån en text du tillhandahåller och jämför resultatet av de två tillvägagångssätten. Skriv vilket tillvägagångssätt som förhindrar anpassning.

checklista

  • [ ] Jag bestämde vilket lager (mekaniskt, halvrättsligt, rent omdöme) uppgiften ligger på.
  • [ ] "Vad händer om denna utdata är felaktig?" Jag ställde frågan.
  • [ ] Jag har verifierat varje kredit och citat mot en oberoende källa.
  • [ ] Jag har kontrollerat att det inte finns någon personlig/känslig information i data som kommer in i AI.
  • [ ] Jag behöll det slutliga beslutet och ansvaret efter eget gottfinnande.