Vinster:
- Förmåga att minska juridiska risker genom att utvärdera upphovsrättsstatusen för indata och datavillkoren för verktyget och ifrågasätta rättigheterna för utdata
- Förmåga att skydda personuppgifter genom anonymisering och minimering och säkerställa integritet genom att vara transparent för användaren
- Förmåga att upprätta ett styrningsramverk för institutionen som inkluderar godkända verktyg, förbjudna data och verifieringsregler och testa dess användning med biblioteksvärden.
Bibliotekarien och informationsansvarig är någon som inte bara organiserar och presenterar information, utan också skyddar den: skydda skaparens rättigheter, användarens integritet och institutionens ansvar. Artificiell intelligens utmanar alla tre områden med nya och komplexa frågor. Är det ett upphovsrättsbrott att ladda upp ett dokument till AI? Kränker det integritet att ge användardata till ett AI-verktyg? Hur ska organisationen hantera användningen av AI? I denna avslutande enhet kommer vi att etablera ett ramverk som sammanför de etiska och juridiska trådar som vi har berört genom hela modulen.
Låt oss definiera begreppen. Upphovsrätt är den lagliga rättighet som tillerkänns skaparen av ett verk över användningen av hans verk; Otillåten kopiering eller användning kan betraktas som intrång. Personuppgifter är all information som direkt eller indirekt identifierar en person och är föremål för rättsskydd. Styrning är ramen för regler, policyer och ansvarsskyldighet som styr en organisations användning av AI. Dessa tre koncept utgör den juridiska och etiska grunden för ansvarsfull AI-användning.
Steg för steg: ansvarsfull och laglig användning av AI
1. Utvärdera upphovsrättsstatusen för bidraget. Innan du laddar in en text, bok eller artikel i ett AI-verktyg, överväg upphovsrättsstatusen för det verket och villkoren för användningen av verktyget. Att ge ett upphovsrättsskyddat verk till ett verktyg som använder data som du laddar upp för sina egna syften kan utgöra en kränkning av rättigheter.
2. Ifrågasätt utgångens rättigheter. Upphovsrättsstatusen för texten som produceras av AI:n kan vara osäker, och AI:n kan omedvetet reproducera upphovsrättsskyddat innehåll i träningsdata. Innan du publicerar en AI-utdata, utvärdera dess originalitet och potentiella överträdelser.
3. Skydda personuppgifter. Användarnas identitet, läs-/sökhistorik och personlig information ska inte gå in i något AI-verktyg utan uttryckligt medgivande och starkt skydd. Anonymisering och dataminimering (endast så mycket data som behövs) är väsentliga.
4. Säkerställa transparens och samtycke. Användare bör veta hur deras data och interaktioner behandlas; Där AI är inblandat bör detta tydligt anges. Användningen av hemlig AI undergräver förtroendet.
5. Upprätta ett ramverk för styrning. Organisationen bör i en skriftlig policy fastställa vilka verktyg som är godkända, vilka data som kan matas in, vem som är ansvarig och hur utdata ska verifieras.
Tips: Skapa ett enkelt "AI-användningsregler" för din organisation: vilka verktyg som är godkända, vilka data som aldrig skrivs in (personlig/proprietär/konfidentiell), hur varje utdata verifieras och vem är ansvarig. En tydlig guide på en sida är mer verkställbar än en lång policy.
Etiska principer och värderingar för bibliotekarie
Bibliotekaryrkets djupt rotade värderingar fungerar som en kompass i AI:s tidsålder: lika tillgång till information, tankefrihet, användarnas integritet, intellektuell ärlighet och opartiskhet. AI kan antingen stödja eller hota dessa värden. Det kan utöka tillgången men förstärka fördomar; kan påskynda tjänsten men kan äventyra integriteten; Det kan underlätta upptäckt men kan sprida felaktig information.
Den ansvariga bibliotekarien testar varje AI-användning mot dessa värden: "Utjämnar denna användning åtkomst eller utesluter en grupp? Skyddar den integriteten? Ger den korrekt och ärlig information?" AI är ett verktyg; De värderingar som du kommer att använda det med är kärnan i yrket. Tekniken förändras, men dessa värderingar är bibliotekarskapets ständiga kompass.
Varning: "Alla använder det" eller "det är snabbt" motiverar inte användningen av en AI. Även om en användning är laglig kan den vara oetisk; Anta inte en praxis som är skadlig när det gäller upphovsrätt, integritet och rättvisa, bara för att det är enkelt. Det yttersta ansvaret ligger inte på verktyget, utan hos den professionella som använder det.
tre minifodral
Fall 1 — Upphovsrättsskyddad nedladdning har stoppats. Ett team planerade att ladda en hel upphovsrättsskyddad referensbok i ett allmänt AI-verktyg för att generera sammanfattningar. Informationsansvarig ansåg att detta var riskabelt, både vad gäller upphovsrätt och verktygets dataanvändningsvillkor; i stället studerades den endast i korta, auktoriserade utdrag och inom institutionens slutna system.
Fall 2 – Personuppgifter anonymiserade. Ett bibliotek ville analysera användarfeedback med AI; men feedbacken innehöll användarnamn och kontaktinformation. Teamet anonymiserade data före analys; endast anonyma, kollektiva tendenser bearbetades. Sekretessen bevarad, insikten återvunnen.
Fall 3 – Klyftan i förvaltningen sluten. I en organisation använde anställda olika AI-verktyg utan övervakning, ibland skrev de in konfidentiella dokument. Informationsadministratören publicerade en policy på en sida som definierar godkända verktyg, förbjudna datatyper och verifieringsregler; Osäkerhet och risk har minskat avsevärt.
Personalkompetens och företagskultur
En förvaltningspolitik är bara så stark som de människor som genomför den. Även den bäst skrivna regeln finns kvar på papper om anställda inte förstår riskerna med AI. Den varaktiga grunden för ansvarsfull AI-användning är därför personalens kompetens: varje anställds förståelse av vad en hallucination är, vilken data som aldrig ska matas in och varför en utdata ska verifieras. Bibliotek och informationsinstitutioner har en dubbel roll i detta avseende; Den måste både utbilda sin egen personal och sprida denna läskunnighet till användarna. En bra företagskultur är en som rapporterar ett AI-fel snarare än att dölja det, och tycker att det är normalt att säga "Jag är inte säker på den här utdatan, låt oss verifiera." I en miljö där misstag är dolda av rädsla för straff sprids en påhittad källa eller ett kränkning av integriteten obemärkt. Dessutom, eftersom teknik och verktyg förändras snabbt, bör policy och utbildning uppdateras regelbundet snarare än en gång. Styrning; Det är ett levande system där regler, verktyg, utbildning och kultur samverkar. I centrum för detta system står den kompetenta personen, som tar ansvar och fattar det slutliga beslutet, inte fordonet.
Tips: Innan du använder ett nytt AI-verktyg, gör en liten pilot: prova det med ett begränsat team, på verkliga men lågriskuppgifter, registrera fel och risker. Detta både bygger upp kompetens och avslöjar policysårbarheter innan verktyget rullas ut i hela organisationen.
Fyra kopierbara mallar
1) Upphovsrättslig preliminär bedömning:
Hjälp mig att utvärdera följande innehåll för upphovsrätt innan det laddas in i ett AI-verktyg: kan innehållet vara upphovsrättsskyddat, vilket sätt att använda är riskabelt, vilket alternativ (utdrag, tillstånd, allmän egendom) är säkrare? Innehållstyp: [här]
2) Skanning av personuppgifter:
Innehåller följande text personuppgifter (namn, kontaktperson, identitet, läs-/sökhistorik, information som tyder på hälsa/tro)? Markera var och en, klassificera den och föreslå hur du kan anonymisera den. Text: [här]
3) Utkast till AI-användningspolicy:
Utkast till riktlinjer för användning av AI på en sida för vår organisation: (1) godkända verktygspolicyer, (2) datatyper som aldrig har angetts, (3) regel för utdatavalidering, (4) ansvarighet och transparens, (5) policyer för upphovsrätt och sekretess. Håll det kort och handlingskraftigt. Sammanhang: [här]
4) Etisk kontrollfråga:
Testa följande planerade AI-användning mot biblioteksvärden: rättvis åtkomst, integritet, noggrannhet/integritet, risk för partiskhet och flaggaproblem om några. Användning: [här]
Svag prompt / Stark prompt
Svag uppmaning:
Ska jag lägga den på AI för att sammanfatta den här boken?
Frågan tar inte hänsyn till upphovsrätt, datavillkor för verktyget och alternativ; Att svara "ja" kan leda till en kränkning av rättigheter.
Kraftfull uppmaning:
Din roll: biträdande upphovsrätts- och integritetsrådgivare. Jag överväger att ge följande innehåll till ett AI-verktyg. Lista möjliga problem när det gäller upphovsrättsstatus, användning av fordonsdata och risk för personuppgifter; föreslå säkrare alternativ (kort offert, tillstånd, allmän egendom, slutet system). Anspråk på rättssäkerhet, visa risker. Innehåll och sammanhang: [här]
Kraftfull uppmaning; Den överväger beslutet i termer av upphovsrätt, datavillkor och integritetsaspekter och lägger säkra alternativ på bordet.
Tabell för förvaltningsdimensioner
Storlek
grundläggande fråga
försiktighetsåtgärd
upphovsrätt
Finns det något in-/utdataintrång?
Tillstånd, allmän egendom, kort utdrag
integritet
Är personuppgifter skyddade?
Anonymisering, minimering
transparens
Vet användaren?
Tydlig information, samtycke
Ansvar
Vem är ansvarig?
Skriftlig policy, mänskligt godkännande
Värderingar
Skyddas åtkomst och integritet?
Etisk kontroll, bias check
Vanliga misstag
- Ladda upp upphovsrättsskyddat innehåll utan att tänka efter. Det finns risk för upphovsrättsintrång och datavillkor.
- Mata in personuppgifter i det offentliga verktyget. Integritetsintrång och juridisk risk.
- Döljer användningen av AI. Utan transparens skadas förtroendet.
- Att blanda ihop "lagligt" med "etiskt". En laglig användning kan vara oetiskt.
- Att inte upprätta ett ramverk för styrning. Okontrollerad användning skapar oförutsägbara risker.
Sammanfattningsvis
Upphovsrätt, konfidentialitet och etik är grunden för ansvar för bibliotekarie i AI-åldern. Utvärdera upphovsrättsstatusen för posten och datavillkoren för verktyget; ifrågasätta rättigheterna för produktionen; skydda personuppgifter med anonymisering och minimering; vara transparent för användaren och inhämta samtycke; Etablera ett tydligt ramverk för styrning i organisationen. De djupt rotade värdena för bibliotekarskap (lika tillgång, integritet, integritet, opartiskhet) är kompassen som testar varje användning av AI. Teknikförändringar; Ansvar och värderingar förändras inte, och det yttersta ansvaret ligger alltid hos människan.
Applikationsuppgift
Förbered ett dokument med en sidas användningsregler för din organisation (eller en fiktiv organisation) med mallen "AI-användningspolicyutkast": godkända verktyg, data som aldrig ska matas in, valideringsregel, ansvar. Testa sedan en riktig AI-användning som du planerar för åtkomst, integritet, noggrannhet och partiskhet med mallen "Etisk kontrollfråga" och skriv hur du kommer att ta itu med eventuella problem som uppstår.
checklista
- [ ] Jag utvärderade upphovsrättsstatusen för inlägget och datavillkoren för verktyget.
- [ ] Jag anonymiserade personuppgifter och använde bara det som var nödvändigt.
- [ ] Jag har varit öppen för användaren om användningen av AI och respekterat samtycke.
- [ ] Jag har skapat en skriven AI-användningspolicy för organisationen.
- [ ] Jag testade användningen med biblioteksvärden och höll ansvaret på människan.
Modulexamen
1. Vilket av följande är den mest exakta positioneringen för artificiell intelligens inom biblioteks- och informationshantering?
- A) AI är en sammanfattnings-, metadata-, sök- och rekommendationsassistent; Ansvaret för noggrannhet, källans tillförlitlighet och etiska beslut ligger hos människan ✔
- B) Artificiell intelligens kan på ett tillförlitligt sätt verifiera en källas äkthet och riktighet
- C) Artificiell intelligens fungerar bara i bokkatalogisering, det har inget att göra med annat biblioteksarbete
- D) Eftersom artificiell intelligens är mer opartisk än människor, bör ämnes- och klassificeringsbeslut överlåtas till den.
Beskrivning: Artificiell intelligens; Det är en assistent som ritar metadata, sammanfattar, översätter, markerar mönstret och pekar mot källan. Den behöriga experten ansvarar för uppgifter med hög konsekvens såsom verifiering av riktighet, ämnes- och klassificeringsbeslut, källans trovärdighet och beslut om upphovsrätt och integritet; En overifierad utgång kan leda till spridning av en påhittad källa eller en kränkning av integriteten.
2. Varför är "hallucination" särskilt farlig för bibliotekarien?
- A) Produktionen av artificiell intelligens produceras mycket långsamt och slösar bort tid
- B) Artificiell intelligens kan på ett övertygande sätt producera obefintliga källor och citat, och kärnan i yrket är källans äkthet ✔
- C) Hallucinationer förekommer endast vid bildbehandling, det har inget med text att göra
- D) Hallucinationer ses bara i mycket gamla artificiell intelligensverktyg, inte i nuvarande verktyg.
Förklaring: En hallucination är när artificiell intelligens producerar en obefintlig källa, citat eller information på ett extremt övertygande sätt. Eftersom kärnan i yrket är källans äkthet och tillförlitlighet, om ett tillverkat avtryck eller citat överförs till en bibliografi eller användare utan verifiering, kommer allvarlig desinformation att uppstå.
3. Vilket av följande är det område med högst risk för tillverkning vid framställning av metadata med artificiell intelligens och hur ska det åtgärdas?
- A) Språkområdet är det mest utsatta området och behöver inte verifieras
- B) Titelfältet har den högsta risken och bör fyllas med förutsägelse
- C) ISBN och publiceringsår medför den högsta risken för tillverkning och bör verifieras ordagrant med originalkällan ✔
- D) Inget fält är riskabelt eftersom artificiell intelligens alltid producerar metadata korrekt
Förklaring: Exakta, numeriska fält som ISBN och publiceringsår är mycket lätt förfalskade av AI; AI kan generera ett rimligt utseende i stället för ett ISBN som den inte känner till. Dessa fält måste verifieras ordagrant med originalkällan (streckkod, avtryck/kolofon).
4. Vad är huvudsyftet med att använda "kontrollerat ordförråd" när man tilldelar en ämnesterm?
- A) Säkerställa terminologikonsistens och tillgänglighet mellan poster; Förhindra artificiell intelligens från att göra upp fria villkor ✔
- B) Lägg automatiskt till varje ny term som efterfrågas av artificiell intelligens i katalogen
- C) Eliminera ämnesord helt och sök endast på titel
- D) Sakta ner katalogiseringen och skriva varje post med olika termer
Beskrivning: En kontrollerad vokabulär är en lista över godkända och standardtermer. Om samma ämne är skrivet med olika termer i olika poster, kommer användaren att hitta den ena och missa den andra. Genom att ge AI:n den här listan och säga till den att "bara välja från listan", bibehålls konsekvens och hittabarhet; En ny term som inte är listad av artificiell intelligens bör inte läggas till i katalogen.
5. Vad är det korrekta tillvägagångssättet när man skaffar ett dokuments klassificeringsnummer från artificiell intelligens?
- A) Den exakta siffran som ges av artificiell intelligens bör accepteras direkt utan att titta på den officiella tabellen
- B) Klassificeringsnummer bör inte användas alls, källor bör slumpmässigt läggas på hyllan
- C) Förslaget till mästarklass bör betraktas som preliminärt, de exakta stegen bör verifieras med den officiella klassificeringstabellen ✔
- D) Eftersom artificiell intelligens inte kan klassificera, bör denna uppgift skippas helt
Förklaring: AI kan ofta hitta rätt huvudklass, men kan missa subnivåer (t.ex. medicinsk historia istället för medicin) eller producera felaktiga siffror som verkar rimliga. Därför bör masterklassförslaget betraktas som en början och de exakta stegen bör verifieras med den officiella klassificeringstabellen.
6. Vilket påstående är sant när man jämför semantisk sökning och nyckelordssökning?
- A) Semantisk sökning bör ersätta nyckelordssökning i alla fall
- B) Semantisk sökning hittar semantiskt relaterade resurser; Sökordssökning efter exakt titel eller ISBN är mer tillförlitlig ✔
- C) Sökordssökning hittar källor med olika termer som är semantiskt relaterade bättre än semantisk sökning
- D) Semantisk sökning fungerar bara på numeriska data, inte på text
Beskrivning: Semantisk sökning hittar olika ord men relaterade resurser, som "sömnproblem" och "sömnstörning", eftersom den matchar betydelsen av ord (via inbäddningsvektorer). När man däremot letar efter ett exakt ISBN-nummer, fullständig titel eller lagnummer är en nyckelords-/domänsökning mer tillförlitlig. Bästa praxis är att använda båda tillsammans.
7. Vilken är bibliotekariens skyldighet mot risken för en "filterbubbla" i personliga resursrekommendationer?
- A) Stärk bubblan genom att endast rekommendera de mest liknande resurserna till användaren
- B) Att helt avstå från att komma med förslag
- C) Dela användarens läshistorik offentligt
- D) Att medvetet lägga till källor med olika perspektiv och horisonter och ange detta transparent ✔
Förklaring: Filterbubblan är när rekommendationssystemet ständigt låser användaren till liknande innehåll och håller dem borta från nya och annorlunda perspektiv. Bibliotekets värde är jämlik och mångsidig tillgång; Därför bryter bibliotekarien medvetet bubblan genom att lägga till annorlunda utseende, ögonöppnande resurser och ange detta transparent.
8. Vilken praxis är korrekt i termer av 'äkthet och integritet' vid bearbetning av ett arkivdokument med artificiell intelligens?
- A) "försköna" dokumentet med artificiell intelligens, komplettera det genom att ta igen de saknade delarna och byt ut originalet
- B) Ta bort det råa originalet och behålla endast versionen förbättrad med artificiell intelligens
- C) OCR ska endast korrigera igenkänningsfel, innehåll ska inte ändras, råoriginalet ska bevaras och derivat ska vara tydligt märkta ✔
- D) Acceptera OCR-utgången som "ren text" utan några korrigeringar och öppna den för sökning.
Beskrivning: Kärnan i arkivarbete är försäkran om att dokumentet kommer från den påstådda källan och att dess innehåll inte har ändrats. OCR-korrigering bör endast ta bort igenkänningsfel, inte ändra innehållet; AI "restaurering" är inte en ersättning för faktiska bevis eftersom det kan utgöra saknade delar. Den råa (original) skanningen ska alltid bevaras, derivat ska vara tydligt märkta.
9. Vilket av följande är nödvändigt för ansvarsfull konstruktion av en biblioteksinformationsbot?
- A) Boten producerar svar på varje fråga snabbt utifrån sin allmänna kunskap och citerar inte källor
- B) Boten förlitar sig endast på verifierad företagsinformation, citerar fakta och riktar känsliga frågor till en expert/människa ✔
- C) Boten ger direkt exakta råd i medicinska och juridiska frågor
- D) Döljer för användaren om han pratar med en bot eller en människa
Förklaring: Rådgivningsroboten bör endast förlita sig på den verifierade aktuella informationen och källlistan för institutionen, inte på dess allmänna minne, bör ge fakta genom att citera källan, bör inte ge råd om medicinska/juridiska/känsliga frågor, bör rikta den till experten och bör överföra den till människan när det behövs. Boten ersätter alltså inte människan, utan blir snarare ett lager som lättar på bördan.
10. Inom bibliometri, vad är den korrekta metoden för att ta reda på en författares citeringsantal eller h-index?
- A) Frågar AI direkt, eftersom siffrorna den ger alltid är korrekta
- B) Hämta siffrorna från den faktiska hänvisningsdatabasen; Använder endast artificiell intelligens för att organisera och tolka dessa data ✔
- C) Uppskatta siffrorna och använd dem i sändningsbeslut
- D) Att betrakta antalet citeringar som ett direkt mått på kvaliteten på en författares arbete.
Förklaring: Artificiell intelligens kan utgöra värden som citationsantal och h-index utan att komma åt riktiga data (det kan till exempel ge ett värde på 42 när det faktiskt är 19). Därför måste siffror och hänvisningar tas från en riktig hänvisningsdatabas; AI bör endast användas för att gruppera, sortera och tolka denna verkliga data.
11. Vad är sant om gränsen för bibliometriska mått (antal citeringar, h-index, impact factor)?
- A) Mätvärden mäter direkt kvalitet och är jämförbara mellan olika domäner
- B) Kriterier kan användas säkert ensamma vid anställnings- och befordransbeslut.
- C) Mätvärden indikerar användning, inte kvalitet; kan inte jämföras mellan olika domäner och måste balanseras med kvalitativ bedömning ✔
- D) Humaniora-resultaten är fullt och fullständigt representerade i citeringsdatabaser
Offentliggörande: Dessa mätvärden indikerar användning och synlighet, de är inte direkta kvalitetsmått. Eftersom fältens citeringskultur är olika (som medicin och filosofi) kan de inte direkt jämföras; Boktunga produktioner inom humaniora är underrepresenterade i databaser. Därför bör kriterier inte användas ensamma för att utvärdera individer, utan bör balanseras med kvalitativ utvärdering.
12. Vilken är den viktigaste fördelen med RAG-metoden (access-augmented manufacturing) jämfört med en allmän AI?
- A) Avsevärt minska hallucinationen genom att länka svaret till institutionens verkliga dokument och citera källan ✔
- B) Svara alltid perfekt, oavsett kvaliteten på dokumentbasen
- C) Att göra hallucinationer helt och permanent omöjliga
- D) Öppna alla dokument för alla utan behov av åtkomstkontroll
Förklaring: När man svarar på en fråga hittar RAG först de relevanta delarna från institutionens egna dokument och tar fram svaret endast baserat på dessa delar med källan. På så sätt kopplas svaret till verklig och spårbar dokumentation och hallucinationerna reduceras avsevärt. RAG eliminerar dock inte hallucinationen helt, eftersom svaret fortfarande kan vara fel om fel pjäs tas upp.
13. Inom humaniora och samhällsvetenskap, vilken är den mest tillförlitliga metoden för att verifiera ett citat från en AI till en användare?
- A) Se till att citatet ser trovärdigt och flytande ut
- B) Bara att be AI:n att återge samma citat
- C) Verifiera citatet genom att hitta det i författarens verkliga verk ✔
- D) Acceptera att det är tillräckligt att citatet tillskrivs ett känt namn
Beskrivning: Artificiell intelligens kan generera helt påhittade citat som tillskrivs en verklig författare; Det faktum att citatet verkar ord för ord korrekt och övertygande är inte ett bevis på dess riktighet. Den mest tillförlitliga metoden är att verifiera citatet genom att hitta det i författarens verkliga verk; Logiken i "den här författaren kan ha sagt något liknande" är inte tillräckligt.
14. Vilken princip är korrekt i att använda artificiell intelligens när det gäller upphovsrätt, integritet och etik?
- A) Upphovsrättsskyddade och personliga uppgifter kan läggas in i offentliga verktyg utan eftertanke eftersom det är snabbt
- B) Om en användning är laglig är den definitivt etisk och ingen ytterligare utvärdering krävs.
- C) När artificiell intelligens producerar en output, övergår ansvaret helt och hållet till verktyget, inte till människan.
- D) Upphovsrätt och integritet måste respekteras från allra första början; anonymisering, transparens och samtycke är väsentliga och det yttersta ansvaret ligger hos människan ✔
Förklaring: Impulsiv inmatning av upphovsrättsskyddat innehåll och personuppgifter (användar-ID, läs-/sökhistorik) i allmänna artificiella intelligensverktyg kan resultera i en kränkning av rättigheter och integritet; Anonymisering, dataminimering, transparens och samtycke är väsentliga. Dessutom, även om en användning är laglig, kan den vara oetisk; "alla använder det" eller "det händer snabbt" motiverar inte en praxis och det yttersta ansvaret ligger hos experten, inte verktyget.