Gevinster:
- Å kunne skille hvor kunstig intelligens sparer tid i bibliotekararbeidsflyten (metadata, sammendrag, søk, forslag) og hvor nøyaktighet, kildepålitelighet og personvernbeslutninger overlates til mennesker, avhengig av risikonivå.
- Evne til å bruke en disiplin som verifiserer hver utgang ved å koble den til kilden, bekrefte den i en uavhengig kilde og sende den gjennom et biasfilter.
- Å forstå hvorfor hallusinasjoner, oppdiktede kilder og brukernes personvern er risikoer som må tas i betraktning i dette yrket helt fra begynnelsen.
Når en katalogiseringsspesialist setter seg ved skrivebordet sitt om morgenen, kan han ha dusinvis av nyankomne bøker, hundrevis av dokumenter fra en donasjonssamling og en arkivboks som venter på å bli digitalisert. En referansebibliotekar (eksperten som hjelper brukere med å finne informasjon) svarer på spørsmål i løpet av dagen som "hvor er den pålitelige kilden om dette emnet?" En informasjonsansvarlig er ansvarlig for å holde en organisasjons tusenvis av dokumenter synlige og pålitelige. I denne enheten skal vi avklare hvor nøyaktig kunstig intelligens (AI kort fortalt; store språkmodeller og lignende verktøy) sparer tid i disse oppgavene, og hvor dømmekraft, valg og ansvar forblir hos mennesket.
La oss starte med en definisjon: kunstig intelligens, som vi mener språkgenererende og mønstergjenkjennende programvareverktøy trent på store mengder tekst. Disse verktøyene oppsummerer, oversetter, foreslår klassifisering, genererer tekstutkast og flagger mønstre i store databiter. Men den vet ikke om en kilde virkelig eksisterer, om en informasjon er korrekt, eller om en brukers personvern er beskyttet. Derfor er AI en assistent, ikke en beslutningstaker innen bibliotekar og informasjonshåndtering.
Hvor fungerer kunstig intelligens og hvor fungerer det ikke?
La oss dele bibliotekararbeidsflyten inn i tre lag. Det første laget er mekaniske og repeterende oppgaver: trekke ut utkast til metadata fra hovedlinjen til en bok, oppsummere en lang rapport, oversette tekst fra ett språk til et annet, rense en tabell med data. AI er kraftig her og sparer mye tid.
Det andre laget er kvasi-rettslig arbeid: hvilken emneoverskrift skal gi et dokument, om en ressurs skal inkluderes i en samling, hvilken ressurs å anbefale til en bruker. AI produserer forslag her, men eksperten som kjenner institusjonens policy og de reelle behovene til brukeren har siste ordet.
Det tredje laget er ren dømmekraft og ansvarlighet: bekreftelse av at informasjonen er nøyaktig, avgjørelse om opphavsrett, om sensitive personopplysninger skal avsløres, bekrefter påliteligheten til en kilde. På dette laget er AI-ens utgang bare et utgangspunkt; Ansvaret ligger helt og holdent hos mennesker.
Tips: Før du gir en oppgave til AI, spør deg selv: "Hva skjer hvis denne utgangen er feil?" Hvis svaret er «Jeg kaster bort litt tid», bruk gjerne AI. Hvis svaret er "en falsk kilde spres, en bruker blir villedet eller personopplysninger lekket", sørg for å bekrefte utdataene.
Hallusinasjoner: bibliotekarens største fare
Hallusinasjon er når AI produserer ikke-eksisterende informasjon, kilde eller sitat som om den var ekte, og på et ekstremt overbevisende språk. Dette er spesielt farlig for bibliotekar og informasjonshåndtering; fordi essensen av vårt yrke er ektheten og påliteligheten til kilden.
Når du ber AI om å «foreslå fem akademiske artikler om dette emnet», kan den generere titler, forfattere og tidsskriftnavn som virker ekte, men som ikke eksisterer i det hele tatt. Disse fabrikkerte kildene er så overbevisende at en beskytter eller til og med en bibliotekar kan legge dem til i en bibliografi uten å verifisere dem. Innen humaniora og samfunnsvitenskap er faren enda større: Når «det dokumentet fra 1897» er fabrikkert for en historiker eller «den rettsavgjørelsen» for en jurist, blir resultatet alvorlig feilinformasjon.
OBS: Ingen kildehenvisninger, sitater eller referanser produsert av AI skal overføres hvor som helst uten bekreftelse i en ekte katalog, database eller selve kilden. Bare fordi det "ser overbevisende ut" betyr ikke det at det er sant.
Verifikasjonsdisiplin: tre trinn
Den grunnleggende disiplinen som bibliotekaren må bruke når han jobber med AI er denne:
1. Koble til kilden. Alle fakta, figurer, dato og avtrykk må være basert på en originalkilde. Spør AI "fortell meg fra hvilken kilde du fikk denne informasjonen" og sjekk den kilden uavhengig.
2. Bekreft uavhengig. Bekreft kritisk informasjon i minst én pålitelig kilde utenfor AI (autentisk katalog, offisiell database, primærdokument).
3. Før den gjennom forspenningsfilteret. AI bærer skjevhetene til dataene den er trent på. Et foreslått emne, en liste med forslag eller et sammendrag kan fremheve visse synspunkter og skjule andre. Spør hvem som er utelatt, hvilket perspektiv som mangler.
Personvern og brukernes personvern
Et av de mest grunnleggende etiske prinsippene i bibliotekarfaget er brukernes personvern: hva en person leser, hva han søker etter og hvilket emne han er interessert i er konfidensielt. Å legge inn data i AI-verktøy, spesielt offentlige verktøy som opererer over Internett, som inkluderer brukernes identitet, søkehistorikk eller lånte ressurser kan bryte med dette prinsippet; fordi disse dataene kan gå til tredjeparts systemer.
På samme måte, i en organisasjon, bør ikke uklassifiserte, men sensitive dokumenter (personellinformasjon, kontrakter, intern korrespondanse) lastes opp til et generelt AI-verktøy. Verktøy som kjører på institusjonens eget sikre, lukkede system foretrekkes for denne typen data.
Tips: Før du legger inn data i AI, spør "Er denne informasjonen offentlig?" spørre. Hvis svaret er nei, eller du ikke er sikker, legg disse dataene i et de-personliggjort, anonymt format eller bruk kun sikre verktøy godkjent av institusjonen.
tre minisaker
Sak 1 — Utkast til metadata for 400 dokumenter. Et universitetsbibliotek måtte katalogisere et arkiv med 400 dokumenter donert av en professor. Eksperten hentet ut et utkast til tittel, dato og emneforslag fra første side av hvert dokument med AI: gjennomsnittlig tid per dokument gikk ned fra 12 minutter til 4 minutter. Men hvert utkast ble sammenlignet med originaldokumentet og godkjent av eksperten; 17 feil datoer laget av AI ble fanget i dette trinnet.
Sak 2 - Falsk kilde fanget. En rådgivende bibliotekar mottok 6 artikkelforslag fra YZ mens han søkte etter ressurser om "klimamigrasjon" for en studenter. Bibliotekaren søkte i alle i institusjonens database: 2 av 6 artikler fantes ikke i det hele tatt. Verifikasjonstrinnet forhindret at studenten fikk en oppdiktet kilde.
Sak 3 – Konfidensialitetsbrudd forhindret. Et bibliotek vurderte å bruke et generelt AI-verktøy for å analysere "hvilken bruker er interessert i hvilket emne" fra kassaposter. Informasjonssjefen innså at det ville være et brudd på personvernet for disse dataene å gå ut med bruker-IDen; dataene ble først anonymisert og behandlet utelukkende som aggregert, avidentifisert statistikk.
Fire kopierbare maler
1) Begynn å definere roller og grenser:
Din rolle: erfaren assistent katalogisering og informasjonshåndtering spesialist. Din oppgave: å lage et utkast fra informasjonen i kilden jeg ga deg. Regler: (1) Bruk kun informasjonen i teksten jeg ga deg, ikke legg til din egen informasjon. (2) Merk "[må verifiseres]" der du ikke er sikker. (3) Ikke lag opp noen datoer, navn eller avtrykk. Hvis du forstår, start. Kilde: [her]
2) Spørsmål om validering:
List opp hver enkelt påstand (dato, navn, nummer, kildehenvisning) i teksten nedenfor. For hver: hvor i teksten fikk du denne informasjonen? Hvis det ikke står tydelig i teksten, skriv "ikke i teksten". Tekst: [her]
3) Kontroll av skjevhet og manglende perspektiv:
Hvilke perspektiver fremhever følgende sammendrag/anbefaling, og hvilke utelater den? Hvilke grupper, regioner eller synspunkter kan mangle? Bare stol på teksten, ikke spekuler. Tekst: [her]
4) Forhåndssjekk av personvern:
Inneholder teksten nedenfor personopplysninger (navn, ID-nummer, kontakt, lese-/søkehistorikk) eller sensitiv bedriftsinformasjon? Hvis ja, skriv det opp og foreslå hvordan det kan anonymiseres. Tekst: [her]
Svak forespørsel / Sterk forespørsel
Svak melding:
Finn meg noen ressurser om dette emnet.
Denne forespørselen inviterer AI til å generere falske ressurser. Det er ingen roller, grenser, valideringsregler og ressurser. AI kan produsere troverdige, men ikke-eksisterende tagger.
Kraftig ledetekst:
Din rolle: referansebibliotekarassistent. Velg de som er relatert til emnet "klimamigrasjon" fra katalogoppføringene jeg har gitt deg nedenfor og forklar hvorfor de er relevante. Ikke legg til kilder som ikke er på listen, ikke fabriker kilder. Når du ikke er sikker, si «det er ingen egnede kilder oppført». Katalogoppføringer: [her]
Forskjellen er tydelig: sterk melding tvinger AI til å jobbe fra den gitte virkelige kilden, ikke fra sitt eget minne, og forhindrer fabrikasjon.
Lag- og ansvarstabell
virksomhetslag
prøveoppgave
Rollen til AI
mannens avgjørelse
mekanisk
Utkast til metadata, sammendrag, oversettelse
Gir utkast raskt
verifikasjon, godkjenning
kvasi-rettslig
Emnetittel, kildeforslag
gir forslag
Valg etter policy
ren dømmekraft
Autentisering, opphavsrettsbeslutning
Kun foreløpig informasjon
Fullt ansvar ligger hos personen
Vanlige feil
- Erstatter AI-utgangen med kilden. AI er en assistent, ikke en ressurs; Hver utgang er validert.
- Å akseptere den oppdiktede kilden som overbevisende. Bare fordi det ser bra ut, betyr det ikke at det er riktig.
- Legge inn personlige/sensitive data i det offentlige verktøyet. Brukernes personvern og bedriftens konfidensialitet respekteres helt fra begynnelsen.
- Ignorerer fordommer. AI bærer perspektivene til dataene den er trent på; Spør hva som mangler.
- Overlater dommen til AI. Avgjørelser om nøyaktighet, opphavsrett og personvern tilhører mennesker.
Oppsummert
kunstig intelligens; Det er en kraftig assistent for oppsummering, utkast, oversettelse og mønstermerking i bibliotekar og informasjonshåndtering. Det sparer mye tid i mekanisk arbeid; gir råd om kvasi-rettslige spørsmål; Men verifisering av nøyaktighet, pålitelighet av kilden, brukernes personvern og etiske beslutninger tilhører mennesker. Hallusinasjoner er den største faren for dette yrket: ingen kildekreditter eller sitater brukes uten bekreftelse. Kjør AI med klare rolle-, grense- og valideringsregler; Bekreft hver kritisk utgang med en uavhengig kilde.
Søknadsoppgave
Velg et ekte emne fra ditt felt. Spør AI om 5 ressursanbefalinger om det emnet, og søk deretter hver av dem i en faktisk katalog eller database og legg merke til hvor mange som faktisk finnes. Deretter, med malen "Oppstart definerer roller og grenser", forteller AI at den bare skal fungere fra en tekst du gir, og sammenligne utdataene fra de to tilnærmingene. Skriv hvilken tilnærming som hindrer tilpasning.
sjekkliste
- [ ] Jeg bestemte hvilket lag (mekanisk, semi-judicial, ren dømmekraft) oppgaven er på.
- [ ] "Hva skjer hvis denne utgangen er feil?" Jeg stilte spørsmålet.
- [ ] Jeg har verifisert hver kreditt og sitering mot en uavhengig kilde.
- [ ] Jeg har sjekket at det ikke er personlig/sensitiv informasjon i dataene som kommer inn i AI.
- [ ] Jeg holdt den endelige avgjørelsen og ansvaret etter eget skjønn.