Jedinica 1 / 11

Uvod u umjetnu inteligenciju u bibliotekarstvu i upravljanju informacijama: uloge, granice, autentifikacija, privatnost i etika

Dobici:

  • Mogućnost razlikovanja gdje umjetna inteligencija štedi vrijeme u toku rada bibliotekarstva (metapodaci, sažetak, pretraga, prijedlozi), a gdje su tačnost, pouzdanost izvora i odluke o privatnosti prepušteni ljudima, ovisno o nivou rizika.
  • Sposobnost primjene discipline koja provjerava svaki rezultat povezujući ga sa izvorom, potvrđujući ga u nezavisnom izvoru i propuštajući ga kroz filter pristranosti.
  • Razumijevanje zašto su halucinacije, izmišljeni izvori i privatnost korisnika rizici koji se moraju uzeti u obzir u ovoj profesiji od samog početka.

Kada stručnjak za katalogizaciju ujutro sjedne za svoj stol, možda ima desetine novopristiglih knjiga, stotine dokumenata iz zbirke donacija i arhivsku kutiju koja čeka na digitalizaciju. Referentni bibliotekar (stručnjak koji pomaže korisnicima da pronađu informacije) tokom dana odgovara na pitanja poput “gdje je pouzdan izvor o ovoj temi?” Menadžer informacija je odgovoran za održavanje hiljada dokumenata organizacije dostupnim i pouzdanim. U ovoj cjelini razjasnit ćemo gdje točno umjetna inteligencija (ukratko AI; veliki jezički modeli i slični alati) štedi vrijeme u ovim zadacima, a gdje prosuđivanje, izbor i odgovornost ostaju na čovjeku.

Počnimo s definicijom: umjetna inteligencija, pod kojom podrazumijevamo softverske alate za generiranje jezika i prepoznavanje obrazaca obučenih za velike količine teksta. Ovi alati sažimaju, prevode, predlažu klasifikaciju, generišu nacrt teksta i označavaju obrasce u velikim komadima podataka. Ali ne zna da li izvor zaista postoji, da li je informacija tačna ili je li zaštićena privatnost korisnika. Zato je u bibliotekarstvu i upravljanju informacijama AI pomoćnik, a ne donosilac odluka.

Gdje umjetna inteligencija radi, a gdje ne?

Podijelimo tok rada bibliotekarstva u tri sloja. Prvi sloj su mehanički i ponavljajući zadaci: izdvajanje nacrta metapodataka iz reda knjige, sažimanje dugog izvještaja, prevođenje teksta s jednog jezika na drugi, čišćenje tabele podataka. AI je moćan ovdje i štedi mnogo vremena.

Drugi sloj je kvazi-sudski rad: koji predmetni naslov dati dokumentu, da li uključiti resurs u zbirku, koji resurs preporučiti korisniku. AI ovdje daje prijedloge, ali posljednju riječ ima stručnjak koji poznaje politiku institucije i stvarne potrebe korisnika.

Treći sloj je čista prosudba i odgovornost: potvrđivanje da su informacije tačne, odlučivanje o autorskim pravima, da li će se otkriti osjetljive lične podatke, potvrda pouzdanosti izvora. Na ovom sloju, izlaz AI je samo početna tačka; Odgovornost je u potpunosti na ljudima.

Savjet: Prije nego što date zadatak AI, zapitajte se: “Šta se događa ako je ovaj izlaz pogrešan?” Ako je odgovor "izgubiću malo vremena", slobodno koristite AI. Ako je odgovor "lažni izvor se širi, korisnik je zaveden ili su lični podaci procurili", obavezno provjerite izlaz.

Halucinacije: najveća opasnost za bibliotekara

Halucinacija je kada AI proizvodi nepostojeće informacije, izvor ili citat kao da su stvarni, i to na izuzetno uvjerljivom jeziku. Ovo je posebno opasno za bibliotekarstvo i upravljanje informacijama; jer je suština naše profesije autentičnost i pouzdanost izvora.

Kada AI kažete da „predloži pet akademskih radova na ovu temu“, on može generirati naslove, autore i nazive časopisa koji izgledaju stvarni, ali uopće ne postoje. Ovi izmišljeni izvori su toliko uvjerljivi da ih pokrovitelj ili čak bibliotekar mogu dodati u bibliografiju bez njihove provjere. U humanističkim i društvenim naukama opasnost je još veća: kada se "taj dokument iz 1897. godine" izmisli za istoričara ili "ta sudska odluka" za pravnika, rezultat je ozbiljna dezinformacija.

Pažnja: nijedan izvor, citat ili referenca koje je proizvela AI ne bi trebalo nigdje prenijeti bez provjere u stvarnom katalogu, bazi podataka ili samom izvoru. Samo zato što "izgleda uvjerljivo" ne znači da je istina.

Disciplina verifikacije: tri koraka

Osnovna disciplina koju bibliotekar mora da primeni kada radi sa veštačkom inteligencijom je sledeća:

1. Povežite se na izvor. Svaka činjenica, brojka, datum i otisak moraju biti zasnovani na izvornom izvoru. Pitajte AI „recite mi iz kojeg izvora ste dobili ove informacije“ i provjerite taj izvor nezavisno.

2. Nezavisno potvrditi. Provjerite kritične informacije u barem jednom pouzdanom izvoru izvan AI (autentičan katalog, službena baza podataka, primarni dokument).

3. Provucite ga kroz filter za pristrasnost. AI nosi predrasude podataka na kojima se obučava. Predložena tema, lista prijedloga ili sažetak mogu istaknuti određene točke gledišta i zamagliti druge. Pitajte ko je izostavljen, koja perspektiva nedostaje.

Privatnost i privatnost korisnika

Jedan od najosnovnijih etičkih principa bibliotekarske profesije je privatnost korisnika: povjerljivo je ono što osoba čita, šta traži i koja tema ga zanima. Unošenje podataka u AI alate, posebno javne alate koji rade preko Interneta, što uključuje korisničke identitete, istoriju pretraživanja ili pozajmljene resurse može narušiti ovaj princip; jer ovi podaci mogu ići u sisteme trećih strana.

Isto tako, u organizaciji, neklasifikovani, ali osjetljivi dokumenti (informacije o osoblju, ugovori, interna prepiska) ne bi trebali biti učitani u opći alat za umjetnu inteligenciju. Alati koji rade na sopstvenom sigurnom, zatvorenom sistemu institucije su poželjniji za ovu vrstu podataka.

Savjet: Prije unosa bilo kakvih podataka u AI, pitajte "Jesu li ove informacije javne?" pitaj. Ako je odgovor ne, ili niste sigurni, stavite te podatke u depersonalizovani, anonimni format ili koristite samo sigurne alate koje je odobrila institucija.

tri mini kofera

Slučaj 1 — Nacrt metapodataka za 400 dokumenata. Univerzitetska biblioteka morala je da katalogizira arhivu od 400 dokumenata koje je donirao profesor. Ekspert je izdvojio nacrt naslova, datuma i predloga teme sa prve stranice svakog dokumenta sa AI: prosečno vreme po dokumentu je smanjeno sa 12 minuta na 4 minuta. Ali svaki nacrt otiska je upoređen sa originalnim dokumentom i odobren od strane stručnjaka; 17 netačnih datuma koje je napravila AI uhvaćeno je u ovom koraku.

Slučaj 2 — Lažni izvor uhvaćen. Bibliotekar savjetodavni primio je 6 prijedloga članaka od YZ dok je tražio resurse o "klimatskoj migraciji" za studenta dodiplomskog studija. Bibliotekarka ih je sve pretražila u bazi podataka ustanove: 2 od 6 članaka uopšte nisu postojala. Korak provjere spriječio je studentu da dobije izmišljeni izvor.

Slučaj 3 — Spriječeno je kršenje povjerljivosti. Biblioteka koja je razmatrala korištenje općeg AI alata za analizu „koji korisnik je zainteresiran za koju temu“ iz zapisa o naplati. Menadžer informacija je shvatio da bi bilo kršenje privatnosti da ovi podaci izađu sa korisničkim ID-om; podaci su prvo anonimizirani i obrađeni isključivo kao agregirana, de-identificirana statistika.

Četiri šablona za kopiranje

1) Počnite definirati uloge i granice:

Vaša uloga: iskusni pomoćnik stručnjaka za katalogizaciju i upravljanje informacijama. Vaš zadatak: da napravite nacrt od informacija iz izvora koji sam vam dao. Pravila: (1) Koristite samo informacije u tekstu koji sam vam dao, nemojte dodavati svoje podatke. (2) Označite "[mora biti potvrđeno]" ako niste sigurni. (3) Ne izmišljajte nikakve datume, imena ili otiske. Ako razumete, počnite. Izvor: [ovdje]

2) Pitanje provjere valjanosti:

Navedite svaku činjeničnu tvrdnju (datum, ime, broj, navod izvora) u tekstu ispod. Za svaku: gdje ste u tekstu dobili ove informacije? Ako nije jasno u tekstu, napišite "nije u tekstu". Tekst: [ovdje]

3) Pristrasnost i provjera perspektive koja nedostaje:

Koje perspektive naglašava sljedeći sažetak/preporuka, a koje izostavlja? Koje grupe, regije ili pogledi možda nedostaju? Samo se oslonite na tekst, nemojte spekulisati. Tekst: [ovdje]

4) Prethodna provjera privatnosti:

Da li donji tekst sadrži lične podatke (ime, ID broj, kontakt, historiju čitanja/pretraživanja) ili osjetljive korporativne informacije? Ako jeste, navedite ga i predložite kako se može anonimizirati. Tekst: [ovdje]

Slaba prompt / Jaka prompt

Slab upit:

Pronađite mi neke resurse na ovu temu.

Ovaj upit poziva AI da generiše lažne resurse. Ne postoje uloge, granice, pravila validacije i resursi. AI može proizvesti uvjerljive, ali nepostojeće oznake.

Snažan upit:

Vaša uloga: pomoćnik referentnog bibliotekara. Odaberite one koji se odnose na temu "klimatske migracije" iz kataloških stavki koje sam vam dao u nastavku i objasnite zašto su relevantni. Nemojte dodavati izvore koji nisu na listi, nemojte izmišljati izvore. Kada niste sigurni, recite "nema navedenih odgovarajućih izvora." Unosi u katalog: [ovdje]

Razlika je jasna: jak prompt prisiljava AI da radi iz datog stvarnog izvora, a ne iz vlastite memorije, i sprječava izmišljanje.

Tabela slojeva i odgovornosti

poslovni sloj

ogledni zadatak

Uloga AI

čovekova odluka

mehanički

Nacrt metapodataka, sažetak, prijevod

Brzo proizvodi nacrte

verifikacija, odobrenje

kvazisudski

Naslov teme, prijedlog izvora

nudi prijedloge

Odabir prema politici

čista presuda

Autentifikacija, odluka o autorskim pravima

Samo preliminarne informacije

Potpuna odgovornost leži na osobi

Uobičajene greške

  • Zamjena AI izlaza za izvor. AI je pomoćnik, a ne resurs; Svaki izlaz je validiran.
  • Prihvatanje izmišljenog izvora kao uvjerljivog. Samo zato što izgleda dobro ne znači da je ispravno.
  • Unošenje ličnih/osjetljivih podataka u javni alat. Privatnost korisnika i korporativna povjerljivost se poštuju od samog početka.
  • Ignoriranje predrasuda. AI nosi perspektive podataka na kojima je obučena; Pitajte šta nedostaje.
  • Prepuštanje presude AI. Odluke o tačnosti, autorskim pravima i privatnosti pripadaju ljudima.

Ukratko

umjetna inteligencija; To je moćan pomoćnik za sažimanje, izradu, prevođenje i označavanje obrazaca u bibliotekarstvu i upravljanju informacijama. Štedi mnogo vremena u mehaničkom radu; daje savjete o kvazi-sudskim pitanjima; Ali provjera tačnosti, pouzdanosti izvora, privatnosti korisnika i etičkih odluka pripada ljudima. Halucinacije su najveća opasnost za ovu profesiju: ​​ne koriste se izvori ili citati bez provjere. Pokrenite AI sa jasnim pravilima o ulozi, granicama i validaciji; Potvrdite svaki kritični izlaz sa nezavisnim izvorom.

Zadatak aplikacije

Odaberite pravu temu iz svog područja. Zatražite od AI 5 preporuka resursa na tu temu, a zatim pretražite svaku od njih u stvarnom katalogu ili bazi podataka i zabilježite koliko ih stvarno postoji. Zatim, uz predložak „Startup definiše uloge i granice“, recite AI-u da radi samo iz teksta koji dostavite i uporedite rezultate dva pristupa. Napišite koji pristup sprječava uklapanje.

kontrolna lista

  • [ ] Odredio sam na kojem je sloju (mehaničkom, polusudskom, čistom sudu) zadatak.
  • [ ] "Šta se događa ako je ovaj izlaz netačan?" Postavio sam pitanje.
  • [ ] Provjerio sam svaki kredit i citat prema nezavisnom izvoru.
  • [ ] Provjerio sam da nema ličnih/osjetljivih informacija u podacima za unos AI.
  • [ ] Konačnu odluku i odgovornost zadržao sam po sopstvenom nahođenju.