Vienība 1 / 11

Ievads mākslīgajā intelektā bibliotēkā un informācijas pārvaldībā: lomas, robežas, autentifikācija, privātums un ētika

Ieguvumi:

  • Spēja atšķirt, kur mākslīgais intelekts ietaupa laiku bibliotēku darbplūsmā (metadati, kopsavilkums, meklēšana, ieteikumi) un kur precizitāte, avota uzticamība un privātuma lēmumi tiek atstāti cilvēku ziņā atkarībā no riska līmeņa.
  • Spēja pielietot disciplīnu, kas pārbauda katru izvadi, saistot to ar avotu, apstiprinot to neatkarīgā avotā un izlaižot to caur neobjektivitātes filtru.
  • Izpratne par to, kāpēc halucinācijas, safabricēti avoti un lietotāju privātums ir riski, kas šajā profesijā ir jāņem vērā jau no paša sākuma.

Kad kataloģizācijas speciālists no rīta apsēžas pie sava galda, viņam var būt desmitiem tikko atnāktu grāmatu, simtiem dokumentu no ziedojumu kolekcijas un arhīva kaste, kas gaida digitalizāciju. Uzziņu bibliotekārs (eksperts, kas palīdz lietotājiem atrast informāciju) visas dienas garumā atbild uz jautājumiem, piemēram, “kur ir uzticams avots par šo tēmu?” Informācijas pārvaldnieks ir atbildīgs par to, lai organizācijas tūkstošiem dokumentu būtu atrodami un uzticami. Šajā nodaļā mēs noskaidrosim, kur tieši mākslīgais intelekts (īsumā AI; lielie valodu modeļi un līdzīgi rīki) ietaupa laiku šajos uzdevumos un kur spriedums, izvēle un atbildība paliek cilvēkam.

Sāksim ar definīciju: mākslīgais intelekts, ar kuru mēs saprotam valodu ģenerējošus un modeļu atpazīšanas programmatūras rīkus, kas apmācīti lielam teksta daudzumam. Šie rīki apkopo, tulko, iesaka klasifikāciju, ģenerē teksta melnrakstu un atzīmē modeļus lielos datu gabalos. Taču tas nezina, vai avots patiešām pastāv, vai informācija ir pareiza un vai lietotāja privātums ir aizsargāts. Tāpēc bibliotekārajā un informācijas pārvaldībā AI ir palīgs, nevis lēmumu pieņēmējs.

Kur mākslīgais intelekts strādā un kur nedarbojas?

Sadalīsim bibliotēku darbplūsmu trīs slāņos. Pirmais slānis ir mehāniski un atkārtoti uzdevumi: metadatu melnrakstu izvilkšana no grāmatas rindiņas, gara pārskata apkopošana, teksta tulkošana no vienas valodas uz citu, datu tabulas tīrīšana. AI šeit ir spēcīgs un ievērojami ietaupa laiku.

Otrais slānis ir kvazitiesu darbs: kādu priekšmeta virsrakstu dot dokumentam, vai iekļaut kolekcijā resursu, kādu resursu ieteikt lietotājam. AI šeit sniedz ieteikumus, bet pēdējais vārds ir ekspertam, kurš zina iestādes politiku un lietotāja patiesās vajadzības.

Trešais slānis ir tīrais spriedums un atbildība: informācijas precīzuma apstiprināšana, autortiesību izlemšana, sensitīvu personas datu izpaušana, avota uzticamības apstiprināšana. Šajā slānī AI izvade ir tikai sākumpunkts; Atbildība pilnībā gulstas uz cilvēkiem.

Padoms. Pirms dot uzdevumu AI, pajautājiet sev: "Kas notiek, ja šī izvade ir nepareiza?" Ja atbilde ir "Es tērēšu kādu laiku", izmantojiet AI. Ja atbilde ir "izplatīts viltus avots, lietotājs ir maldināts vai personas dati ir nopludināti", noteikti pārbaudiet izvadi.

Halucinācijas: bibliotekāra lielākās briesmas

Halucinācijas ir tad, kad mākslīgais intelekts sniedz neesošu informāciju, avotu vai citātu tā, it kā tas būtu īsts, turklāt ārkārtīgi pārliecinošā valodā. Tas ir īpaši bīstami bibliotēku darbam un informācijas pārvaldībai; jo mūsu profesijas būtība ir avota autentiskums un uzticamība.

Kad jūs sakāt AI “ieteikt piecus akadēmiskus darbus par šo tēmu”, tas var ģenerēt nosaukumus, autorus un žurnālu nosaukumus, kas šķiet reāli, bet vispār neeksistē. Šie safabricētie avoti ir tik pārliecinoši, ka patrons vai pat bibliotekārs tos var pievienot bibliogrāfijai, nepārbaudot. Humanitārajās un sociālajās zinātnēs briesmas ir vēl lielākas: ja "tas 1897. gada dokuments" ir safabricēts vēsturniekam vai "tas tiesas lēmums" juristam, rezultāts ir nopietna dezinformācija.

Uzmanību! Nevienu AI radītu avota citātu, citātu vai atsauci nedrīkst nekur pārsūtīt bez pārbaudes reālā katalogā, datubāzē vai pašā avotā. Tas, ka tas "izskatās pārliecinoši", nenozīmē, ka tā ir patiesība.

Pārbaudes disciplīna: trīs soļi

Pamatdisciplīna, kas bibliotekāram jāievēro, strādājot ar AI, ir šāda:

1. Izveidojiet savienojumu ar avotu. Katram faktam, skaitlim, datumam un nospiedumam jābūt balstītam uz oriģinālo avotu. Pajautājiet AI “pastāstiet man, no kura avota saņēmāt šo informāciju” un neatkarīgi pārbaudiet šo avotu.

2. Patstāvīgi apstiprināt. Pārbaudiet kritisko informāciju vismaz vienā uzticamā avotā ārpus AI (autentiskā katalogā, oficiālā datu bāzē, primārajā dokumentā).

3. Izlaidiet to caur slīpo filtru. AI satur to datu novirzes, uz kuriem tas tiek apmācīts. Ieteiktā tēma, ieteikumu saraksts vai kopsavilkums var izcelt noteiktus viedokļus, bet aizklāt citus. Pajautājiet, kurš ir atstāts malā, kādas perspektīvas trūkst.

Privātums un lietotāju privātums

Viens no bibliotekāra profesijas fundamentālajiem ētikas principiem ir lietotāja privātums: tas, ko cilvēks lasa, ko viņš meklē un kāds priekšmets viņu interesē, ir konfidenciāls. Ievadot datus mākslīgā intelekta rīkos, jo īpaši publiskos rīkos, kas darbojas internetā, kas ietver lietotāju identitāti, meklēšanas vēsturi vai aizņemtos resursus, var pārkāpt šo principu; jo šie dati var nonākt trešo pušu sistēmās.

Tāpat organizācijā neklasificētus, bet sensitīvus dokumentus (personāla informāciju, līgumus, iekšējo saraksti) nevajadzētu augšupielādēt vispārējā AI rīkā. Šāda veida datiem priekšroka dodama rīkiem, kas darbojas pašas iestādes drošā, slēgtā sistēmā.

Padoms. Pirms jebkādu datu ievadīšanas AI, jautājiet "Vai šī informācija ir publiska?" jautāt. Ja atbilde ir nē vai neesat pārliecināts, ievietojiet šos datus depersonalizētā, anonīmā formātā vai izmantojiet tikai iestādes apstiprinātus drošus rīkus.

trīs mini futrāļi

1. gadījums — metadatu uzmetums 400 dokumentiem. Universitātes bibliotēkai bija jākatalogē profesora dāvināto 400 dokumentu arhīvs. Eksperts no katra dokumenta ar AI pirmās lapas izvilka virsraksta, datuma un tēmas ieteikuma melnrakstu: vidējais laiks vienam dokumentam samazinājās no 12 minūtēm līdz 4 minūtēm. Bet katrs nospieduma melnraksts tika salīdzināts ar oriģinālo dokumentu un apstiprināts ar ekspertu; Šajā solī tika fiksēti 17 nepareizi AI izdomāti datumi.

2. gadījums — pieķerts viltus avots. Konsultatīvais bibliotekārs saņēma 6 rakstu ieteikumus no YZ, meklējot resursus par "klimata migrāciju" bakalaura studentam. Bibliotekāre tos visus meklēja iestādes datubāzē: 2 no 6 rakstiem nemaz neeksistēja. Pārbaudes darbība neļāva studentam iegūt izdomātu avotu.

3. gadījums — ir novērsts konfidencialitātes pārkāpums. Bibliotēka apsvēra iespēju izmantot vispārēju AI rīku, lai analizētu “kurš lietotājs interesējas par kādu tēmu” no norēķinu ierakstiem. Informācijas pārvaldnieks saprata, ka šo datu iziešana ar lietotāja ID būtu privātuma pārkāpums; dati vispirms tika anonimizēti un apstrādāti tikai kā apkopota, neidentificēta statistika.

Četras kopējamas veidnes

1) Sāciet definēt lomas un robežas:

Jūsu loma: pieredzējis kataloģizācijas un informācijas pārvaldības speciālista asistents. Tavs uzdevums: izveidot melnrakstu no informācijas avotā, ko es jums sniedzu. Noteikumi: (1) Izmantojiet tikai to informāciju, ko es jums sniedzu, nepievienojiet savu informāciju. (2) Ja neesat pārliecināts, atzīmējiet "[jābūt verificētam]". (3) Neveidojiet nekādus datumus, vārdus vai nospiedumus. Ja saproti, sāc. Avots: [šeit]

2) Validācijas pārbaudes jautājums:

Zemāk esošajā tekstā uzskaitiet katru faktisko apgalvojumu (datums, vārds, numurs, atsauce uz avotu). Katram: kur tekstā jūs ieguvāt šo informāciju? Ja tas nav skaidri tekstā, ierakstiet "nav tekstā". Teksts: [šeit]

3) Neobjektivitātes un trūkstošās perspektīvas pārbaude:

Kuras perspektīvas ir izceltas tālāk sniegtajā kopsavilkumā/ieteikumā un kuras izlaiž? Kuru grupu, reģionu vai skatījumu varētu trūkt? Vienkārši paļaujieties uz tekstu, nedomājiet. Teksts: [šeit]

4) Privātuma iepriekšēja pārbaude:

Vai tālāk tekstā ir ietverti personas dati (vārds, ID numurs, kontaktpersona, lasīšanas/meklēšanas vēsture) vai sensitīva uzņēmuma informācija? Ja tā, uzskaitiet to un iesakiet, kā to var padarīt anonīmu. Teksts: [šeit]

Vāja uzvedne / spēcīga uzvedne

Vāja uzvedne:

Atrodiet man dažus resursus par šo tēmu.

Šī uzvedne aicina AI ģenerēt viltotus resursus. Nav lomu, robežu, apstiprināšanas noteikumu un resursu. AI var radīt ticamus, bet neesošus tagus.

Spēcīga uzvedne:

Jūsu loma: uzziņu bibliotekāra palīgs. Izvēlieties tos, kas saistīti ar tēmu "klimata migrācija", no kataloga ierakstiem, kurus es jums sniedzu zemāk, un paskaidrojiet, kāpēc tie ir svarīgi. Nepievienojiet avotus, kas nav sarakstā, neveidojiet avotus. Ja neesat pārliecināts, sakiet "nav norādīti piemēroti avoti". Kataloga ieraksti: [šeit]

Atšķirība ir skaidra: spēcīga uzvedne liek AI darboties no dotā reālā avota, nevis no savas atmiņas, un novērš izgatavošanu.

Slāņu un atbildības tabula

biznesa slānis

uzdevuma paraugs

AI loma

cilvēka lēmums

mehāniski

Metadatu uzmetums, kopsavilkums, tulkojums

Ātri rada melnrakstus

pārbaude, apstiprināšana

kvazi-tiesas

Tēmas nosaukums, avota ieteikums

piedāvā ieteikumus

Atlase pēc politikas

tīrs spriedums

Autentifikācija, autortiesību lēmums

Tikai provizoriska informācija

Pilna atbildība gulstas uz cilvēku

Biežas kļūdas

  • AI izvades aizstāšana ar avotu. AI ir palīgs, nevis resurss; Katrs rezultāts tiek apstiprināts.
  • Safabricētā avota pieņemšana kā pārliecinoša. Tas, ka tas izskatās labi, nenozīmē, ka tas ir pareizi.
  • Personas/sensitīvu datu ievadīšana publiskajā rīkā. Lietotāju privātums un korporatīvā konfidencialitāte tiek ievērota jau no paša sākuma.
  • Aizspriedumu ignorēšana. AI nes to datu perspektīvas, uz kuriem tas tiek apmācīts; Jautājiet, kas trūkst.
  • Atstājot spriedumu AI ziņā. Lēmumi par precizitāti, autortiesībām un privātumu pieder cilvēkiem.

Rezumējot

mākslīgais intelekts; Tas ir spēcīgs palīgs apkopošanai, sastādīšanai, tulkošanai un paraugu marķēšanai bibliotēku un informācijas pārvaldībā. Tas ietaupa daudz laika mehāniskajā darbā; sniedz konsultācijas kvazitiesu jautājumos; Bet precizitātes, avota uzticamības, lietotāja privātuma un ētisku lēmumu pārbaude ir cilvēku ziņā. Halucinācijas ir vislielākās briesmas šai profesijai: avota kredīti vai citāti netiek izmantoti bez pārbaudes. Palaidiet AI ar skaidriem lomu, robežām un validācijas noteikumiem; Apstipriniet katru kritisko izvadi ar neatkarīgu avotu.

Lietojumprogrammas uzdevums

Izvēlieties īstu tēmu no savas jomas. Lūdziet AI 5 resursu ieteikumus par šo tēmu, pēc tam meklējiet katru no tiem faktiskā katalogā vai datubāzē un atzīmējiet, cik daudz tādu ir. Pēc tam, izmantojot veidni “Startēšanas lomu un robežu noteikšana”, sakiet AI darboties tikai no jūsu iesniegtā teksta un salīdziniet abu pieeju rezultātus. Uzrakstiet, kura pieeja neļauj pielāgot.

kontrolsaraksts

  • [ ] Noteicu, kurā slānī (mehāniskā, pustiesiskā, tīrā sprieduma) atrodas uzdevums.
  • [ ] "Kas notiek, ja šī izvade ir nepareiza?" Es uzdevu jautājumu.
  • [ ] Esmu pārbaudījis katru kredītu un citātu, salīdzinot to ar neatkarīgu avotu.
  • [ ] Esmu pārbaudījis, vai AI ievadītajos datos nav personas/sensitīvas informācijas.
  • [ ] Galīgo lēmumu un atbildību paturēju pēc saviem ieskatiem.