Jednotka 1 / 11

Úvod do umělé inteligence v knihovnictví a správě informací: role, hranice, autentizace, soukromí a etika

zisky:

  • Umět rozlišit, kde umělá inteligence šetří čas v knihovnickém workflow (metadata, shrnutí, vyhledávání, návrhy) a kde jsou přesnost, spolehlivost zdroje a rozhodování o soukromí ponecháno na lidech, v závislosti na míře rizika.
  • Schopnost aplikovat disciplínu, která ověřuje každý výstup jeho propojením se zdrojem, potvrzením v nezávislém zdroji a průchodem přes filtr zkreslení.
  • Pochopení toho, proč jsou halucinace, smyšlené zdroje a soukromí uživatelů riziky, se kterými je třeba v této profesi počítat od samého začátku.

Když si katalogizační specialista ráno sedne ke svému stolu, může mít desítky nově příchozích knih, stovky dokumentů z darovací sbírky a archivní krabici čekající na digitalizaci. Referenční knihovník (odborník, který pomáhá uživatelům najít informace) během dne odpovídá na otázky typu „kde je spolehlivý zdroj na toto téma?“ Informační manažer je odpovědný za to, aby byly tisíce dokumentů organizace zjistitelné a spolehlivé. V tomto celku si ujasníme, kde přesně umělá inteligence (zkráceně AI; velké jazykové modely a podobné nástroje) šetří čas při těchto úkolech a kde úsudek, volba a zodpovědnost zůstávají na člověku.

Začněme definicí: umělá inteligence, kterou máme na mysli softwarové nástroje generující jazyk a rozpoznávající vzory trénované na velkém množství textu. Tyto nástroje shrnují, překládají, navrhují klasifikaci, generují koncept textu a označují vzory ve velkých porcích dat. Neví však, zda zdroj skutečně existuje, zda je informace správná nebo zda je chráněno soukromí uživatele. To je důvod, proč v knihovnictví a správě informací je umělá inteligence pomocníkem, nikoli rozhodovatelem.

Kde umělá inteligence funguje a kde nefunguje?

Rozdělme knihovnický pracovní postup do tří vrstev. První vrstvou jsou mechanické a opakující se úkoly: extrahování konceptů metadat z vedlejšího řádku knihy, shrnutí dlouhé zprávy, překlad textu z jednoho jazyka do druhého, čištění tabulky dat. Umělá inteligence je zde výkonná a šetří spoustu času.

Druhá vrstva je kvazi-soudní práce: jaké téma dát dokumentu, zda zahrnout zdroj do sbírky, jaký zdroj doporučit uživateli. AI zde produkuje návrhy, ale poslední slovo má odborník, který zná politiku instituce a skutečné potřeby uživatele.

Třetí vrstvou je čistý úsudek a odpovědnost: potvrzení, že informace jsou přesné, rozhodnutí o autorských právech, zda zveřejnit citlivé osobní údaje, potvrzení spolehlivosti zdroje. Na této vrstvě je výstup AI pouze výchozím bodem; Zodpovědnost je plně na lidech.

Tip: Než zadáte úkol AI, zeptejte se sami sebe: „Co se stane, když je tento výstup špatný? Pokud je odpověď „promarním nějaký čas“, klidně použijte AI. Pokud je odpověď „šíří se falešný zdroj, uživatel je uveden v omyl nebo unikají osobní údaje“, nezapomeňte výstup ověřit.

Halucinace: největší nebezpečí pro knihovníka

Halucinace je, když umělá inteligence produkuje neexistující informace, zdroj nebo citaci, jako by byly skutečné, a v extrémně přesvědčivém jazyce. To je zvláště nebezpečné pro knihovnictví a správu informací; protože podstatou naší profese je pravost a spolehlivost zdroje.

Když řeknete AI, aby „navrhla pět akademických prací na toto téma“, může vygenerovat tituly, autory a názvy časopisů, které se zdají skutečné, ale vůbec neexistují. Tyto smyšlené zdroje jsou tak přesvědčivé, že je může patron nebo dokonce knihovník přidat do bibliografie, aniž by je ověřoval. V humanitních a společenských vědách je nebezpečí ještě větší: když je „ten dokument z roku 1897“ vymyšlen pro historika nebo „to soudní rozhodnutí“ pro právníka, výsledkem jsou závažné dezinformace.

Upozornění: Žádná citace zdroje, citace nebo reference vytvořené AI by neměly být nikde přenášeny bez ověření ve skutečném katalogu, databázi nebo samotném zdroji. To, že to "vypadá přesvědčivě", ještě neznamená, že je to pravda.

Ověřovací disciplína: tři kroky

Základní disciplína, kterou musí knihovník při práci s AI uplatňovat, je tato:

1. Připojte se ke zdroji. Každý fakt, údaj, datum a otisk musí vycházet z původního zdroje. Zeptejte se AI ​​„řekněte mi, z jakého zdroje jste tyto informace získali“ a zkontrolujte tento zdroj nezávisle.

2. Nezávisle potvrďte. Ověřte kritické informace alespoň v jednom spolehlivém zdroji mimo AI ​​ (autentický katalog, oficiální databáze, primární dokument).

3. Protáhněte jej přes filtr předpětí. AI nese zkreslení dat, na kterých je trénována. Navrhované téma, seznam návrhů nebo shrnutí může zvýraznit určité úhly pohledu a jiné zakrýt. Zeptejte se, kdo je vynechán, jaká perspektiva chybí.

Soukromí a soukromí uživatelů

Jedním z nejzákladnějších etických principů knihovnické profese je soukromí uživatele: to, co člověk čte, co hledá a jaký předmět ho zajímá, je důvěrné. Zadávání dat do nástrojů umělé inteligence, zejména veřejných nástrojů, které fungují přes internet, které zahrnují totožnost uživatelů, historii vyhledávání nebo vypůjčené zdroje, může tuto zásadu porušovat; protože tato data mohou jít do systémů třetích stran.

Stejně tak by se v organizaci neměly do obecného nástroje AI nahrávat neutajované, ale citlivé dokumenty (personální informace, smlouvy, interní korespondence). Pro tento typ dat jsou preferovány nástroje běžící na vlastním zabezpečeném uzavřeném systému instituce.

Tip: Před zadáním jakýchkoli dat do AI se zeptejte „Je tato informace veřejná?“ požádat. Pokud odpověď zní ne nebo si nejste jisti, vložte tato data do odosobněného, ​​anonymního formátu nebo použijte pouze zabezpečené nástroje schválené institucí.

tři mini pouzdra

Případ 1 – Návrh metadat pro 400 dokumentů. Univerzitní knihovna musela zkatalogizovat archiv 400 dokumentů darovaných profesorem. Expert vytáhl z první stránky každého dokumentu pomocí AI název konceptu, datum a návrh tématu: průměrný čas na jeden dokument se snížil z 12 minut na 4 minuty. Ale každý návrh otisku byl porovnán s původním dokumentem a schválen odborníkem; V tomto kroku bylo zachyceno 17 nesprávných dat vytvořených AI.

Případ 2 – Zachycen falešný zdroj. Poradní knihovník obdržel 6 návrhů článků od YZ při hledání zdrojů o „klimatické migraci“ pro vysokoškoláka. Knihovnice je všechny prohledala v databázi instituce: 2 ze 6 článků vůbec neexistovaly. Ověřovací krok zabránil tomu, aby student dostal vymyšlený zdroj.

Případ 3 – Zabránění porušení důvěrnosti. Knihovna zvažovala použití obecného nástroje umělé inteligence k analýze toho, „který uživatel se zajímá o jaké téma“ ze záznamů pokladny. Správce informací si uvědomil, že by bylo porušením soukromí, kdyby tato data vyšla s ID uživatele; údaje byly nejprve anonymizovány a zpracovány výhradně jako agregované, neidentifikovatelné statistiky.

Čtyři kopírovatelné šablony

1) Začněte definovat role a hranice:

Vaše role: zkušený asistent specialisty na katalogizaci a správu informací. Váš úkol: vytvořit koncept z informací ve zdroji, který jsem vám dal. Pravidla: (1) Používejte pouze informace v textu, který jsem vám dal, nepřidávejte své vlastní informace. (2) Pokud si nejste jisti, označte „[musí být ověřeno]“. (3) Nevymýšlejte si žádná data, jména ani otisky. Pokud rozumíte, začněte. Zdroj: [zde]

2) Kontrolní otázka ověření:

V níže uvedeném textu uveďte každé skutkové tvrzení (datum, jméno, číslo, citace zdroje). U každého: kde v textu jste tuto informaci získal? Pokud to v textu není jasně uvedeno, napište „není v textu“. Text: [zde]

3) Kontrola zkreslení a chybějící perspektivy:

Které perspektivy zdůrazňuje následující shrnutí/doporučení a které vynechává? Jaké skupiny, regiony nebo pohledy mohou chybět? Spolehněte se jen na text, nespekulujte. Text: [zde]

4) Předběžná kontrola soukromí:

Obsahuje níže uvedený text osobní údaje (jméno, IČO, kontakt, historii čtení/hledání) nebo citlivé firemní informace? Pokud ano, uveďte jej a navrhněte, jak jej lze anonymizovat. Text: [zde]

Slabá výzva / Silná výzva

Slabá výzva:

Najděte mi nějaké zdroje na toto téma.

Tato výzva vyzývá AI ke generování falešných zdrojů. Neexistují žádné role, hranice, pravidla ověřování a zdroje. Umělá inteligence může produkovat věrohodné, ale neexistující značky.

Výkonná výzva:

Vaše role: referentský asistent knihovníka. Vyberte ty, které souvisejí s tématem „klimatická migrace“ z položek katalogu, které jsem vám dal níže, a vysvětlete, proč jsou relevantní. Nepřidávejte žádné zdroje, které nejsou na seznamu, nevytvářejte zdroje. Když si nejste jisti, řekněte „nejsou uvedeny žádné vhodné zdroje“. Záznamy v katalogu: [zde]

Rozdíl je jasný: silná výzva nutí AI pracovat z daného skutečného zdroje, nikoli z vlastní paměti, a zabraňuje výrobě.

Tabulka vrstev a odpovědnosti

obchodní vrstva

ukázkový úkol

Role AI

rozhodnutí člověka

mechanické

Koncept metadat, shrnutí, překlad

Rychle vytváří návrhy

ověření, schválení

kvazi-soudní

Název tématu, návrh zdroje

nabízí návrhy

Výběr podle zásad

čistý soud

Autentizace, rozhodnutí o autorských právech

Pouze předběžné informace

Plná zodpovědnost leží na člověku

Časté chyby

  • Nahrazení výstupu AI za zdroj. AI je asistent, ne zdroj; Každý výstup je validován.
  • Přijetí vymyšleného zdroje jako přesvědčivého. To, že to vypadá dobře, ještě neznamená, že je to správné.
  • Zadávání osobních/citlivých údajů do veřejného nástroje. Soukromí uživatelů a firemní důvěrnost jsou respektovány od samého počátku.
  • Ignorování předsudků. AI nese perspektivy dat, na kterých je trénována; Zeptejte se, co chybí.
  • Ponechání posouzení na AI. Rozhodnutí o přesnosti, autorských právech a soukromí patří lidem.

V souhrnu

umělá inteligence; Je to výkonný pomocník pro shrnutí, navrhování, překládání a označování vzorů v knihovnictví a správě informací. Ušetří mnoho času při mechanické práci; poskytuje rady v kvazi-soudních záležitostech; Ale ověřování přesnosti, spolehlivosti zdroje, soukromí uživatelů a etická rozhodnutí patří lidem. Halucinace představují pro tuto profesi největší nebezpečí: bez ověření se nepoužívají žádné zdroje ani citace. Spusťte AI s jasnými pravidly role, hranic a ověřování; Potvrďte každý kritický výstup nezávislým zdrojem.

Aplikační úkol

Vyberte si skutečné téma ze svého oboru. Požádejte umělou inteligenci o 5 doporučení zdrojů na toto téma, poté každé prohledejte ve skutečném katalogu nebo databázi a poznamenejte si, kolik jich skutečně existuje. Poté pomocí šablony „Spuštění definující role a hranice“ řekněte AI, aby pracovala pouze z textu, který poskytnete, a porovnejte výstup obou přístupů. Napište, který přístup brání pasování.

kontrolní seznam

  • [ ] Určil jsem, na které vrstvě (mechanické, polosoudní, čistý úsudek) se úkol nachází.
  • [ ] "Co se stane, když je tento výstup nesprávný?" položil jsem otázku.
  • [ ] Každý kredit a citaci jsem ověřil proti nezávislému zdroji.
  • [ ] Zkontroloval jsem, že v datech vstupujících do AI nejsou žádné osobní/citlivé informace.
  • [ ] Konečné rozhodnutí a odpovědnost jsem si nechal na svém uvážení.