zisky:
- Schopnost extrahovat výňatek tématu ze skutečného obsahu a mapovat primární a sekundární témata ze seznamu schválených témat
- Být schopen přijmout hlavní třídu klasifikačních návrhů, jako je Dewey, a ověřit podúrovně s oficiální tabulkou.
- Schopnost porozumět úsudkové a reprezentativní povaze klasifikace a zkontrolovat návrhy proti zastaralým a vylučujícím výrazům.
Určení toho, o čem zdroj je, je jedním z nejhodnotnějších úkolů knihovnictví. Tomu se říká tematická analýza: přečtení obsahu dokumentu a jeho spárování se správnými předmětovými hesly a správným klasifikačním číslem. Pokud uživatel může najít související knihy vedle sebe na poličce nebo získá přesné výsledky při hledání tématu v katalogu, je za tím dobrá analýza tématu. V této lekci se naučíte používat umělou inteligenci při doporučování témat, klasifikaci a automatickém indexování; ale dozvíte se, proč by měl člověk učinit konečné rozhodnutí.
Pojďme si definovat několik pojmů. Klasifikační systém je systém, který čísluje zdroje podle jejich předmětu; nejběžnější jsou Dewey Decimal Classification (DDC) a Library of Congress Classification (LCC). Například v Dewey znamená 500 přírodní vědy, 900 historii a zeměpis. Úkolem indexování je přiřadit dokumentu klíčové pojmy, které umožňují jeho nalezení. Automatické indexování nastane, když software tuto úlohu navrhne. Umělá inteligence vytváří návrhy ve všech třech úkolech, ale v každém má konečné slovo odborník.
Krok za krokem: analýza témat s umělou inteligencí
1. Předejte podstatu dokumentu AI. Plný text, abstrakt, obsah nebo úvod. Analýza tématu je založena na kontextu; Pokud AI dáte jen titulek, dostanete povrchní a zavádějící doporučení.
2. Vyžádejte si souhrn obsahu od AI. Za prvé, „o čem je tento dokument především?“ požádat. To vám pomůže rychle pochopit a ukáže, zda AI správně uchopil předmět.
3. Shoda s kontrolovanými tématy. Dejte AI svůj seznam schválených témat a řekněte „navrhujte z tohoto seznamu pouze nejvhodnější témata“. Nedovolte, aby produkovala volnou terminologii.
4. Navrhněte klasifikační číslo. Můžete se zeptat AI "do jaké hlavní třídy tento dokument v Dewey spadá?" ale nezapomeňte ověřit přesné číslice čísla s oficiální klasifikační tabulkou. AI dokáže produkovat rozumná, ale nepřesná čísla.
5. Udělejte rozhodnutí a zdůvodněte je. Zkontrolujte návrhy AI, vyberte je s ohledem na politiku instituce a uživatelskou základnu a v případě potřeby je odmítněte. Konečné rozhodnutí o předmětu a klasifikaci nese váš podpis.
Tip: Dokument může mít více témat. Z AI: „Co je primárním tématem tohoto dokumentu, jaká jsou jeho sekundární témata? Zeptejte se samostatně. Správná volba primárního předmětu zajistí, že zdroj půjde na správné místo na polici; sekundární témata poskytují další přístupové body v katalogu.
Soudní povaha klasifikace
Klasifikace se zdá neutrální, ale není. Zda zařadit dokument pod „ženská studia“ nebo „sociologii“, nebo dokonce pod jakou geografii historickou událost zařadíte, jsou rozhodnutí, která zahrnují perspektivu. Klasifikační systémy nesou předpoklady konkrétních období a kultur; Některé termíny se časem stanou zastaralými nebo vylučujícími. Umělá inteligence přebírá tyto předsudky doslovně z dat, na kterých je trénována, a může je dokonce posilovat.
Tématická analýza je proto věcí úsudku, který nelze ponechat na AI. AI označuje, které tituly jsou „pravděpodobné“; Ale rozhodnutí o tom, který titul představuje zdroj nejpřesněji a nejspravedlivější, náleží odborníkovi, který zná hodnoty instituce a její uživatelské základny.
Upozornění: Ujistěte se, že téma navržené umělou inteligencí nezkresluje nebo nevylučuje zdroj. Porovnejte termíny vygenerované umělou inteligencí se současným a inkluzivním slovníkem instituce, zejména pokud jde o citlivá témata, jako je identita, etnická příslušnost, náboženství a pohlaví.
tři mini pouzdra
Případ 1 – Návrh hromadného tématu. Knihovna by přiřadila témata k digitální sbírce 800 článků. Expert poskytl AI shrnutí každého článku a požádal o shodu ze schváleného seznamu titulů. Doporučení AI správně zachytila v průměru 2 ze 3 způsobilých titulů na článek; expert přidal třetí a vyřadil špatné návrhy. Práce byla dokončena přibližně o 40 % rychleji, než kdyby byla provedena zcela ručně.
Případ 2 – Nesprávné klasifikační číslo. Expert požádal o Deweyho číslo od AI pro knihu lékařské historie. YZ navrhl "610 (medicína)"; Kniha však byla především o historii medicíny a správné místo bylo "610.9 (History of Medicine)". Expert se podíval na oficiální Deweyho tabulku a opravil ji; AI našla hlavní třídu, ale minula vedlejší přestávku.
Případ 3 – Zastaralý výraz zachycen. AI navrhla zastaralý a nyní považovaný za vylučující předmět pro knihu o sociologii; protože tento starý termín byl v tréninkových datech běžný. Odborník vybral správný termín z aktuálního inkluzivního slovníku instituce. To byl konkrétní příklad toho, že AI nese zaujatost minulosti.
Hloubka a konzistence: jak konkrétní by měla být?
Běžným rozhodnutím při analýze tématu je úroveň specifičnosti termínu, který má být přiřazen. Pokud zdroji dáte příliš obecný název („Datum“), uživatel hledající téma se utopí ve stovkách irelevantních výsledků. Pokud zadáte název, který je příliš úzký, uživatel, který hledá širší zdroj, jej nenajde. Pravidlem je vybrat termín, který nejkonkrétněji, ale plně pokrývá zdroj: pokud se zdroj zabývá pouze architekturou seldžuckého období, správná úroveň je „architektura Seldžu“, nikoli „architektura“. AI často postrádá tuto rovnováhu; Vytváří návrhy, které jsou buď příliš obecné, nebo příliš rozptýlené. Proto je nutné dát AI jasné pokyny typu „navrhněte co nejkonkrétnější téma pokryté zdrojem a nepřidávejte podtémata, kterých se zdroj ve skutečnosti nedotýká“. Kromě toho je konzistentní označování zdrojů na stejné téma v průběhu času stejně důležité pro integritu katalogu jako specifičnost; Když se jeden den řekne „architektura Seldžuka“ a druhý den „budovy z období Seldžu“, uživatele se rozdělí.
Tip: Při přidělování více názvů zdroji zbytečně neskládejte termíny, které jsou navzájem podmnožinami. Uvedením „osmanské historie“ i „historie“ je to druhé zbytečné; vyberte nejkonkrétnější a zahrňte pouze tituly, které skutečně přidávají jiný dosah.
Čtyři kopírovatelné šablony
1) Extrakce tématu:
Napište primární téma dokumentu níže do jedné věty a sekundární témata do 3 položek. Přidání tématu, které není v textu, pouze na základě textu. Dokument/shrnutí: [zde]
2) Shoda ze schválené hlavičky:
Níže je uveden souhrn dokumentu a seznam schválených hesel. Porovnejte pouze 3–5 nadpisů ze seznamu, které jsou pro dokument nejvhodnější, počínaje tím nejvhodnějším. Ke každé možnosti napište zdůvodnění jednou větou. Pokud v seznamu není žádný vhodný titul, uveďte jej. Shrnutí: [zde] / Seznam: [zde]
3) Návrh hlavní třídy klasifikace:
Pro následující dokument navrhněte možnou hlavní třídu (3 číslice) v Deweyově desítkové klasifikaci a vysvětlete, proč jste si ji vybrali. Spodní číslice označte jako „nutno ověřit z oficiální tabulky“, neuvádějte přesná čísla. Dokument: [zde]
4) Kontrola zkreslení a měny:
Jsou mezi níže uvedenými tématy nějaké termíny, které mohou být zastaralé, vylučující nebo jednostranné? Pokud ano, označte jej a vysvětlete, proč by to mohlo být problematické. Návrhy: [zde]
Slabá výzva / Silná výzva
Slabá výzva:
Uveďte témata této knihy: „Obchod v Osmanské říši“.
Umělá inteligence, která vychází pouze z názvu, vytváří obecné pojmy, aniž by znala kontext, a ignoruje řízenou slovní zásobu. Výsledek: nekonzistentní, možná nesprávné názvy.
Výkonná výzva:
Vaše role: asistent věcného analytika. Níže je uveden úvod a obsah knihy; Poskytl jsem také seznam schválených témat. (1) Shrňte hlavní téma knihy do jedné věty. (2) Spojte pouze 3–5 nejvhodnějších titulů ze seznamu s odůvodněním. (3) Nevycházejte ze seznamu, nevymýšlejte si pojmy. Text: [zde] /Seznam schválených: [zde]
Silná výzva omezuje AI na skutečný obsah a řízenou slovní zásobu; zachovává přesnost a konzistenci.
Tabulka úkolů analýzy tématu
Quest
Role AI
rozhodnutí člověka
Shrnutí obsahu
rychlý návrh
kontrola přesnosti
Návrh názvu
Shoda ze seznamu
Konečná volba, zdůvodnění
Klasifikační číslo
Návrh mistrovské třídy
Ověření dělení
Kontrola zkreslení
značení
Inkluzivní termínové rozhodnutí
Časté chyby
- Jen se ptám na téma z nadpisu. Analýza tématu je založena na kontextu; Název je zavádějící.
- Přijetí klasifikačního čísla bez jeho ověření. Přestože AI najde hlavní třídu, chybí jí dílčí zlom.
- Přeskakování řízené slovní zásoby. Volný termín narušuje konzistenci.
- Ignorování předsudků. AI může přenést zastaralé, vylučující podmínky z minulosti.
- Ponechání rozhodnutí zcela na AI. Zastupování a spravedlnost vyžadují úsudek; Rozhodnutí je na člověku.
V souhrnu
Při analýze a klasifikaci témat je umělá inteligence rychlým pomocníkem, který extrahuje souhrn obsahu, porovnává témata ze schváleného seznamu a navrhuje hlavní třídu klasifikace. Předmětová analýza je však v podstatě věcí úsudku a reprezentace: je na odborníkovi, aby rozhodl, který titul nejpřesněji a nejpřesněji popisuje zdroj, přesné číslice klasifikačního čísla a měnu výrazů. Spusťte AI se skutečným obsahem a řízenou slovní zásobou, ověřte klasifikační čísla s oficiální tabulkou a dávejte pozor na zaujatost.
Aplikační úkol
Připravte si úvod ke zdroji, který máte, a krátký seznam schválených témat. Získejte návrhy umělé inteligence pomocí šablon „Extrakce témat“ a „Schválené přiřazování témat“. Poté porovnejte návrhy s oficiální klasifikační tabulkou a aktuálním slovníkem instituce: kolik návrhů bylo správných, kolik jste opravili? Zkontrolujte doporučení ohledně zastaralých výrazů pomocí šablony „Kontrola zkreslení a aktuálnosti“.
kontrolní seznam
- [ ] Nechal jsem udělat analýzu tématu ze skutečného obsahu, nikoli z názvu.
- [ ] Zmapoval jsem názvy z řízené slovní zásoby.
- [ ] Spodní číslice klasifikačního čísla jsem ověřil oficiální tabulkou.
- [ ] Zkontroloval jsem návrhy podle zastaralých a vylučujících výrazů.
- [ ] Konečné rozhodnutí o předmětu a klasifikaci jsem učinil podle vlastního uvážení.