Winst:
- Mogelijkheid om onderwerpuittreksels uit de daadwerkelijke inhoud te extraheren en primaire en secundaire onderwerpen uit de goedgekeurde onderwerpenlijst in kaart te brengen
- In staat zijn om de hoofdklasse van classificatiesuggesties zoals Dewey te accepteren en de subniveaus te verifiëren met de officiële tabel.
- Vermogen om de veroordelende en representatieve aard van classificatie te begrijpen en suggesties te vergelijken met verouderde en uitsluitende termen.
Bepalen waar een bron ‘over gaat’ is een van de meest veroordelende taken van het bibliothecarisschap. Dit heet topicanalyse: het lezen van de inhoud van een document en het matchen ervan met de juiste onderwerpkoppen en het juiste classificatienummer. Als een gebruiker gerelateerde boeken naast elkaar op de plank kan vinden of nauwkeurige resultaten krijgt bij het zoeken naar een onderwerp in de catalogus, zit er een goede onderwerpanalyse achter. In dit onderdeel leer je hoe je kunstmatige intelligentie kunt gebruiken bij onderwerpaanbeveling, classificatie en automatische indexering; maar je zult leren waarom de mens de uiteindelijke beslissing over het onderwerp moet nemen.
Laten we een paar concepten definiëren. Het classificatiesysteem is een systeem dat bronnen nummert op basis van hun onderwerp; de meest voorkomende zijn de Dewey Decimal Classification (DDC) en de Library of Congress Classification (LCC). In Dewey geeft 500 bijvoorbeeld natuurwetenschappen aan, en 900 geschiedenis en aardrijkskunde. Indexeren is de taak van het toewijzen van sleuteltermen aan een document waardoor het vindbaar wordt. Automatische indexering vindt plaats wanneer de software deze taak voorstelt. AI produceert suggesties in alle drie de taken, maar de expert heeft bij elke taak het laatste woord.
Stap voor stap: onderwerpanalyse met kunstmatige intelligentie
1. Geef de essentie van het document aan de AI. Volledige tekst, samenvatting, inhoudsopgave of inleiding. Onderwerpanalyse is gebaseerd op context; Als je AI alleen de titel geeft, krijg je een oppervlakkige en misleidende aanbeveling.
2. Vraag een inhoudsoverzicht aan bij de AI. Ten eerste: “Waar gaat dit document voornamelijk over?” vragen. Dit zorgt ervoor dat je het snel begrijpt en laat zien of de AI het onderwerp goed heeft begrepen.
3. Match met gecontroleerde onderwerpen. Geef de AI jouw lijst met goedgekeurde onderwerpen en zeg “stel alleen de meest geschikte onderwerpen uit deze lijst voor.” Sta niet toe dat er vrije terminologie wordt geproduceerd.
4. Stel classificatienummer voor. Je kunt de AI vragen "in welke hoofdklasse valt dit document in Dewey?" maar zorg ervoor dat u de exacte cijfers van het nummer verifieert met de officiële classificatietabel. AI kan redelijke maar onnauwkeurige cijfers produceren.
5. Neem de beslissing en rechtvaardig deze. Bekijk de suggesties van de AI, selecteer ze in het licht van het beleid en de gebruikersbasis van de instelling en verwerp ze indien nodig. De definitieve onderwerpbeslissing en classificatie is voorzien van uw handtekening.
Tip: Een document kan meerdere onderwerpen krijgen. Van AI “wat is het primaire onderwerp van dit document, wat zijn de secundaire onderwerpen?” Vraag het apart. Door het hoofdonderwerp correct te kiezen, zorgt u ervoor dat het hulpmiddel op de juiste plaats op de plank terechtkomt; secundaire onderwerpen geven extra toegangspunten in de catalogus.
Juridische aard van classificatie
Classificatie lijkt neutraal, maar is het niet. Of je een document nu onder 'vrouwenstudies' of 'sociologie' plaatst, of zelfs onder welke geografie je een historische gebeurtenis classificeert, het zijn beslissingen waarbij perspectief betrokken is. Classificatiesystemen dragen de aannames van bepaalde perioden en culturen in zich; Sommige termen raken na verloop van tijd achterhaald of uitgesloten. AI neemt deze vooroordelen letterlijk over van de gegevens waarop zij is getraind en kan deze zelfs versterken.
Daarom is onderwerpanalyse een kwestie van oordeel die niet aan AI kan worden overgelaten. AI geeft aan welke titels “waarschijnlijk” zijn; Maar de beslissing welke titel de bron het meest nauwkeurig en eerlijk weergeeft, behoort toe aan de deskundige die de waarden van de instelling en haar gebruikersbestand kent.
Let op: Zorg ervoor dat een door AI voorgesteld onderwerp de bron niet verkeerd weergeeft of uitsluit. Vergelijk door AI gegenereerde termen met het huidige en inclusieve vocabulaire van de instelling, vooral over gevoelige onderwerpen zoals identiteit, etniciteit, religie en gender.
drie minikoffers
Geval 1 — Voorstel voor een massaonderwerp. Een bibliotheek zou onderwerpen toekennen aan een digitale collectie van 800 artikelen. De expert gaf de samenvatting van elk artikel aan de AI en vroeg om een match uit de goedgekeurde titellijst. AI-aanbevelingen hebben gemiddeld twee van de drie in aanmerking komende titels per artikel correct vastgelegd; de deskundige voegde er een derde aan toe en verwijderde de verkeerde suggesties. De klus was ongeveer 40% sneller klaar dan wanneer deze volledig met de hand werd gedaan.
Geval 2 — Onjuist classificatienummer. Een expert vroeg om een Dewey-nummer van AI voor een medisch geschiedenisboek. YZ stelde "610 (geneeskunde)" voor; Het boek ging echter vooral over de geschiedenis van de geneeskunde en de juiste plaats was "610.9 (History of Medicine)". De expert keek naar de officiële Dewey-tabel en corrigeerde deze; AI vond de hoofdklasse maar miste de subbreak.
Geval 3 — Verouderde term betrapt. AI stelde een verouderde en nu als uitsluitende onderwerpterm voor een sociologieboek voor; omdat deze oude term gebruikelijk was in de trainingsgegevens. De deskundige selecteerde de juiste term uit het huidige inclusieve vocabulaire van de instelling. Dit was een concreet voorbeeld dat AI de vooroordelen uit het verleden met zich meedraagt.
Diepgang en consistentie: hoe specifiek moet het zijn?
Een veel voorkomende beslissing bij onderwerpanalyse is het specificiteitsniveau van de toe te wijzen term. Als u een bron een titel geeft die te algemeen is ("Datum"), zal de gebruiker die naar het onderwerp zoekt verdrinken in honderden irrelevante resultaten. Als je een te beperkte titel opgeeft, zal een gebruiker die op zoek is naar een bredere bron deze niet kunnen vinden. De regel is om de term te kiezen die de bron het meest specifiek maar volledig dekt: als een bron alleen over architectuur uit de Seltsjoekse periode gaat, is 'Seltsjoekse architectuur' en niet 'Architectuur' het juiste niveau. AI mist dit evenwicht vaak; Het levert suggesties op die óf te algemeen óf te verspreid zijn. Daarom is het noodzakelijk om duidelijke instructies aan AI te geven, zoals "suggereer het meest specifieke onderwerp dat door de bron wordt behandeld, en voeg geen subonderwerpen toe waar de bron niet daadwerkelijk op ingaat." Bovendien is consistente labeling van bronnen over hetzelfde onderwerp in de loop van de tijd net zo belangrijk voor de integriteit van de catalogus als specificiteit; Door de ene dag 'Seltsjoekse architectuur' en de volgende dag 'Seltsjoekse gebouwen' te zeggen, verdeelt de gebruiker zich.
Tip: Wanneer u meerdere titels aan een bron geeft, stapel dan niet onnodig termen op die subsets van elkaar zijn. Door zowel ‘Ottomaanse geschiedenis’ als ‘Geschiedenis’ te geven, is dit laatste overbodig; kies de meest specifieke en neem alleen titels op die echt een ander bereik toevoegen.
Vier kopieerbare sjablonen
1) Onderwerpextractie:
Schrijf het primaire onderwerp van het onderstaande document in één zin en de secundaire onderwerpen in 3 items. Een onderwerp toevoegen dat niet in de tekst staat, alleen op basis van de tekst. Document/samenvatting: [hier]
2) Matching van goedgekeurde header:
Hieronder vindt u een samenvatting van het document en een lijst met goedgekeurde onderwerpkoppen. Zoek alleen de drie tot vijf kopjes uit de lijst die het meest geschikt zijn voor het document, te beginnen met de meest geschikte. Schrijf voor elke keuze een rechtvaardiging van één zin. Als er geen geschikte titel in de lijst staat, geef deze dan op. Samenvatting: [hier] / Lijst: [hier]
3) Classificatie masterclass suggestie:
Stel voor het volgende document een mogelijke hoofdklasse (3 cijfers) voor in de Dewey Decimale Classificatie en leg uit waarom u deze heeft gekozen. Markeer de onderste cijfers als "moet worden geverifieerd aan de hand van de officiële tabel", geef geen exacte cijfers. Document: [hier]
4) Bias en valutacontrole:
Zijn er termen die mogelijk verouderd, uitsluitend of eenzijdig zijn in de onderstaande suggesties voor onderwerpen? Zo ja, markeer dit dan en leg uit waarom dit problematisch kan zijn. Suggesties: [hier]
Zwakke prompt/sterke prompt
Zwakke prompt:
Geef de onderwerpen van dit boek: ‘Handel in het Ottomaanse Rijk’.
De AI werkt uitsluitend vanuit de titel, verzint algemene termen zonder de context te kennen en negeert de gecontroleerde woordenschat. Resultaat: inconsistente, misschien onjuiste titels.
Krachtige prompt:
Jouw rol: assistent vakanalist. Hieronder vindt u de introductie en inhoud van het boek; Ik heb ook een lijst met goedgekeurde onderwerpen verstrekt. (1) Vat het hoofdonderwerp van het boek in één zin samen. (2) Verbind alleen de 3-5 meest geschikte titels uit de lijst met de redenering. (3) Ga niet van de lijst af, verzin geen voorwaarden. Tekst: [hier] /Lijst met goedgekeurde producten: [hier]
De sterke prompt beperkt de AI tot echte inhoud en gecontroleerde woordenschat; behoudt zowel nauwkeurigheid als consistentie.
Taakdiagram voor onderwerpanalyse
Zoektocht
Rol van AI
de beslissing van de mens
Inhoud samenvatting
snel ontwerp
nauwkeurigheidscontrole
Titel suggestie
Match uit lijst
Uiteindelijke keuze, rechtvaardiging
Classificatienummer
Masterclass suggestie
Verificatie van onderverdelingen
Bias-controle
markering
Inclusief termijnbesluit
Veel voorkomende fouten
- Ik vraag gewoon om een onderwerp uit de titel. Onderwerpanalyse is gebaseerd op context; De titel is misleidend.
- Het classificatienummer accepteren zonder het te verifiëren. Hoewel AI de hoofdklasse vindt, mist het de subbreak.
- Gecontroleerde woordenschat overslaan. Vrije term verbreekt de consistentie.
- Vooroordelen negeren. AI kan de verouderde, uitsluitende voorwaarden uit het verleden overnemen.
- De beslissing volledig aan AI overlaten. Vertegenwoordiging en rechtvaardigheid vereisen oordeel; De beslissing is aan de persoon.
Samengevat
Bij onderwerpanalyse en -classificatie is AI een snelle assistent die samenvattingen van de inhoud ophaalt, onderwerpen uit de goedgekeurde lijst matcht en classificatie-masterclasses voorstelt. Maar de analyse van het onderwerp is in wezen een kwestie van beoordeling en representatie: het is aan de deskundige om te beslissen welke titel het meest nauwkeurig en eerlijk de bron, de exacte cijfers van het classificatienummer en de valuta van de termen beschrijft. Voer de AI uit met echte inhoud en gecontroleerde woordenschat, verifieer classificatienummers met de officiële tabel en wees alert op vooringenomenheid.
Applicatie taak
Bereid een inleiding voor op een bron die je hebt en een korte lijst met goedgekeurde onderwerpen. Ontvang AI-suggesties met de sjablonen 'Onderwerpextractie' en 'Goedgekeurde onderwerpmatching'. Vergelijk vervolgens de suggesties met de officiële classificatietabel en het huidige vocabulaire van de instelling: hoeveel suggesties waren correct, hoeveel heb je verbeterd? Controleer aanbevelingen voor verouderde termen met de sjabloon 'Vooroordeel en recentheidscontrole'.
controlelijst
- [ ] Ik heb de onderwerpanalyse laten uitvoeren op basis van de daadwerkelijke inhoud, niet op basis van de titel.
- [ ] Ik heb de titels uit de gecontroleerde woordenschat in kaart gebracht.
- [ ] Ik heb de onderste cijfers van het classificatienummer geverifieerd met de officiële tabel.
- [ ] Ik heb suggesties gecontroleerd op verouderde en uitsluitende termen.
- [ ] Ik heb het definitieve onderwerp en de classificatiebeslissing naar eigen goeddunken genomen.