Winst:
- In staat zijn te begrijpen hoe semantisch zoeken relevante bronnen vindt die zoeken op trefwoorden mist, met de nauwe betekenis ervan, en beide methoden samen kunnen gebruiken.
- Mogelijkheid om AI-ondersteunde samenvattingen van detectiesystemen kritisch te evalueren op basis van de vraag of ze op de bron zijn gebaseerd of niet, en deze met de bron te bevestigen.
- Vermogen om de vage vraag van de gebruiker te verduidelijken en 'schijnbaar relevante' resultaten te onderscheiden in termen van betrouwbaarheid
Een gebruiker zoekt in de catalogus naar ‘slaapproblemen bij kinderen’, maar de belangrijkste gerelateerde bron is getiteld ‘Pediatrische slaapstoornissen’. Bij klassiek zoeken wordt deze bron mogelijk helemaal niet weergegeven, omdat deze exact overeenkomt met de woorden. Dit is waar semantisch zoeken een rol speelt: het is een vorm van zoeken die overeenkomt met de betekenis van woorden, niet met hun spelling. In dit onderdeel leer je hoe op kunstmatige intelligentie gebaseerde semantische zoek- en ontdekkingssystemen werken, wat ze de bibliothecaris opleveren en welke valkuilen ze met zich meebrengen.
Laten we het basisconcept definiëren. De kern van semantisch zoeken is inbedding: de techniek waarbij de betekenis van een tekst wordt omgezet in een vector van getallen (een soort betekeniscoördinaat). Teksten die qua betekenis dicht bij elkaar liggen, liggen in deze getallenruimte dicht bij elkaar. Hoewel 'slaapprobleem' en 'slaapstoornis' dus verschillende woorden zijn, liggen ze dicht bij elkaar en als je naar het een zoekt, vind je ook het ander. Dit is de kracht van het vinden van relevante bronnen die zoekwoorden missen.
Stap voor stap: semantisch zoeken begrijpen en gebruiken
1. Begrijp de ware bedoeling van de gebruiker. Semantisch zoeken probeert vast te leggen wat de gebruiker bedoelt. Jouw taak als bibliothecaris is om de vage vraag van de gebruiker te verduidelijken en de juiste input aan het zoeksysteem te geven.
2. Gebruik trefwoorden en semantisch zoeken samen. Semantisch zoeken vindt bronnen met verwante maar verschillende woorden; Zoeken op trefwoord is betrouwbaarder bij het zoeken naar een exacte term, naam of code (een auteursnaam, een wetsnummer). De goede bibliothecaris gebruikt beide.
3. Evalueer de resultaten kritisch. Semantisch zoeken levert resultaten op die “relevant lijken”; Maar relevant lijken betekent niet dat je accuraat of betrouwbaar bent. Je beoordeelt de herkomst en actualiteit van de resultaten.
4. Leer de zoekstrategie van de gebruiker. Discovery-systemen zijn krachtig, maar gebruikers zoeken vaak met enkele woorden. Een taak van de bibliothecaris is om de gebruiker beter te leren zoeken.
Tip: Semantisch zoeken kan zwakker zijn dan zoeken op trefwoord/domein bij het zoeken naar zeer precieze informatie (een specifiek ISBN, een volledige titel, alle werken van een auteur); omdat het andere resultaten verwart die "een nauwe betekenis hebben". Gebruik domeingebaseerd zoeken voor nauwkeurige informatie, en semantisch zoeken voor ontdekking en zoeken naar onderwerpen.
Ontdekkingssystemen en AI-aangedreven samenvattingen
Moderne ontdekkingssystemen bieden niet langer alleen maar lijsten met resultaten; Sommigen produceren met AI een direct samenvattend antwoord op een vraag. Dit is een krachtige maar risicovolle trend. Het is handig als het systeem samenvattingen maakt op basis van feitelijke bronnen in de collectie en met bronvermelding. Maar als het systeem een antwoord genereert uit zijn eigen algemene geheugen zonder de bron te vermelden, brengt dit het risico van hallucinaties met zich mee en kan de gebruiker verkeerd worden geïnformeerd.
De rol van de bibliothecaris is om de gebruiker te vertellen of dergelijke samenvattingen al dan niet op de bron zijn gebaseerd. De boodschap “De samenvatting die het systeem geeft is een begin; ga naar de oorspronkelijke bron en verifieer daar” is de basis van informatievaardigheden.
Let op: zelfs als een door AI aangestuurde ontdekkingssamenvatting een bron citeert, mag u er niet vanuit gaan dat de geciteerde bron die informatie daadwerkelijk ondersteunt. Soms toont het systeem de juiste bron, maar retourneert het de verkeerde samenvatting. Voor kritisch gebruik opent en controleert u samen met de gebruiker het relevante gedeelte van de bron.
drie minikoffers
Casus 1 — Ontsnapte bron gevonden. Eén onderzoeker was op zoek naar hulpbronnen op het ‘stedelijke hitte-eiland’, maar de titel van het beste onderzoek in de collectie was ‘thermisch comfort in steden’. Zoeken op trefwoord heeft dit gemist; semantisch zoeken leverde het op in de top vijf van resultaten, dankzij de semantische nabijheid. De onderzoeker bereikte een bron die hij anders niet zou hebben gezien.
Geval 2 – Misleidende ‘interesse’. Eén gebruiker zocht naar 'economische oorzaken van de Franse Revolutie'. Semantisch zoeken rangschikte ook verschillende bronnen die doorgaans over het onderwerp "revolutie en economie" gingen, maar geen verband hielden met de Franse Revolutie. De bibliothecaris realiseerde zich dat deze "schijnbaar relevante" resultaten niet echt overeenkwamen met het onderwerp en stuurde de gebruiker naar de juiste bronnen.
Geval 3 — Samenvattende verificatie. Een ontdekkingssysteem gaf een AI-samenvatting bij een vraag en citeerde twee bronnen. De bibliothecaris opende de bronnen: de een ondersteunde de samenvatting, de ander zei het tegenovergestelde van wat er in de samenvatting stond. Het systeem heeft de bron verkeerd geïnterpreteerd. De bibliothecaris liet de opdrachtgever de juiste bron en de daadwerkelijke bevinding zien.
Rangschikking, zichtbaarheid en eerlijkheid
Welke bron bovenaan verschijnt en welke onderaan als resultaat van een zoekopdracht is geen onschuldig technisch gegeven; De overgrote meerderheid van de gebruikers kijkt alleen naar de eerste paar resultaten. Daarom bepaalt de ranking welke informatie daadwerkelijk wordt gezien. Op AI gebaseerde ranking berekent de ‘relevantie’-metriek op basis van patronen die het heeft geleerd, en deze patronen kunnen de neiging hebben om bronnen te benadrukken die populair zijn, veel worden geciteerd of in bepaalde talen voorkomen. Als gevolg hiervan kunnen waardevolle maar weinig bekende bronnen in nieuwe of andere talen onzichtbaar blijven. De taak van de bibliothecaris is om te weten dat de volgorde geen neutraal feit is en om de gebruiker te leren verder te kijken dan de eerste resultaten, verschillende zoektermen uit te proberen en de volgorde van de resultaten in twijfel te trekken. De ‘top drie bronnen’ mogen nooit gelijkgesteld worden met de ‘top drie bronnen’, vooral niet als het om een onderzoeksvraag gaat. Ontdekking vereist dieper graven in de lijst.
Tip: Wanneer u een gebruiker leert zoeken, laat hem dan zien hoe hij naar hetzelfde onderwerp kan zoeken met behulp van twee tot drie verschillende sets termen. Verschillende termen leveren verschillende resultaten op; Dit doorbreekt de blinde vlek die door een enkele zoekopdracht wordt gecreëerd en opent een rijkere verzameling bronnen.
Vier kopieerbare sjablonen
1) Uitbreiding van zoektermen:
Verrijk het onderstaande zoekonderwerp voor semantisch zoeken en zoeken op trefwoorden. Maak een lijst van synoniemen, verwante termen en mogelijke formele/technische equivalenten. Stel alleen termen voor die echt relevant zijn voor het onderwerp. Onderwerp: [hier]
2) Verduidelijking van de gebruikersvraag:
Stel drie verduidelijkende vragen voor die ik zou moeten stellen om de volgende vage gebruikersvraag te verduidelijken (zoals reikwijdte, periode, genre, taal). Ga niet uit van de intentie van de gebruiker, maar presenteer opties. Vraag: [hier]
3) Evaluatie van de relevantie van de uitkomsten:
Hieronder vindt u een zoekonderwerp en de resultaattitels/samenvattingen worden geretourneerd. Beoordeel hoe relevant elk resultaat is voor het onderwerp als 'hoog/gemiddeld/laag' en geef een rechtvaardiging van één zin. Vertrouw gewoon op de gegeven tekst. Onderwerp: [hier] / Resultaten: [hier]
4) Consistentiecontrole van de samenvattende bron:
Hieronder vindt u een samenvatting en de brontekst waarop deze zou zijn gebaseerd. Is elke claim in de samenvatting daadwerkelijk aanwezig in de brontekst? Markeer item voor item "ondersteund / niet ondersteund / gedeeltelijk". Samenvatting: [hier] / Bron: [hier]
Zwakke prompt/sterke prompt
Zwakke prompt:
Noem mij de beste bronnen over dit onderwerp.
De AI weet niet uit welke collectie, volgens welke criteria, hij moet kiezen uit daadwerkelijk bestaande bronnen; kan een opgestelde ‘best of’-lijst opstellen op basis van zijn algemene geheugen.
Krachtige prompt:
Jouw rol: scout-assistent. Hieronder vindt u het zoekonderwerp en 15 daadwerkelijke resultaten (titel + samenvatting) die door het scoutsysteem zijn geretourneerd. Noem deze vijftien resultaten op basis van hun relevantie voor het onderwerp en geef voor elk een rechtvaardiging in één zin. Een nieuwe bron aan de lijst toevoegen, deze verzinnen. Onderwerp: [hier] / Resultaten: [hier]
De krachtige prompt beperkt de AI tot de echte resultatenset en zorgt ervoor dat deze wordt geëvalueerd; Het voorkomt verzinsel en ophalen uit het algemene geheugen.
Vergelijkingstabel voor zoektypen
Status
beste methode
Waarom
Exacte titel/ISBN/auteur
Veld/trefwoord
Eén-op-één matching is betrouwbaar
Onderwerpverkenning, verschillende termen
Semantisch zoeken
Legt de nabijheid van betekenis vast
Een actuele gebeurtenis/zelfstandig naamwoord
trefwoord + datum
Nauwkeurigheid en tijdigheid
Gerelateerde maar andere naambron
Semantisch zoeken
vindt synoniem
Veel voorkomende fouten
- Semantisch zoeken gebruiken voor nauwkeurige informatie. Zoeken op domein naar ISBN of volledige titel is betrouwbaarder.
- Ervan uitgaande dat "wat relevant lijkt" waar is. De nabijheid van de betekenis is geen garantie voor betrouwbaarheid of nauwkeurigheid.
- De AI-samenvatting geven zonder naar de bron te kijken. De samenvatting heeft de bron mogelijk verkeerd geïnterpreteerd.
- Geen verduidelijking van de vage vraag van de gebruiker. Verkeerde invoer leidt tot verkeerd resultaat.
- Slechts één methode gebruiken. Het is het beste om semantisch zoeken en zoeken op trefwoorden samen te gebruiken.
Samengevat
Semantische zoek- en ontdekkingssystemen vinden relevante bronnen die zoekwoorden missen door de betekenis te matchen, en niet het woord, en versterken de ontdekking. Door AI aangedreven samenvattingen bieden gemak, maar brengen het risico met zich mee van hallucinatie en verkeerde interpretatie van de bron. De taak van de bibliothecaris; Door semantisch zoeken en zoeken op trefwoorden samen te gebruiken, kritisch te evalueren wat "relevant lijkt", AI-samenvattingen te verifiëren met de bron, en de gebruiker een brongebaseerde, bevestigende zoekgewoonte aan te leren.
Applicatie taak
Kies een onderwerp en voer zowel trefwoord- als semantische zoekopdrachten uit (indien van toepassing); vergelijk twee reeksen resultaten: welke aanvullende bronnen heeft de semantische zoekopdracht gevonden, welke niet-gerelateerde resultaten zijn door elkaar gehaald? Genereer een AI-aangedreven samenvatting (of maak een voorbeeldsamenvatting) en controleer of de claims in de samenvatting ook daadwerkelijk in de bron voorkomen met de sjabloon ‘Samenvatting-bronconsistentiecontrole’.
controlelijst
- [ ] Ik heb domein/trefwoord gebruikt voor nauwkeurige informatie en semantisch zoeken naar ontdekking.
- [ ] Ik heb de vage vraag van de gebruiker verduidelijkt.
- [ ] Ik evalueerde resultaten die "relevant leken te zijn" voor de betrouwbaarheid.
- [ ] Ik heb de AI-samenvattingen geverifieerd met de originele bron.
- [ ] Ik heb de brongebaseerde zoekgewoonte van de gebruiker uitgelegd.