Enhet 4 / 11

Semantiske søke- og oppdagelsessystemer

Gevinster:

  • Å kunne forstå hvordan semantisk søk finner relevante ressurser som søkeordsøk går glipp av, med sin nærhet i betydning, og å kunne bruke begge metodene sammen på plass.
  • Evne til kritisk å vurdere AI-støttede sammendrag av oppdagelsessystemer i henhold til om de er kildebaserte eller ikke, og bekrefte dem med kilden.
  • Evne til å avklare brukerens vage spørsmål og skille "tilsynelatende relevante" resultater når det gjelder pålitelighet

En bruker søker i katalogen etter "søvnproblemer hos barn", men den mest relaterte ressursen heter "Pediatriske søvnforstyrrelser." Klassisk søk ​​viser kanskje ikke denne kilden i det hele tatt fordi den samsvarer nøyaktig med ordene. Det er her semantisk søk ​​spiller inn: det er en form for søk som samsvarer med betydningen av ordene, ikke stavemåten. I denne enheten vil du lære hvordan kunstig intelligens-baserte semantiske søke- og oppdagelsessystemer fungerer, hva de bringer til bibliotekaren, og hvilke fallgruver de har.

La oss definere det grunnleggende konseptet. I hjertet av semantisk søk ​​er innebygging: teknikken for å transformere betydningen av en tekst til en vektor av tall (en type meningskoordinat). Tekster som er nærme i betydning, er nær hverandre i dette tallrommet. Selv om "søvnproblem" og "søvnforstyrrelse" er forskjellige ord, ligger de tett sammen og et søk etter det ene vil også finne det andre. Dette er kraften til å fange opp relevante ressurser som søkeordsøk går glipp av.

Trinn for trinn: forstå og bruke semantisk søk

1. Forstå brukerens sanne intensjon. Semantisk søk ​​prøver å fange opp hva brukeren mener. Din jobb som bibliotekar er å avklare brukerens vage spørsmål og gi riktig input til søkesystemet.

2. Bruk nøkkelord og semantisk søk ​​sammen. Semantisk søk ​​finner ressurser med relaterte, men forskjellige ord; Et søkeordsøk er mer pålitelig når du leter etter en eksakt term, navn eller kode (et forfatternavn, et lovnummer). Den gode bibliotekaren bruker begge deler.

3. Vurder resultatene kritisk. Semantisk søk ​​gir resultater som "virker relevante"; Men å virke relevant betyr ikke å være nøyaktig eller pålitelig. Du vurderer kilden og aktualiteten til resultatene.

4. Lær brukerens søkestrategi. Oppdagelsessystemer er kraftige, men brukere søker ofte med enkeltord. En oppgave for bibliotekaren er å lære brukeren å søke bedre.

Tips: Semantisk søk ​​kan være svakere enn søkeord/domenesøk når man leter etter svært presis informasjon (et spesifikt ISBN, en fullstendig tittel, alle verk av en forfatter); fordi det forvirrer andre resultater som er "nær mening". Bruk domenebasert søk for presis informasjon, og semantisk søk ​​for oppdagelse og emnesurfing.

Oppdagelsessystemer og AI-drevne sammendrag

Moderne oppdagelsessystemer gir ikke lenger bare lister over resultater; Noen gir et direkte oppsummerende svar på et spørsmål med AI. Dette er en kraftig, men risikabel trend. Det er nyttig hvis systemet produserer sammendrag basert på faktiske kilder i samlingen og siterer kilden. Men hvis systemet genererer et svar fra sitt eget generelle minne uten å sitere kilden, medfører dette risiko for hallusinasjoner og kan feilinformere brukeren.

Bibliotekarens rolle er å fortelle brukeren om slike sammendrag er kildebasert eller ikke. Meldingen "Sammendraget gitt av systemet er en start; gå til den opprinnelige kilden og kontroller der" er grunnlaget for informasjonskompetanse.

Forsiktig: Selv om et AI-drevet funnsammendrag siterer en kilde, ikke anta at den siterte kilden faktisk støtter denne informasjonen. Noen ganger viser systemet riktig kilde, men returnerer feil sammendrag. For kritisk bruk, åpne og sjekk den relevante delen av ressursen sammen med brukeren.

tre minisaker

Tilfelle 1 - Rømt kilde funnet. En forsker lette etter ressurser på «den urbane varmeøya», men tittelen på den beste studien i samlingen var «termisk komfort i byer». Nøkkelordsøk gikk glipp av dette; semantisk søk ​​returnerte det blant de fem beste resultatene, takket være dets semantiske nærhet. Forskeren nådde en kilde han ellers ikke ville ha sett.

Sak 2 – Villedende «interesse». En bruker søkte etter "økonomiske årsaker til den franske revolusjonen". Semantisk søk ​​rangerte også flere kilder generelt om emnet "revolusjon og økonomi", men uten tilknytning til den franske revolusjonen. Bibliotekaren innså at disse "tilsynelatende relevante" resultatene faktisk ikke samsvarte med emnet og ledet brukeren til de riktige ressursene.

Tilfelle 3 — Sammendragsbekreftelse. Et oppdagelsessystem ga et AI-sammendrag til et spørsmål og siterte to kilder. Bibliotekaren åpnet kildene: den ene støttet sammendraget, den andre sa det motsatte av det sammendraget sa. Systemet feiltolket ressursen. Bibliotekaren viste lånetakeren riktig kilde og det faktiske funnet.

Rangering, synlighet og rettferdighet

Hvilken ressurs som kommer opp på toppen og hvilken nederst som et resultat av et søk er ikke en uskyldig teknikalitet; De aller fleste brukere ser kun på de første resultatene. Derfor avgjør rangeringen hvilken informasjon som faktisk blir sett. AI-basert rangering beregner «relevans»-beregningen basert på mønstre den har lært, og disse mønstrene kan ha en tendens til å fremheve kilder som er populære, høyt siterte eller på visse språk. Som et resultat kan verdifulle, men lite kjente ressurser på nye eller andre språk forbli usynlige. Bibliotekarens jobb er å vite at rekkefølge ikke er et nøytralt faktum og å lære brukeren å se forbi de første resultatene, prøve forskjellige søkeord og stille spørsmål ved rekkefølgen på resultatene. "Topp tre kilder" bør aldri sidestilles med "topp tre kilder", spesielt for et forskningsspørsmål. Oppdagelse krever å grave dypere i listen.

Tips: Når du lærer en bruker å søke, vis dem hvordan de søker etter samme emne ved å bruke to til tre forskjellige sett med termer. Ulike termer gir forskjellige resultatrangeringer; Dette bryter blindsonen skapt av et enkelt søk og åpner for en rikere pool av ressurser.

Fire kopierbare maler

1) Utvidelse av søkeord:

Berik søkeemnet nedenfor for semantisk og nøkkelordsøk. Liste synonymer, relaterte termer og mulige formelle/tekniske ekvivalenter. Foreslå bare termer som virkelig er relevante for emnet. Emne: [her]

2) Avklare brukerspørsmålet:

Foreslå 3 oppklarende spørsmål jeg bør stille for å avklare følgende vage brukerspørsmål (som omfang, punktum, sjanger, språk). Ikke anta brukerhensikt, presentere alternativer. Spørsmål: [her]

3) Evaluering av utfallsrelevans:

Nedenfor er et søkeemne og resultattitlene/sammendragene returnert. Vurder hvor relevant hvert resultat er for emnet som "høy/middels/lav" og gi en begrunnelse med én setning. Bare stol på teksten som er gitt. Emne: [her] / Resultater: [her]

4) Sammendrag-kildekonsistenssjekk:

Nedenfor er et sammendrag og kildeteksten som det hevdes å være basert på. Er hver påstand i sammendraget faktisk til stede i kildeteksten? Merk element for element "støttet / ikke støttet / delvis". Sammendrag: [her] / Kilde: [her]

Svak forespørsel / Sterk forespørsel

Svak melding:

List meg over de beste ressursene om dette emnet.

AI vet ikke fra hvilken samling, i henhold til hvilke kriterier, som skal velges fra faktisk eksisterende ressurser; kan produsere en sammensatt "best of"-liste fra hans generelle hukommelse.

Kraftig ledetekst:

Din rolle: speiderassistent. Nedenfor er søkeemnet og 15 faktiske resultater (tittel + sammendrag) returnert fra speidersystemet. List opp disse 15 resultatene i henhold til deres relevans for emnet og gi en begrunnelse med én setning for hver. Legger til en ny kilde til listen, gjør den opp. Emne: [her] / Resultater: [her]

Den kraftige ledeteksten begrenser AI til det virkelige resultatsettet og får det til å evaluere; Det forhindrer fabrikasjon og gjenfinning fra det generelle minnet.

Søketype sammenligningsdiagram

Status

beste metoden

Hvorfor

Nøyaktig tittel/ISBN/forfatter

Felt/søkeord

En-til-en-matching er pålitelig

Temautforskning, ulike termer

Semantisk søk

Fanger nærhet til mening

En aktuell hendelse/substantiv

nøkkelord + dato

Nøyaktighet og aktualitet

Beslektet men annen navnekilde

Semantisk søk

finner synonym

Vanlige feil

  • Bruke semantisk søk for presis informasjon. Domenesøk etter ISBN eller full tittel er mer pålitelig.
  • Forutsatt at "det som virker relevant" er sant. Nærhet til mening er ikke en garanti for pålitelighet eller nøyaktighet.
  • Gir AI-sammendraget uten å se på kilden. Sammendraget kan ha feiltolket kilden.
  • Avklarer ikke brukerens vage spørsmål. Feil input gir feil resultat.
  • Bruker kun én metode. Det er best å bruke semantisk og nøkkelordsøk sammen.

Oppsummert

Semantiske søke- og oppdagelsessystemer finner relevante ressurser som søkeordsøk går glipp av ved å matche betydningen, ikke ordet, og styrker oppdagelsen. AI-drevne sammendrag gir bekvemmelighet, men medfører risiko for hallusinasjoner og feiltolkning av kilden. Jobben til bibliotekaren; Bruke semantisk og nøkkelordsøk sammen, kritisk evaluere det som "virker relevant", verifisere AI-sammendrag med kilden, og lære brukeren en kildebasert, bekreftende søkevane.

Søknadsoppgave

Velg et emne og gjør både nøkkelord og semantiske søk (hvis aktuelt); sammenligne to sett med resultater: hvilke ekstra ressurser fant det semantiske søket, hvilke urelaterte resultater blandet det sammen? Generer et AI-drevet sammendrag (eller ta et eksempelsammendrag) og sjekk om påstandene i sammendraget faktisk forekommer i kilden med malen "Sammendrag-kildekonsistenssjekk".

sjekkliste

  • [ ] Jeg brukte domene/søkeord for presis informasjon og semantisk søk etter oppdagelse.
  • [ ] Jeg avklarte brukerens vage spørsmål.
  • [ ] Jeg evaluerte resultater som "så ut til å være relevante" for reliabilitet.
  • [ ] Jeg bekreftet AI-sammendragene med originalkilden.
  • [ ] Jeg forklarte brukerens kildebaserte søkevane.