Јединица 4 / 11

Системи семантичког претраживања и откривања

Добици:

  • Бити у стању да разуме како семантичка претрага проналази релевантне ресурсе које претрага кључних речи пропушта, са својом блискошћу у значењу, и да буде у стању да користи обе методе заједно на месту.
  • Способност критичке процене резимеа система откривања подржаних вештачком интелигенцијом према томе да ли су засновани на извору или не и потврдити их извором.
  • Способност да се разјасне корисниково нејасно питање и разликују 'наизглед релевантни' резултати у смислу поузданости

Корисник у каталогу претражује „проблеме са спавањем код деце“, али главни извор у вези је под насловом „Педијатријски поремећаји спавања“. Класична претрага можда уопште не приказује овај извор јер се тачно подудара са речима. Овде долази у обзир семантичка претрага: то је облик претраге који одговара значењу речи, а не њиховом правопису. У овој јединици ћете научити како функционишу системи семантичког претраживања и откривања засновани на вештачкој интелигенцији, шта доносе библиотекару и које замке носе.

Хајде да дефинишемо основни концепт. У срцу семантичке претраге је уграђивање: техника трансформације значења текста у вектор бројева (врста координата значења). Текстови који су блиски по значењу блиски су један другом у овом бројевном простору. Дакле, иако су "проблем спавања" и "поремећај спавања" различите речи, оне се налазе близу једна другој, а потрага за једним ће такође пронаћи и другу. Ово је моћ хватања релевантних ресурса које претрага кључних речи пропушта.

Корак по корак: разумевање и коришћење семантичке претраге

1. Разумети праву намеру корисника. Семантичка претрага покушава да ухвати шта корисник мисли. Ваш посао као библиотекара је да разјасните корисниково нејасно питање и дате исправан унос систему за претрагу.

2. Користите кључне речи и семантичку претрагу заједно. Семантичка претрага проналази ресурсе са сродним, али различитим речима; Претрага по кључним речима је поузданија када се тражи тачан појам, име или шифра (име аутора, законски број). Добар библиотекар користи и једно и друго.

3. Критички проценити резултате. Семантичка претрага враћа резултате који „изгледају релевантни“; Али изгледати релевантно не значи бити тачан или поуздан. Ви оцењујете извор и правовременост резултата.

4. Научите стратегију претраживања корисника. Дисцовери системи су моћни, али корисници често претражују једним речима. Један задатак библиотекара је да научи корисника да боље претражује.

Савет: Семантичка претрага може бити слабија од претраживања кључних речи/домена када се траже веома прецизне информације (одређени ИСБН број, пун наслов, сва дела аутора); јер збуњује друге резултате који су „блиски по значењу”. Користите претрагу засновану на домену за прецизне информације и семантичку претрагу за откривање и прегледање тема.

Системи за откривање и резимеи засновани на вештачкој интелигенцији

Савремени системи откривања више не пружају само листе резултата; Неки дају директан сажет одговор на питање са АИ. Ово је моћан, али ризичан тренд. Корисно је ако систем производи сажетке на основу стварних извора у колекцији и наводећи извор. Али ако систем генерише одговор из сопственог општег памћења без навођења извора, то носи ризик од халуцинације и може дезинформисати корисника.

Улога библиотекара је да каже кориснику да ли су такви резимеи засновани на извору или не. Порука „Резиме који је дао систем је почетак; идите до оригиналног извора и проверите тамо“ је основа информационе писмености.

Опрез: Чак и ако резиме открића који покреће вештачка интелигенција цитира извор, немојте претпостављати да цитирани извор заправо подржава ту информацију. Понекад систем приказује тачан извор, али враћа погрешан резиме. За критичне употребе, отворите и проверите релевантни одељак ресурса заједно са корисником.

три мини кофера

Случај 1 — Пронађени извори. Један истраживач је тражио ресурсе на „урбаном топлотном острву“, али наслов најбоље студије у колекцији био је „термални комфор у градовима“. Претрага кључних речи ово је пропустила; семантичка претрага га је вратила међу првих пет резултата, захваљујући његовој семантичкој близини. Истраживач је дошао до извора који иначе не би видео.

Случај 2 — Обмањујући „интерес“. Један корисник је тражио „економске узроке Француске револуције“. Семантичка претрага је такође рангирала неколико извора генерално на тему „револуције и економије“, али који нису повезани са Француском револуцијом. Библиотекар је схватио да ови „наизглед релевантни“ резултати заправо не одговарају теми и упутио је корисника на исправне ресурсе.

Случај 3 — Резиме верификације. Систем открића дао је АИ резиме питања и цитирао два извора. Библиотекар је отворио изворе: један је подржао резиме, други је рекао супротно од онога што је сажетак рекао. Систем је погрешно протумачио ресурс. Библиотекар је показао покровитељу тачан извор и стварни налаз.

Рангирање, видљивост и правичност

Који ресурс се појављује на врху, а који на дну као резултат претраге није безазлена техника; Велика већина корисника гледа само првих неколико резултата. Према томе, рангирање одређује које информације се заправо виде. Рангирање засновано на вештачкој интелигенцији израчунава своју метрику „релевантности“ на основу образаца које је научио, а ови обрасци могу имати тенденцију да истичу изворе који су популарни, високо цитирани или на одређеним језицима. Као резултат тога, вредни, али мало познати ресурси на новим или различитим језицима могу остати невидљиви. Посао библиотекара је да зна да редослед није неутрална чињеница и да научи корисника да гледа даље од почетних резултата, испроба различите термине за претрагу и доводи у питање редослед резултата. „Три најбоља извора“ никада не би требало да се изједначавају са „најбоља три извора“, посебно за истраживачко питање. Откриће захтева дубље копање у листу.

Савет: Када подучавате корисника да претражује, покажите му како да тражи исту тему користећи два до три различита скупа термина. Различити термини враћају различита рангирања резултата; Ово разбија слепу тачку створену једном претрагом и отвара богатији фонд ресурса.

Четири шаблона за копирање

1) Проширење термина за претрагу:

Обогатите тему претраге у наставку за семантичко претраживање и претраживање кључних речи. Наведите синониме, повезане термине и могуће формалне/техничке еквиваленте. Предложите само термине који су заиста релевантни за тему. Тема: [овде]

2) Појашњавање корисничког питања:

Предложите 3 појашњавајућа питања која треба да поставим да разјасним следеће нејасно корисничко питање (као што су обим, период, жанр, језик). Не претпостављајте намеру корисника, представите опције. Питање: [овде]

3) Процена релевантности исхода:

Испод је тема претраге и враћени наслови/сажеци резултата. Оцените колико је сваки резултат релевантан за тему као „висок/средњи/низак“ и дајте оправдање у једној реченици. Само се ослоните на дати текст. Тема: [овде] / Резултати: [овде]

4) Провера доследности резиме-извор:

Испод је сажетак и изворни текст на коме се тврди да се заснива. Да ли је свака тврдња у резимеу заиста присутна у изворном тексту? Означите ставку по ставку "подржано / неподржано / делимично". Резиме: [овде] / Извор: [овде]

Слаби промпт / Јаки промпт

Слабо обавештење:

Наведите ми најбоље ресурсе на ову тему.

АИ не зна из које колекције, према којим критеријумима, да бира између стварно постојећих ресурса; може произвести из свог општег памћења састављену листу „најбољих“.

Снажан упит:

Ваша улога: помоћник извиђача. Испод су тема претраге и 15 стварних резултата (наслов + сажетак) враћених из извиђачког система. Наведите ових 15 резултата према њиховој релевантности за тему и дајте оправдање у једној реченици за сваки. Додавање новог извора на листу, састављање. Тема: [овде] / Резултати: [овде]

Моћни промпт ограничава АИ на стварни скуп резултата и чини га проценом; Спречава измишљање и извлачење из опште меморије.

Табела поређења типова претраге

Статус

најбољи метод

Зашто

Тачан наслов/ИСБН/аутор

Поље/кључна реч

Упаривање један на један је поуздано

Истраживање теме, различити термини

Семантичка претрага

Захваћа блискост значења

Актуелни догађај/именица

кључна реч + датум

Тачност и благовременост

Сродан, али другачији извор имена

Семантичка претрага

налази синоним

Уобичајене грешке

  • Коришћење семантичке претраге за прецизне информације. Претраживање домена за ИСБН или пун наслов је поузданије.
  • Под претпоставком да је „оно што се чини релевантним“ истина. Блискост значења није гаранција поузданости или тачности.
  • Давање АИ резимеа без гледања у извор. Сажетак је можда погрешно протумачио извор.
  • Не разјашњавајући нејасно питање корисника. Погрешан унос доноси погрешан резултат.
  • Користећи само један метод. Најбоље је користити семантичку претрагу и претрагу по кључним речима заједно.

Укратко

Системи семантичке претраге и откривања проналазе релевантне ресурсе које претрага кључних речи пропушта тако што се подудара са значењем, а не са речју, и појачавају откривање. Сажеци засновани на вештачкој интелигенцији пружају погодност, али носе ризик од халуцинација и погрешног тумачења извора. Посао библиотекара; Коришћење семантичке претраге и претраживања кључних речи заједно, критичка процена онога што се „чини релевантним“, провера АИ резимеа са извором и подучавање корисника базираној на извору, потврђујући навику претраживања.

Задатак апликације

Изаберите тему и извршите претрагу по кључним речима и семантичку претрагу (ако је применљиво); упоредите два скупа резултата: које додатне ресурсе је пронашла семантичка претрага, које неповезане резултате је помешала? Генеришите резиме који покреће вештачка интелигенција (или узмите узорак резимеа) и проверите да ли се тврдње у резимеу заиста појављују у извору помоћу шаблона „Провера доследности резимеа-извора“.

контролна листа

  • [ ] Користио сам домен/кључну реч за прецизне информације и семантичку претрагу за откриће.
  • [ ] Појаснио сам корисниково нејасно питање.
  • [ ] Оценио сам резултате који су „изгледали релевантни“ у погледу поузданости.
  • [ ] Проверио сам АИ резимее са оригиналним извором.
  • [ ] Објаснио сам корисникову навику претраживања засновану на извору.