одиниця 1 / 11

Вступ до штучного інтелекту в бібліотечній справі та управлінні інформацією: ролі, межі, автентифікація, конфіденційність та етика

Прибуток:

  • Можливість розрізнити, де штучний інтелект економить час у бібліотечному робочому процесі (метадані, зведення, пошук, пропозиції), а де рішення щодо точності, надійності джерела та конфіденційності залишаються за людьми, залежно від рівня ризику.
  • Здатність застосовувати дисципліну, яка перевіряє кожен результат, пов’язуючи його з джерелом, підтверджуючи його в незалежному джерелі та пропускаючи через фільтр упередженості.
  • Розуміння того, чому галюцинації, сфабриковані джерела та конфіденційність користувачів є ризиками, які необхідно враховувати в цій професії з самого початку.

Коли фахівець із каталогізації вранці сідає за свій стіл, у нього можуть бути десятки щойно надійшли книг, сотні документів із колекції пожертв та архівна скринька, які очікують на оцифрування. Бібліотекар-довідник (експерт, який допомагає користувачам знаходити інформацію) протягом дня відповідає на такі запитання, як «де надійне джерело на цю тему?» Менеджер інформації відповідає за те, щоб тисячі документів організації залишалися доступними та надійними. У цьому розділі ми з’ясуємо, де саме штучний інтелект (коротко ШІ; великі мовні моделі та подібні інструменти) економить час у цих завданнях, а де судження, вибір і відповідальність залишаються за людиною.

Почнемо з визначення: штучний інтелект, під яким ми маємо на увазі програмні інструменти, що створюють мову та розпізнають шаблони, навчені на великих обсягах тексту. Ці інструменти підсумовують, перекладають, пропонують класифікацію, генерують чернетки тексту та шаблони прапорців у великих фрагментах даних. Але він не знає, чи дійсно існує джерело, чи правильна інформація, чи захищена конфіденційність користувача. Ось чому в бібліотечній справі та управлінні інформацією ШІ є помічником, а не особою, яка приймає рішення.

Де штучний інтелект працює, а де ні?

Давайте розділимо бібліотечний робочий процес на три рівні. Перший рівень — це механічні та повторювані завдання: вилучення чернеток метаданих із авторського рядка книги, підсумовування довгого звіту, переклад тексту з однієї мови на іншу, очищення таблиці даних. ШІ тут потужний і значно економить час.

Другий рівень – квазісудова робота: яку тематику дати документу, чи включати ресурс до колекції, який ресурс рекомендувати користувачеві. Тут AI виробляє пропозиції, але останнє слово залишається за експертом, який знає політику закладу та реальні потреби користувача.

Третій рівень — це суто судження та підзвітність: підтвердження того, що інформація є точною, рішення щодо авторських прав, чи розкривати конфіденційні персональні дані, підтвердження надійності джерела. На цьому рівні вихід ШІ є лише відправною точкою; Відповідальність повністю лежить на людях.

Порада: перш ніж поставити завдання штучному інтелекту, запитайте себе: «Що трапиться, якщо цей результат буде неправильним?» Якщо відповідь «Я втрачу трохи часу», сміливо використовуйте ШІ. Якщо відповідь: «поширюється неправдиве джерело, користувача введено в оману або стався витік особистих даних», обов’язково перевірте вихідні дані.

Галюцинація: найбільша небезпека для бібліотекаря

Галюцинація — це коли штучний інтелект видає неіснуючу інформацію, джерело чи цитату так, ніби вони справжні, і надзвичайно переконливою мовою. Це особливо небезпечно для бібліотечної справи та управління інформацією; тому що суть нашої професії - достовірність і достовірність джерела.

Коли ви наказуєте штучному інтелекту «запропонувати п’ять наукових робіт на цю тему», він може генерувати назви, авторів і назви журналів, які здаються справжніми, але взагалі не існують. Ці сфабриковані джерела настільки переконливі, що меценат чи навіть бібліотекар може додати їх до бібліографії, не перевіряючи. У гуманітарних і соціальних науках небезпека ще більша: коли для історика фальсифікують «той документ 1897 року», а для юриста «те судове рішення», результатом стає серйозна дезінформація.

Увага: Жодне цитування джерела, цитата чи посилання, створені штучним інтелектом, не повинні передаватись без перевірки в справжньому каталозі, базі даних або в самому джерелі. Те, що це «виглядає переконливо», не означає, що це правда.

Перевірочна дисципліна: три кроки

Основна дисципліна, яку повинен дотримуватися бібліотекар під час роботи з ШІ, така:

1. Підключіться до джерела. Кожен факт, цифра, дата та вихідні дані мають ґрунтуватися на оригінальному джерелі. Попросіть штучного інтелекту «скажи мені, з якого джерела ви отримали цю інформацію» і перевірте це джерело самостійно.

2. Самостійно підтвердити. Перевірте важливу інформацію принаймні в одному надійному джерелі за межами AI (автентичний каталог, офіційна база даних, первинний документ).

3. Пропустіть його через фільтр зсуву. ШІ переносить упередження даних, на яких він навчається. Запропонована тема, список пропозицій або резюме можуть висвітлити певні точки зору та приховати інші. Запитайте, хто залишився осторонь, якої точки зору не вистачає.

Конфіденційність і конфіденційність користувачів

Одним із найфундаментальніших етичних принципів професії бібліотекаря є конфіденційність користувача: те, що людина читає, що вона шукає та яка тема її цікавить, є конфіденційною. Введення даних в інструменти штучного інтелекту, особливо загальнодоступні інструменти, які працюють через Інтернет, які включають ідентифікаційні дані користувачів, історію пошуку або запозичені ресурси, може порушити цей принцип; оскільки ці дані можуть надходити до сторонніх систем.

Так само в організації несекретні, але конфіденційні документи (інформація про персонал, контракти, внутрішнє листування) не слід завантажувати в загальний інструмент ШІ. Інструменти, які працюють у власній захищеній закритій системі установи, є кращими для цього типу даних.

Порада: перш ніж вводити будь-які дані в AI, запитайте "Ця інформація загальнодоступна?" запитати. Якщо відповідь «ні» або ви не впевнені, перемістіть ці дані в деперсоналізований, анонімний формат або використовуйте лише безпечні інструменти, схвалені установою.

три міні-чохла

Випадок 1 — Чернетки метаданих для 400 документів. Університетська бібліотека повинна була каталогізувати архів із 400 документів, подарованих професором. Експерт виділив чернетку назви, дати та теми з першої сторінки кожного документа за допомогою ШІ: середній час на документ зменшився з 12 хвилин до 4 хвилин. Але кожен чорновий відбиток звірявся з оригінальним документом і затверджувався експертом; На цьому кроці було виявлено 17 неправильних дат, вигаданих ШІ.

Випадок 2 — Зловлено фейкове джерело. Бібліотекар-консультант отримав від YZ 6 пропозицій статей під час пошуку ресурсів на тему «кліматична міграція» для студента бакалаврату. Бібліотекар перешукала їх усіх у базі даних установи: 2 із 6 статей взагалі не існувало. Етап перевірки запобіг студенту отримати сфабриковане джерело.

Випадок 3 — Попереджено порушення конфіденційності. Бібліотека розглянула можливість використання загального інструменту штучного інтелекту для аналізу того, «який користувач цікавиться якою темою» на основі записів перевірки. Менеджер інформації зрозумів, що це буде порушенням конфіденційності, якщо ці дані вийдуть разом з ідентифікатором користувача; дані спочатку були знеособлені та оброблені виключно як узагальнена, деідентифікована статистика.

Чотири шаблони, які можна копіювати

1) Почніть визначати ролі та межі:

Ваша роль: досвідчений помічник спеціаліста з каталогізації та управління інформацією. Ваше завдання: створити чернетку з інформації з джерела, яке я вам надав. Правила: (1) Використовуйте лише інформацію з наданого мною тексту, не додавайте власну інформацію. (2) Позначте «[має бути перевірено]», якщо ви не впевнені. (3) Не вигадуйте жодних дат, імен чи відбитків. Якщо розумієш, починай. Джерело: [тут]

2) Запитання перевірки підтвердження:

Перелічіть кожну фактичну заяву (дата, ім’я, номер, посилання на джерело) у тексті нижче. Для кожного: звідки в тексті ви взяли цю інформацію? Якщо в тексті незрозуміло, напишіть «не в тексті». Текст: [тут]

3) Упередженість і перевірка відсутності перспективи:

Які перспективи висвітлює наведене нижче резюме/рекомендація, а які не розглядаються? Які групи, регіони чи представлення можуть бути відсутні? Просто покладайтеся на текст, не спекулюйте. Текст: [тут]

4) Попередня перевірка конфіденційності:

Чи містить наведений нижче текст особисті дані (ім’я, ідентифікаційний номер, контакт, історію читання/пошуку) або конфіденційну корпоративну інформацію? Якщо так, укажіть його та запропонуйте, як його можна анонімізувати. Текст: [тут]

Слабка підказка / Сильна підказка

Слабка підказка:

Знайдіть мені деякі ресурси на цю тему.

Ця підказка запрошує штучний інтелект створити підроблені ресурси. Немає ролей, обмежень, правил перевірки та ресурсів. ШІ може створити правдоподібні, але неіснуючі теги.

Потужна підказка:

Ваша роль: помічник бібліотекаря-довідника. Виберіть ті, які пов’язані з темою «кліматична міграція», з наведених нижче статей каталогу та поясніть, чому вони актуальні. Не додавайте жодних джерел, яких немає в списку, не фабрикуйте джерела. Якщо ви не впевнені, скажіть «немає відповідних джерел у списку». Записи в каталозі: [тут]

Різниця очевидна: сильна підказка змушує AI працювати з даного реального джерела, а не з власної пам’яті, і запобігає фабрикації.

Таблиця рівнів і відповідальності

бізнес-рівень

зразок завдання

Роль ШІ

рішення людини

механічний

Чернетки метаданих, резюме, переклад

Швидко створює протяги

перевірка, затвердження

квазісудовий

Назва теми, пропозиція джерела

пропонує пропозиції

Вибір за політикою

чисте судження

Автентифікація, рішення про авторські права

Лише попередня інформація

Повна відповідальність лежить на людині

Поширені помилки

  • Заміна виходу ШІ на джерело. ШІ – помічник, а не ресурс; Кожен результат перевіряється.
  • Прийняття сфабрикованого джерела як переконливого. Те, що це виглядає добре, не означає, що це правильно.
  • Введення особистих/конфіденційних даних у загальнодоступний інструмент. Конфіденційність користувачів і корпоративна конфіденційність поважаються з самого початку.
  • Ігнорування упереджень. AI передає перспективи даних, на яких він навчається; Запитайте, чого не вистачає.
  • Залишаючи судження ШІ. Рішення щодо точності, авторських прав і конфіденційності належать людям.

Підсумовуючи

штучний інтелект; Це потужний помічник для конспектування, складання, перекладу та маркування шаблонів у бібліотечній справі та управлінні інформацією. Це значно економить час на механічній роботі; дає поради з квазісудових питань; Але перевірка точності, надійності джерела, конфіденційності користувачів і етичних рішень належать людям. Найбільшу небезпеку для цієї професії становлять галюцинації: жодні джерела чи цитати не використовуються без перевірки. Запустіть ШІ з чіткими правилами ролі, меж і перевірки; Підтверджуйте кожен критичний вихід із незалежним джерелом.

Аплікаційне завдання

Виберіть реальну тему зі своєї галузі. Попросіть штучного інтелекту надати 5 рекомендацій щодо ресурсів на цю тему, а потім знайдіть кожен із них у справжньому каталозі чи базі даних і запам’ятайте, скільки насправді існує. Потім за допомогою шаблону «Запуск, що визначає ролі та межі» скажіть штучному інтелекту працювати лише з наданого вами тексту та порівняйте результати двох підходів. Напишіть, який підхід заважає підгонці.

контрольний список

  • [ ] Я визначив, на якому рівні (механічний, напівсудовий, чисте судження) знаходиться завдання.
  • [ ] "Що станеться, якщо цей вивід буде неправильним?" Я поставив запитання.
  • [ ] Я перевірив кожне авторство та цитування з незалежним джерелом.
  • [ ] Я перевірив, чи немає особистої/конфіденційної інформації в даних, які надходять до ШІ.
  • [ ] Я залишив остаточне рішення та відповідальність на власний розсуд.