Прибуток:
- Можливість скоротити час каталогізації шляхом створення проектів метаданих відповідно до таких стандартів, як MARC і Dublin Core, із реальної інформації вихідних даних
- Можливість перевіряти поля з високим ризиком фальсифікації, такі як рік публікації, ISBN, ім’я автора, з першоджерелом і картою предметних термінів із контрольованого словника
- Можливість затверджувати авторські та тематичні формати з контролем повноважень і підтримувати узгодженість каталогу
Каталогізація — невидима, але найважливіша робота бібліотечної справи. Відкриття ресурсу (книги, статті, карти, звукозапису, цифрового файлу) можливе за наявності правильних метаданих. Метадані означають «дані про дані»: структуровану інформацію, яка описує назву ресурсу, автора, рік публікації, тему, мову та фізичні атрибути. Якщо метадані хороші, користувач знаходить ресурс; Якщо він поганий або неповний, ресурс втрачається, навіть якщо він існує. У цьому розділі ви дізнаєтесь, як використовувати штучний інтелект для створення чернеток метаданих, а також як забезпечити відповідність стандартам і точність.
Давайте спочатку визначимо два поняття. MARC (Machine-Readable Cataloging) — це формат запису, який бібліотеки використовували протягом десятиліть і розміщує кожну інформацію в пронумерованих полях; Наприклад, поле 245 містить назву, а поле 100 містить основного автора. Dublin Core — це спрощений стандарт метаданих для цифрових ресурсів, що складається з 15 основних полів (назва, автор, тема, дата, жанр тощо). Ці стандарти гарантують, що записи з різних бібліотек можуть спілкуватися одна з одною.
Крок за кроком: створення чернеток метаданих за допомогою штучного інтелекту
1. Зберіть інформацію про особу джерела. Обкладинка книги, титульна сторінка, зміст або текст цифрового файлу. ШІ працює лише на основі інформації, яку ви йому надаєте; Якщо ви надаєте неповну інформацію, це створює неповні або сфабриковані метадані.
2. Вкажіть цільовий стандарт. Дайте штучному інтелекту чітку ціль, наприклад «за полями Dublin Core» або «за полями MARC 245, 100, 260, 650». Якщо ви не вкажете стандарт, буде створено довільний формат.
3. Виготовити чернетку. ШІ створює назву, заяву про відповідальність, інформацію про публікацію та пропозицію теми на основі наданої вами інформації.
4. Здійснювати повноваження. Достовірний запис — це запис, який встановлює єдину стандартну форму імені автора, установи або теми (наприклад, «Ататюрк, Мустафа Кемаль, 1881-1938»). ШІ може писати ім’я різними способами; Ви перевіряєте та виправляєте затверджений формат повноважень.
5. Перевірити та підтвердити. Порівняйте кожне поле з першоджерелом. Зокрема, точна інформація, така як рік видання, ISBN та ім’я автора, дуже схильна до підробки ШІ.
Підказка: дайте штучному інтелекту фотографію або текст фактичної кредитної сторінки джерела; Не кажіть «вгадай назву книги». Прогнозовані метадані підривають надійність каталогу. ШІ пише впевнено, коли робить прогнози, і це введе вас в оману.
Контрольований словниковий запас і послідовність
Послідовність - це все в каталогізації. Якщо одна тема написана з двома різними термінами в двох різних записах, користувач знайде один і пропустить інший. Тому в бібліотеках використовується контрольований словник — затверджений стандартний перелік термінів. Пропонуючи терміни з вільного тексту, ШІ може вибрати його розмовний еквівалент, а не офіційний термін у цьому списку. Наприклад, AI може написати «серцевий напад»; тоді як затверджений термін може бути «інфаркт міокарда».
Рішення полягає в тому, щоб надати ШІ контрольований словник і сказати «просто виберіть із цього списку». Тож замість того, щоб вільно вигадувати умови, ШІ підбирає найбільш підходящий із затвердженого списку.
Застереження: якщо предметний термін, запропонований ШІ, не входить до контрольованого словника, не додавайте цей термін до каталогу. Рішення про додавання нових термінів приймає експерт, відповідальний за управління повноваженнями; Додавання довільних термінів порушує узгодженість каталогу.
три міні-чохла
Кейс 1 — Прискорений збір пожертв. Громадська бібліотека отримала в дар 1200 книг. Спеціаліст із каталогізації наказав ШІ прочитати вихідні сторінки кожної книги та створити чернетку Дублінського ядра; Час запису зменшився з 9 хвилин до 3,5 хвилин. Час, що залишився, експерт присвятив перевірці повноважень; Загальний час було скорочено приблизно на 55%, але жодні записи не надходили в систему без перевірки.
Випадок 2 — Зловили фальшивий ISBN. Експерт змусив ШІ створити чернетки 30 книг. Під час перевірки він виявив, що номер ISBN у 4 записах був підробленим: штучний інтелект написав 13-значний номер, який здавався розумним, хоча він не знав справжнього номера книги. Етап перевірки не дозволив чотирьом неправильним ISBN стати постійними в каталозі.
Випадок 3 — невідповідність повноважень виправлено. Бібліотека знайшла автора як "Дж. Сміт" в одних записах, "Джон Сміт" в інших, "Сміт, Джон" в інших. AI був узгоджений з авторитетним файлом, привівши всі записи в єдиний затверджений формат ("Сміт, Джон, 1965-"); Якби ця робота виконувалася вручну, це зайняло б кілька днів, але завдяки підказці штучного інтелекту вона скоротилася до кількох годин, але кожен збіг схвалюється експертом.
Ретроспективне перетворення та старі записи
Багато бібліотек мають неповні або застарілі записи, які були введені багато років тому за іншими правилами. Перехід до поточного стандарту називається ретроспективним перетворенням і є дуже трудомістким, якщо виконувати вручну. AI може прочитати старий запис і створити чернетку, щоб перемістити його в поточну структуру полів: наприклад, він може проаналізувати цитату з довільним текстом і розподілити її по потрібним полям. Однак тут є дві небезпеки. По-перше, штучний інтелект може компенсувати відсутню інформацію, щоб «надолужити»; по-друге, це може зберегти помилку в старому записі, скопіювавши його в новий формат, а не виправляючи. Тому при ретроспективному перетворенні вихід ШІ слід перевіряти систематично, не шляхом вибірки, а за критичними полями (автор, рік, ідентифікаційні номери). Хорошою практикою є відображення записів до і після перетворення поруч, роблячи кожну зміну видимою; тому експерт може з першого погляду побачити, що було переміщено, що змінилося, а що, можливо, було сфабриковано.
Увага: чернетки метаданих, створені штучним інтелектом, не слід передавати в систему як пакет, не переглядаючи їх один за іншим. Масова помилка пошкоджує сотні записів одночасно, а отримання набагато складніше, ніж створення. Найбезпечніше виробляти і перевіряти невеликими партіями.
Чотири шаблони, які можна копіювати
1) Структура Дублінського ядра:
Ваша роль: помічник каталогізатора. Заповніть поля Dublin Core з наступного тексту автора: Назва, Творець, Тема, Опис, Видавець, Дата, Жанр, Формат, Мова. Використовуйте лише зрозумілу в тексті інформацію; Залиште пропущене поле «[немає інформації]», не гадайте. Текст вихідних даних: [тут]
2) Схема поля MARC:
Запропонуйте схеми для таких полів MARC з інформації про книгу нижче: 245 (назва/авторство), 100 (основний автор), 260/264 (публікація), 300 (фізичний опис), 650 (тема). Позначте будь-яке поле, у якому ви не впевнені, як «[потребує перевірки]». Інформація: [тут]
3) Зіставлення теми з контрольованої лексики:
Нижче наведено короткий виклад джерела та список затверджених термінів теми. Установіть відповідність між 3-5 найбільш підходящими термінами зі списку та джерелом. Якщо в списку немає відповідного терміна, напишіть «немає підходящого терміну в списку», нових термінів не придумуйте. Резюме: [тут] / Список термінів: [тут]
4) Контроль форми повноважень:
Зіставте наведені нижче імена авторів із затвердженими формами в наданому мною списку повноважень. Для кожного імені: формат у записі -> затверджений формат. Якщо в списку немає еквівалента, напишіть «немає авторитетного запису». Імена: [тут] / Список авторитетів: [тут]
Слабка підказка / Сильна підказка
Слабка підказка:
Витягніть каталогізаційну інформацію для такої книги: "Штучний інтелект і суспільство".
Надається лише назва; ШІ змушений вказати автора, рік, видавця та ISBN. Цільового стандарту немає. Результат: переконливий, але ймовірно фальшивий запис.
Потужна підказка:
Ваша роль: помічник каталогізатора. Нижче подано повний текст вихідної сторінки книги. Заповніть поля Dublin Core звідси. Використовуйте лише інформацію, яка чітко викладена в тексті; Залиште нетекстове поле порожнім і напишіть "[немає інформації]". Дати, імена чи номери ISBN не вигадуються. Текст вихідних даних: [повний текст тут]
Потужна підказка обмежує ШІ справжньою інформацією про автора та змушує його чесно залишати порожні місця, а не вигадувати їх.
Поле метаданих і таблиця перевірки
область
Ризик виготовлення
Як перевірити
Назва
низький
Порівняйте зі сторінкою вихідних даних
Формат автор/авторитет
середній
Пошук в авторитетному файлі
Рік видання
висока
Підтвердьте вихідними даними/колофоном
ISBN
дуже високий
Індивідуальний контроль за допомогою штрих-коду/джерела
Предметний термін
висока
Відповідність у контрольованій лексиці
Поширені помилки
- Просто запит метаданих із заголовка. Неповна інформація спонукає ШІ щось вигадувати.
- Не вказуючи цільовий стандарт. Довільне форматування порушує гармонійність записів.
- Прийняття ISBN і року без перевірки. У цих областях найвищий ризик виготовлення.
- Взяття предметного терміна поза межами контрольованого словника. Узгодженість і доступність порушено.
- Обхід контролю влади. Один і той же автор розходиться по різних форматах, користувач пропускає джерело.
Підсумовуючи
У створенні метаданих штучний інтелект є потужним помічником, який швидко витягує вихідні дані та значно скорочує час каталогізації. Але ціною продуктивності є сувора перевірка проти ризиків фальсифікації: зробіть цільовий стандарт (MARC, Dublin Core) чітким, запустіть ШІ лише з реальними знаннями слів, відобразіть предметні терміни з контрольованих словників і перевірте авторитетні форми. Замість того, щоб компенсувати прогалини, ШІ повинен чесно залишити це поле порожнім; Ви зберігаєте остаточне затвердження.
Аплікаційне завдання
Передайте текст вихідної сторінки вашої справжньої книги ШІ за допомогою шаблону «Dublin Core draft» і отримайте чернетку. Потім створіть ту саму книгу лише з назвою («Слабка підказка») і порівняйте два результати: які поля були виготовлені? Потім за допомогою шаблону «Зіставлення теми з контрольованого словника» надайте короткий список затверджених термінів, щоб отримати відповідність до теми, і перевірте, чи ШІ виходить зі списку.
контрольний список
- [ ] Я надав штучному інтелекту справжню ідентифікаційну інформацію про джерело, я не залишав її вгадувати.
- [ ] Я чітко вказав цільовий стандарт метаданих (MARC/Dublin Core).
- [ ] Я перевірив рік публікації та ISBN дослівно з першоджерелом.
- [ ] Я відобразив терміни теми з контрольованого словника.
- [ ] Форми повноважень я підтвердив затвердженим записом.