יחידה 1 / 11

מבוא לבינה מלאכותית בספרנות וניהול מידע: תפקידים, גבולות, אימות, פרטיות ואתיקה

רווחים:

  • היכולת להבחין היכן בינה מלאכותית חוסכת זמן בזרימת העבודה של הספרנות (מטא נתונים, סיכום, חיפוש, הצעות) והיכן החלטות הדיוק, מהימנות המקור והפרטיות נותרות לבני אדם, בהתאם לרמת הסיכון.
  • יכולת ליישם דיסציפלינה המאמתת כל פלט על ידי קישורו למקור, אישורו במקור עצמאי והעברתו דרך מסנן הטיה.
  • הבנה מדוע הזיות, מקורות מפוברקים ופרטיות המשתמש הם סיכונים שיש לקחת בחשבון במקצוע זה כבר מההתחלה.

כשמומחה לקטלוג מתיישב ליד שולחנו בבוקר, ייתכן שיש לו עשרות ספרים שזה עתה הגיעו, מאות מסמכים מאוסף תרומות ותיבת ארכיון הממתינה לדיגיטציה. ספרן עיון (המומחה שעוזר למשתמשים למצוא מידע) עונה על שאלות לאורך היום כמו "איפה המקור האמין בנושא זה?" מנהל מידע אחראי לשמור על גילוי ואמינות של אלפי המסמכים של הארגון. ביחידה זו נבהיר היכן בדיוק בינה מלאכותית (בקיצור AI; דגמי שפה גדולים וכלים דומים) חוסכת זמן במשימות הללו, והיכן שיקול הדעת, הבחירה והאחריות נשארים אצל האדם.

נתחיל בהגדרה: בינה מלאכותית, שבאמצעותה אנו מתכוונים לכלי תוכנה ליצירת שפה ולזיהוי תבניות המאומנים על כמויות גדולות של טקסט. כלים אלה מסכמים, מתרגמים, מציעים סיווג, יוצרים טיוטה של ​​טקסט ודפוסי דגל בנתחים גדולים של נתונים. אבל הוא לא יודע אם מקור באמת קיים, אם מידע נכון, או אם פרטיות המשתמש מוגנת. זו הסיבה שבספריות וניהול מידע, AI הוא עוזר, לא מקבל החלטות.

איפה בינה מלאכותית עובדת ואיפה היא לא עובדת?

בואו נחלק את זרימת העבודה של הספרנות לשלוש שכבות. השכבה הראשונה היא משימות מכניות וחוזרות על עצמן: חילוץ טיוטה של ​​מטא-נתונים מקו הביליין של ספר, סיכום דוח ארוך, תרגום טקסט משפה אחת לאחרת, ניקוי טבלת נתונים. AI חזק כאן וחוסך זמן רב.

הרובד השני הוא עבודה מעין שיפוטית: איזו כותרת נושא לתת למסמך, האם לכלול משאב באוסף, על איזה משאב להמליץ ​​למשתמש. AI מייצרת כאן הצעות, אבל למומחה שמכיר את מדיניות המוסד ואת הצרכים האמיתיים של המשתמש יש את המילה האחרונה.

הרובד השלישי הוא שיקול דעת טהור ואחריות: אישור שהמידע מדויק, החלטה על זכויות יוצרים, האם לחשוף נתונים אישיים רגישים, אישור מהימנות המקור. בשכבה זו, הפלט של ה-AI הוא רק נקודת התחלה; האחריות היא כולה על בני האדם.

טיפ: לפני מתן משימה ל-AI, שאל את עצמך: "מה קורה אם הפלט הזה שגוי?" אם התשובה היא "אני אבזבז קצת זמן", אל תהסס להשתמש בבינה מלאכותית. אם התשובה היא "מופץ מקור שקרי, משתמש הוטעה או נתונים אישיים דלפים", הקפד לאמת את הפלט.

הזיה: הסכנה הגדולה ביותר של הספרנית

הזיה היא כאשר AI מייצר מידע לא קיים, מקור או ציטוט כאילו הוא אמיתי, ובשפה משכנעת ביותר. זה מסוכן במיוחד עבור ספריות וניהול מידע; כי מהות המקצוע שלנו היא האותנטיות והאמינות של המקור.

כאשר אתה אומר ל-AI "להציע חמש מאמרים אקדמיים בנושא זה", הוא יכול ליצור כותרות, מחברים ושמות של כתבי עת שנראים אמיתיים אך אינם קיימים כלל. מקורות מפוברקים אלה כל כך משכנעים שפטרון או אפילו ספרן יכולים להוסיף אותם לביבליוגרפיה מבלי לאמת אותם. במדעי הרוח והחברה, הסכנה גדולה עוד יותר: כאשר "המסמך ההוא מ-1897" מפוברק עבור היסטוריון או "ההחלטה ההיא של בית המשפט" עבור משפטן, התוצאה היא מידע מוטעה חמור.

שימו לב: אין להעביר ציטוט מקור, ציטוט או הפניה שהופקו על ידי AI לשום מקום ללא אימות בקטלוג אמיתי, במסד נתונים או במקור עצמו. זה שזה "נראה משכנע" לא אומר שזה נכון.

משמעת אימות: שלושה שלבים

הדיסציפלינה הבסיסית שעל הספרן ליישם בעת עבודה עם AI היא זו:

1. התחבר למקור. כל עובדה, נתון, תאריך והטבעה חייבים להיות מבוססים על מקור מקורי. שאל את ה-AI "תגיד לי מאיזה מקור קיבלת את המידע הזה" ובדוק את המקור הזה באופן עצמאי.

2. אשר באופן עצמאי. אמת מידע קריטי במקור אמין אחד לפחות מחוץ ל-AI (קטלוג אותנטי, מסד נתונים רשמי, מסמך ראשי).

3. העבירו אותו דרך מסנן ההטיה. בינה מלאכותית נושאת את ההטיות של הנתונים עליהם הוא מאומן. נושא מוצע, רשימת הצעות או תקציר עשויים להדגיש נקודות מבט מסוימות ולטשטש אחרות. שאלו את מי שנשאר בחוץ, איזו פרספקטיבה חסרה.

פרטיות ופרטיות המשתמש

אחד העקרונות האתיים הבסיסיים ביותר של מקצוע הספרנות הוא פרטיות המשתמש: מה שאדם קורא, מה הוא מחפש ובאיזה נושא הוא מתעניין הם חסויים. הזנת נתונים לכלי AI, במיוחד כלים ציבוריים הפועלים דרך האינטרנט, הכוללים את זהויות המשתמשים, היסטוריית החיפושים או משאבים שאולים עלולה להפר את העיקרון הזה; מכיוון שהנתונים האלה עשויים לעבור למערכות של צד שלישי.

כמו כן, בארגון, אין להעלות מסמכים לא מסווגים אך רגישים (מידע על כוח אדם, חוזים, התכתבויות פנימיות) לכלי AI כללי. כלים הפועלים על מערכת מאובטחת וסגורה של המוסד מועדפים עבור סוג זה של נתונים.

טיפ: לפני הזנת נתונים ל-AI, שאל "האם המידע הזה ציבורי?" לִשְׁאוֹל. אם התשובה היא לא, או שאתה לא בטוח, שים את הנתונים האלה בפורמט אנונימי ללא התאמה אישית או השתמש רק בכלים מאובטחים שאושרו על ידי המוסד.

שלושה מיני תיקים

מקרה 1 - טיוטה של מטא נתונים עבור 400 מסמכים. ספריית אוניברסיטה הייתה צריכה לקטלג ארכיון של 400 מסמכים שנתרם על ידי פרופסור. המומחה שלף טיוטת כותרת, תאריך והצעה לנושא מהעמוד הראשון של כל מסמך עם AI: הזמן הממוצע למסמך ירד מ-12 דקות ל-4 דקות. אבל כל טיוטת טביעה הושוותה למסמך המקורי ואושרה על ידי המומחה; בשלב זה נתפסו 17 תאריכים שגויים שהומצאו על ידי ה-AI.

מקרה 2 - נתפס מקור מזויף. ספרנית מייעצת קיבלה 6 הצעות למאמרים מ-YZ תוך כדי חיפוש אחר משאבים בנושא "נדידת אקלים" עבור סטודנט לתואר ראשון. הספרנית חיפשה את כולם במאגר המידע של המוסד: 2 מתוך 6 מאמרים לא היו קיימים כלל. שלב האימות מנע מהתלמיד לקבל מקור מפוברק.

מקרה 3 - מניעת הפרת סודיות. ספרייה שקלה להשתמש בכלי AI כללי כדי לנתח "איזה משתמש מתעניין באיזה נושא" מתוך רשומות התשלום. מנהל המידע הבין שתהיה זו פגיעה בפרטיות שהנתונים הללו יצאו עם מזהה המשתמש; הנתונים הועברו תחילה אנונימיים ועובדו אך ורק כסטטיסטיקה מצטברת ובלתי מזוהה.

ארבע תבניות הניתנות להעתקה

1) התחל להגדיר תפקידים וגבולות:

תפקידך: עוזר מנוסה בקטלוג וניהול מידע. המשימה שלך: לייצר טיוטה מהמידע במקור שנתתי לך. כללים: (1) השתמש רק במידע שבטקסט שנתתי לך, אל תוסיף מידע משלך. (2) סמן "[חייב להיות מאומת]" היכן שאינך בטוח. (3) אין להמציא תאריכים, שמות או טביעות. אם אתה מבין, תתחיל. מקור: [כאן]

2) שאלת בדיקת אימות:

רשום כל טענה עובדתית (תאריך, שם, מספר, ציטוט מקור) בטקסט למטה. לכל אחד: מאיפה בטקסט השגת את המידע הזה? אם זה לא ברור בטקסט, כתוב "לא בטקסט". טקסט: [כאן]

3) הטיה ובדיקת פרספקטיבה חסרה:

אילו נקודות מבט מדגיש הסיכום/המלצה הבאים ואילו הוא משאיר? אילו קבוצות, אזורים או השקפות עשויות להיות חסרות? רק תסתמך על הטקסט, אל תעלה השערות. טקסט: [כאן]

4) בדיקת פרטיות מראש:

האם הטקסט למטה מכיל נתונים אישיים (שם, מספר תעודת זהות, איש קשר, היסטוריית קריאה/חיפוש) או מידע תאגידי רגיש? אם כן, רשום אותו והצע כיצד ניתן להפוך אותו לאנונימי. טקסט: [כאן]

הנחיה חלשה / הנחיה חזקה

הנחיה חלשה:

מצא לי כמה משאבים בנושא זה.

הנחיה זו מזמינה את הבינה המלאכותית לייצר משאבים מזויפים. אין תפקידים, גבולות, חוקי אימות ומשאבים. AI יכול לייצר תגים אמינים אך לא קיימים.

הנחיה עוצמתית:

תפקידך: עוזר ספרנית עיון. בחרו את אלו הקשורים לנושא "נדידת אקלים" מתוך ערכי הקטלוג שנתתי לכם למטה והסבירו מדוע הם רלוונטיים. אל תוסיף מקורות שאינם ברשימה, אל תמציא מקורות. כאשר אינך בטוח, אמור "אין מקורות מתאימים ברשימה". ערכים בקטלוג: [כאן]

ההבדל ברור: הנחיה חזקה מאלצת את ה-AI לעבוד מהמקור האמיתי הנתון, לא מהזיכרון שלו, ומונעת ייצור.

טבלת שכבות ואחריות

רובד עסקי

משימה לדוגמה

תפקיד של AI

החלטה של אדם

מכני

טיוטת מטא נתונים, סיכום, תרגום

מייצר טיוטות במהירות

אימות, אישור

מעין שיפוטי

כותרת הנושא, הצעת מקור

מציע הצעות

בחירה לפי מדיניות

שיפוט טהור

אימות, החלטה על זכויות יוצרים

מידע ראשוני בלבד

האחריות המלאה היא על האדם

טעויות נפוצות

  • החלפת פלט AI במקור. AI הוא עוזר, לא משאב; כל פלט מאומת.
  • קבלת המקור המפוברק כמשכנע. זה שזה נראה טוב לא אומר שזה נכון.
  • הזנת נתונים אישיים/רגישים לכלי הציבורי. פרטיות המשתמש והסודיות הארגונית מכובדים כבר מההתחלה.
  • התעלמות מדעות קדומות. בינה מלאכותית נושאת את נקודות המבט של הנתונים שעליהם היא מאומנת; תשאל מה חסר.
  • משאירים את השיפוט לבינה מלאכותית. החלטות של דיוק, זכויות יוצרים ופרטיות שייכות לבני אדם.

לסיכום

בינה מלאכותית; זהו עוזר רב עוצמה לסיכום, ניסוח, תרגום וסימון דפוסים בספריות וניהול מידע. זה חוסך הרבה זמן בעבודה מכנית; נותן ייעוץ בנושאים מעין שיפוטיים; אבל אימות הדיוק, מהימנות המקור, פרטיות המשתמש והחלטות אתיות שייכים לבני אדם. הזיה היא הסכנה הגדולה ביותר למקצוע זה: אין שימוש במקורות או ציטוטים ללא אימות. הפעל AI עם כללי תפקיד, גבול וכללי אימות ברורים; אשר כל פלט קריטי עם מקור בלתי תלוי.

משימת יישום

בחר נושא אמיתי מהתחום שלך. בקש מה-AI 5 המלצות על משאבים בנושא זה, ואז חפש בכל אחת מהן בקטלוג או מסד נתונים אמיתיים וציין כמה באמת קיימים. לאחר מכן, עם התבנית "אתחול מגדיר תפקידים וגבולות", תגיד ל-AI לעבוד רק מטקסט שאתה מספק והשווה את הפלט של שתי הגישות. כתבו איזו גישה מונעת התאמה.

רשימת בדיקה

  • [ ] קבעתי באיזה רובד (מכני, חצי שיפוטי, שיפוט טהור) נמצאת המשימה.
  • [ ] "מה קורה אם הפלט הזה שגוי?" שאלתי את השאלה.
  • [ ] אימתתי כל קרדיט וציטוט מול מקור בלתי תלוי.
  • [ ] בדקתי שאין מידע אישי/רגיש בנתונים הנכנסים ל-AI.
  • [ ] שמרתי על ההחלטה הסופית ואחריות לפי שיקול דעתי.