יחידה 10 / 11

אימות מקור, הזיות ואוריינות מידע

רווחים:

  • יכולת ללכוד את ההזיה על ידי אימות קיומו של כל מקור, מעבר למקור הראשי ושלבי אישור צולבים עצמאיים
  • יכולת לשמור על מקוריות ויושרה אקדמית מול ציטוטים ומסמכים מפוברקים במדעי הרוח והחברה
  • יכולת ללמד משתמשים מיומנויות אימות מקור ואוריינות מידע בעידן הבינה המלאכותית

בלב המשימה החברתית של הספרנות עומדת הבטחה אחת: מידע אמין. ספרן מביא את המשתמש לא רק למידע, אלא למידע מאומת, ומלמד אותו כיצד להעריך מידע זה בעצמו. בעידן הבינה המלאכותית, המשימה הזו הפכה גם לקשה יותר וגם חשובה יותר; כי AI יכול לייצר מידע מוטעה בצורה משכנעת ביותר. ביחידה זו נעסוק בזיהוי הזיות, בדיסציפלינה של אימות מקור והוראת אוריינות מידע בעידן הבינה המלאכותית.

בואו נגדיר את המושגים. הזיה היא כאשר AI מייצר מידע, מקורות, ציטוטים או אירועים שאינם קיימים בפועל כאילו הם אמיתיים. אימות מקור הוא האישור שהמידע מבוסס על מקור אמיתי, אמין וראשוני. אוריינות מידע היא היכולת של אדם למצוא מידע, להעריך אותו, לפקפק באמינותו ולהשתמש בו בצורה אתית. יחידה זו מטרתה שהספרן יחזק מיומנויות אלו הן בתרגול שלו והן בהוראת המשתמש.

שלב אחר שלב: משמעת אימות מקור

1. בקש את המקור וודא את קיומו. כאשר ה-AI נותן טענה או ציטוט, "מאיזה מקור זה?" ולבדוק שהמקור אכן קיים בקטלוג עצמאי, מסד נתונים או מסמך ראשי.

2. עבור אל המקור הראשי. צורת המידע האמינה ביותר היא המקור שלו ממקור ראשון. אל תסתפקו בסיכום של AI או בטקסט משני; במידת האפשר, גש למסמך המקורי, לנתונים או לפרסום.

3. אישור צולב. אמת טענה קריטית עם לפחות שני מקורות מהימנים, בלתי תלויים זה בזה. משאב אחד, במיוחד משאב AI, אינו מספיק.

4. להעריך את אמינות המקור. מי כתב את זה, מתי, לאיזו מטרה, על איזו ראיה? האם זה מעודכן? קיומו של מידע אינו הופך אותו לאמת; תשאלו גם את מהות המקור.

5. הביעו חוסר ודאות ביושר. אם לא ניתן לאמת מידע, אמור זאת בבירור. תמיד עדיף לומר "לא מאומת" מאשר להציע ודאות מפוברקת.

טיפ: כאשר אתה מקבל ציטוט או מקור מ-AI, תחילה חפש את הכותרת והמחבר בקטלוג בפועל. משאבים לא קיימים מופיעים מיד כאן. בדיקה זו של 30 שניות מונעת ממקור מפוברק להיכנס לביבליוגרפיה, מטלה או פרסום.

אותנטיות ואימות במדעי הרוח והחברה

מדעי הרוח והחברה פגיעים במיוחד לסיכון להזיות. בתחומים אלה, ראיות מבוססות לרוב על מסמך ספציפי, תאריך, ציטוט או מקור הערה. בינה מלאכותית יכולה לייצר טענות מאוד ספציפיות אך מפוברקות לחלוטין, כמו "ההיסטוריון הזה אמר" או "המסמך הזה מ-1923 אומר". ביצירה של ספרות, היסטוריה או משפט, משמעות הדבר היא שרשרת ראיות כוזבת.

יתרה מכך, מקוריות היא הערך היסודי של תחומים אלה: זה משנה למי באמת שייך טקסט, פרשנות או תרגום. הצגת טקסט שהופק על ידי AI כיצירה מקורית או הסתמכות על "מקור" שהוכן על ידי AI פוגעת ביושרה האקדמית. הספרנית היא מדריך המלמד את המשתמשים הן אימות והן את גבולות המקוריות והגניבה.

זהירות: גם במקרים שבהם ציטוט שנוצר על ידי AI נראה מדויק מילה במילה ומיוחס למחבר אמיתי, ציטוט זה עשוי להיות מפוברק. אמת ציטוט על ידי מציאתו רק בעבודתו האמיתית של המחבר; ההיגיון של "המחבר הזה אולי אמר משהו כזה" אינו מספיק.

שלושה מיני תיקים

מקרה 1 - לתלמיד לימדו אימות. ספרן ראה 5 משאבים מ-AI במטלה של תלמיד. יחד בדקו את זה בקטלוג: 2 מקורות מפוברקים. התלמיד חווה על בשרו את השיעור ש"לא נכון שזה ייראה אמיתי" ושוב רכש את ההרגל לאמת כל מקור.

מקרה 2 - מסמך היסטורי מפוברק. חוקר קיבל "דיווח בעיתון 1919" מ-AI; התאריך, שם העיתון והתוכן היו משכנעים ביותר. הספרן סרק את ארכיון העיתון: לא היו חדשות כאלה באותה תקופה. מקור ראשוני מפוברק נתפס עוד לפני שהפך אותו למאמר.

מקרה 3 - ציטוט שגוי. AI ייחס ציטוט להוגה מפורסם. הספרן חיפש את המילה הזו ביצירותיו של ההוגה ולא מצא אותה; המילה לא הוזכרה בשום מקום. בדיקה צולבת מנעה הפצת ציטוט שגוי.

שרשרת הפצת המידע השגוי ותפקיד הספרן

מידע שגוי מתחיל לעתים קרובות עם פלט מפוברק יחיד, אבל זה לא נעצר שם. משתמש מכניס משאב מזויף שנוצר בינה מלאכותית למשימה; המשימה הופכת לפרסום; הפרסום מצוטט על ידי אחרים, כך שמקור בדוי מקבל מראה של "אמת" על ידי ציטוט חוזר. אנחנו יכולים לקרוא לייחוס הזה זיהום: מידע כוזב מקבל לגיטימציה בכך שהוא חוזר על עצמו שוב ושוב. הספרנית עומדת בחוליה הקריטית ביותר בשרשרת זו; מכיוון שזוהי נקודת הבקרה האחרונה שבה המידע מאומת לפני הכניסה למערכת. רק בגלל שמקור "מתרחש במקומות רבים" לא הופך אותו לנכון; אותו מידע מזויף יכול להופיע במקומות רבים על ידי העתקה זה מזה. לכן, אישור צולב צריך להתבסס על השאלה "כמה מקורות מהימנים מאשרים זאת ללא תלות זה בזה", ולא "כמה מקומות הוא מופיע?" עשרה מקורות משניים החוזרים על אותה טענה אינם שווים כמו מקור ראשוני עצמאי יחיד. הספרן צריך לשים את ההבחנה הזו (לא לבלבל בין עצמאות לחזרה) במרכז הן של האימות שלו והן בהוראתו למשתמש.

שימו לב: הופעת המידע במנוע חיפוש או בדפי אינטרנט רבים אינה הוכחה לדיוק שלו. ייתכן שאותה טעות הפכה לנפוצה בהעתקה ממקור למקור. שכיחות ודיוק הם דברים שונים; אישור מצריך מקור בלתי תלוי ואמין.

ארבע תבניות הניתנות להעתקה

1) שאילתת ישות משאב:

רשום כל ציטוט מקור וציטוט בטקסט למטה. לכל אחד: מחבר, כותרת, שנה ומידע על פרסום (אם יש). לחלץ פריט אחר פריט את המידע שאני צריך כדי לאמת; אל תוסיף.טקסט: [כאן]

2) הערכת אימות:

עבור כל אחת מהטענות הבאות, בודד את המרכיבים העובדתיים (תאריך, שם, מספר, ציטוט) שיש לאמת. הצע מול איזה סוג מקור (קטלוג, מסמך ראשי, מסד נתונים) ניתן לאמת אותו. אל תשפוט את הדיוק, פשוט הראה את נתיב האימות. קביעות: [כאן]

3) רשימת בדיקה לאמינות ריתוך:

העריכו את אמינותו של המקור הבא: מי כתב אותו, מתי, לאיזו מטרה, יש ראיות, האם היא עדכנית, האם יש הטיה אפשרית? פשוט תסתמך על המידע שנתתי, תכתוב "לא ידוע" איפה הוא חסר. מידע מקור: [כאן]

4) תוכנית הוראת אוריינות מידע:

הפק מדריך קצר של 20 דקות על אימות מקור והזיה בעידן הבינה המלאכותית עבור קבוצת המשתמשים הבאה (למשל סטודנטים לתואר ראשון): יעדים, 3 דוגמאות, אפליקציה אחת. קבוצה: [כאן]

הנחיה חלשה / הנחיה חזקה

הנחיה חלשה:

כתוב תקציר בנושא זה עם מקורות מהימנים.

אמירת "עם מקורות אמינים" מעודדת את הבינה המלאכותית לייצר מקורות מזויפים שנראים אמיתיים; אין וו אימות.

הנחיה עוצמתית:

תפקידך: עוזר אוריינות מידע. כתיבת סיכום על הנושא הבא; במקום זאת, רשום את השאלות העובדתיות שמשתמש צריך לאמת ואת סוג המקור האמין איתו הוא יכול לאמת אותן. אל תמציא כל ציטוטי מקור; סמן את האזור שאינך בטוח בו כ"חייב להיות מאומת". נושא: [כאן]

הנחיה עוצמתית; הוא משתמש בבינה מלאכותית כמדריך שמראה את הדרך לאימות, במקום לייצר תשובות, ומונע ייצור מבנית.

טבלת שכבות אימות

שכבה

שאלה

שיטה

ישות

האם מקור זה אמיתי?

חיפוש בקטלוג/מסד נתונים

ראשוניות

האם זה המקור הכי קרוב?

גישה למסמך המקורי

אישור

האם מקור אחר מאשר זאת?

הצלבה עצמאית

אמינות

כמה מוצק המקור?

מחבר, תאריך, מטרה, ראיה

כנות

האם אני בטוח?

מצב אי ודאות ברור

טעויות נפוצות

  • לחשוב שמה שמשכנע הוא נכון. להיראות טוב זה לא הוכחה לצדק.
  • להיות מרוצה ממקור אחד. מידע קריטי דורש אישור צולב עצמאי.
  • לא מחפש את הציטוט במקור שלו. כך התפשטו מילים שגויות.
  • מסתיר אי ודאות. "לא ניתן לאימות" עדיף על וודאות כוזבת.
  • לא מלמד את המשתמש לבצע אימות. אוריינות מידע היא המשימה של הספרנית.

לסיכום

אימות מקור ואוריינות מידע הם המשימות הקריטיות ביותר של ספרנות בעידן הבינה המלאכותית. הזיה מייצרת מידע משכנע אך מפוברק והיא מסוכנת במיוחד במדעי הרוח/חברה. הדיסציפלינה ברורה: וודאו את קיומו של כל מקור, פנו למקור הראשוני, ערכו הצלבות עצמאיות, פקפקו באמינות המקור והביעו חוסר ודאות ביושר. הספרן מפיץ את תרבות האימות הזו לא רק בתרגול שלו אלא גם על ידי הוראת משתמשים; מקוריות ויושרה אקדמית הם חלק בלתי נפרד ממשימה זו.

משימת יישום

בקש 6 מקורות ו-2 ציטוטים מ-AI בתחום שלך. אמת כל מקור על ידי חיפוש שלו בקטלוג בפועל וכל ציטוט ביצירתו בפועל של המחבר; שימו לב כמה הם בדיות. לאחר מכן, באמצעות התבנית "תוכנית הוראת אוריינות מידע", נסח מדריך של 20 דקות כדי להסביר אימות מקור לקבוצת משתמשים ולכלול דוגמאות אמיתיות שמצאת בעצמך.

רשימת בדיקה

  • [ ] וידאתי באופן עצמאי שכל מקור אכן קיים.
  • [ ] השתמשתי במקורות ראשוניים בכל מקום אפשרי.
  • [ ] הצלבתי טענות ביקורתיות עם לפחות שני מקורות בלתי תלויים.
  • [ ] אימתתי את הציטוטים על ידי חיפוש אחריהם בעבודתו האמיתית של המחבר.
  • [ ] סימנתי בבירור את המידע הבלתי ניתן לאימות כ"לא ניתן לאימות".