युनिट्स
1. इतिहास आणि संग्रहणातील कृत्रिम बुद्धिमत्तेचा परिचय: भूमिका, सीमा, प्रमाणीकरण आणि नीतिशास्त्र 2. दस्तऐवज डिजिटायझेशन आणि ओसीआर: मुद्रित मजकूर मशीन टेक्स्टमध्ये रूपांतरित करणे 3. लिप्यंतरण: ऑट्टोमन तुर्की आणि हस्तलिखिते 4. मेटाडेटा, कॅटलॉगिंग आणि वर्गीकरण 5. स्रोत स्कॅनिंग, शोध आणि सारांश 6. ऐतिहासिक भाषांतर आणि सरलीकरण 7. स्त्रोत पडताळणी, अनाक्रोनिझम आणि भ्रम 8. सामग्री विश्लेषण आणि नमुना शोध 9. संग्रहण प्रवेश, वर्णन आणि वापरकर्ता सेवा 10. संरक्षण, जीर्णोद्धार आणि डिजिटल संरक्षण 11. नैतिकता, कॉपीराइट, गोपनीयता आणि सांस्कृतिक संवेदनशीलता 12. एंड-टू-एंड प्रोजेक्ट: आर्टिफिशियल इंटेलिजन्ससह संग्रहण संग्रहावर प्रक्रिया करणे
युनिट 7 / 12

स्त्रोत पडताळणी, अनाक्रोनिझम आणि भ्रम

नफा:

  • भ्रम (बनावट स्रोत, कोट, घटना) आणि अनाक्रोनिझम या इतिहासातील सर्वात धोकादायक चुका का आहेत हे स्पष्ट करण्याची क्षमता
  • कॅटलॉगमधील प्रत्येक संदर्भ सत्यापित करणे, दस्तऐवजाशी सामग्रीची तुलना करणे आणि गंभीर तथ्ये क्रॉस-पुष्टी करणे ही शिस्त लागू करण्याची क्षमता.
  • वास्तविक स्त्रोताऐवजी कृत्रिम बुद्धिमत्ता कुठे पहायचे हे विचारून स्त्रोतांमधील पक्षपात आणि गहाळ आवाजांवर प्रश्न करण्याची क्षमता

या मॉड्यूलच्या प्रत्येक युनिटमध्ये एक चेतावणी पुनरावृत्ती आहे: AI चे आउटपुट एक दावा आहे, सत्य नाही, जोपर्यंत सत्यापित होत नाही. हे युनिट त्या चेतावणीला शिस्तीत बदलते. इतिहास आणि संग्रहण ही मूळतः पुराव्यावर आधारित फील्ड आहेत; इतिहासकाराचे सर्वात मूलभूत कौशल्य म्हणजे स्त्रोत टीका (कोणाद्वारे, केव्हा, कोणत्या उद्देशाने स्त्रोत तयार केला गेला आणि तो किती विश्वासार्ह आहे असा प्रश्न विचारणे). AI च्या युगात, हे कौशल्य आणखी गंभीर बनले आहे कारण आता स्त्रोत स्वतःच बनवला जाऊ शकतो.

येथे आम्ही तीन धोक्यांचा सखोल विचार करू: भ्रम (एआय तयार करून बनावट माहिती, स्रोत किंवा कोट्स), अनाक्रोनिझम (नियतकालिक घटक चुकीच्या कालावधीत हलवले जात आहेत), आणि सर्वसाधारणपणे स्त्रोत पडताळणीची शिस्त. भूतकाळात चुकीच्या किंवा पक्षपाती असलेल्या स्त्रोतांकडून AI शिकत असल्याचे देखील आम्ही पाहू, त्यामुळे ते पूर्वाग्रह पुनरुत्पादित करू शकते.

भ्रम: सर्वात धोकादायक चूक

भ्रम म्हणजे जेव्हा एआय आत्मविश्वासाने असे काहीतरी सादर करते जे प्रत्यक्षात अस्तित्वात नाही. ऐतिहासिकदृष्ट्या, हे खालील प्रकारांमध्ये सर्वात सामान्यपणे पाहिले जाते:

  • बनावट स्रोत/संदर्भ: अस्तित्वात नसलेला संग्रहण निधी, फाइल क्रमांक, पुस्तक किंवा लेख.
  • मेड-अप कोट: एक शब्द जो प्रत्यक्षात बोलला गेला नाही, एक वाक्य जे दस्तऐवजात नाही.
  • घडलेली घटना/तारीख/व्यक्ती: घडलेली घटना, खोटी तारीख, अस्तित्वात नसलेली व्यक्ती.
  • काल्पनिक कनेक्शन: दोन वास्तविक घटनांमधील एक अस्तित्वात नसलेला कारण-प्रभाव संबंध.

भ्रमनिरास धोकादायक बनवते ते विश्वासार्ह वाटते. तयार केलेल्या संदर्भाचे स्वरूप वास्तविक संदर्भासारखेच असते: निधीचे नाव, संख्या, तारीख. त्यामुळे "स्वरूप योग्य दिसते" याचा अर्थ "योग्य" असा होत नाही.

लक्ष द्या: YZ द्वारे उत्पादित केलेले कोणतेही संसाधन सत्यापित केल्याशिवाय आणि कॅटलॉगमध्ये किंवा विश्वासार्ह ठिकाणी आढळल्याशिवाय वापरले जाऊ शकत नाही. संदर्भ अस्तित्त्वात आहे हे सिद्ध करण्याचा एकमेव मार्ग म्हणजे मूळ स्त्रोत कुठे आहे ते पाहणे (संग्रहण कॅटलॉग, लायब्ररी, प्रकाशन). "एआयने ते दिले" हा पुरावा नाही.

अनाक्रोनिझम: कालावधीचा चष्मा

अनाक्रोनिझम आजच्या चष्म्यातून भूतकाळ पाहत आहे. एआय आजच्या भाषेत प्रशिक्षित असल्यामुळे, त्यात प्रबळ प्रवृत्ती आहे:

  • टर्म ॲनाक्रोनिझम: कालावधीशी संबंधित नसलेला शब्द, संस्था किंवा संकल्पना वापरणे.
  • संकल्पना अनाक्रोनिझम: वर्तमानाची कल्पना (उदा. आधुनिक विचारधारा किंवा ओळख) भूतकाळात प्रक्षेपित करणे.
  • मूल्य अनाक्रोनिझम: फक्त आजच्या मानकांनुसार भूतकाळातील वर्तनाचा न्याय करणे.

भूतकाळ त्याच्या संदर्भात समजून घेणे हे इतिहासकाराचे काम आहे. AI मध्ये या संदर्भ संवेदनशीलतेचा अभाव आहे; आपण ते स्वतः प्रदान केले पाहिजे.

भ्रमनिरास का होतो हे समजून घेतल्याने त्यापासून संरक्षण करणे सोपे होते. AI ही एक प्रणाली आहे जी "पुढील संभाव्य शब्द" तयार करण्यासाठी कार्य करते; यात "सत्य जाणून घेण्यासारखे" हेतू नाही. प्रश्न विचारल्यावर, त्याला उत्तर माहीत आहे की नाही, तो मजकूर तयार करतो जो सांख्यिकीयदृष्ट्या खात्रीलायक वाटेल. अभिलेखीय संदर्भाचे स्वरूप (निधीचे नाव, संख्या, तारीख) एक शिकलेला नमुना आहे; AI हा नमुना प्रत्यक्ष संदर्भाशिवाय भरू शकतो. तर "एआय ते का बनवते?" प्रश्नाचे उत्तर सोपे आहे: "माहित नाही" पेक्षा मेक अप करणे त्याच्यासाठी सोपे आहे. हे साचे वास्तविक संसाधनांनी भरण्याची जबाबदारी तुमच्यावर येते.

स्त्रोत सत्यापन शिस्त: चरण-दर-चरण

1. संसाधनाचे अस्तित्व सत्यापित करा. AI द्वारे कॅटलॉग/प्रकाशनात दिलेला प्रत्येक संदर्भ शोधा. जर तुम्हाला ते सापडत नसेल तर ते वापरू नका.

2. स्त्रोतासह सामग्रीची तुलना करा. एआयने दस्तऐवजाचे श्रेय दिलेली माहिती प्रत्यक्षात दस्तऐवजात अस्तित्वात आहे का? अवतरण नक्की आहे का?

3. क्रॉस-पुष्टी करा. गंभीर वस्तुस्थितीसाठी, किमान दोन स्वतंत्र विश्वसनीय स्रोत पहा.

4. स्त्रोत टीका लागू करा. स्त्रोत स्वतः विश्वसनीय आहे का? त्याची निर्मिती कोणी, केव्हा आणि कोणत्या उद्देशाने केली? ते पक्षपाती आहे का?

5. ॲनाक्रोनिझम फिल्टरमधून पास करा. आउटपुटमध्ये कालावधीत बसत नाहीत अशा काही अटी, संकल्पना किंवा मूल्य निर्णय आहेत का?

6. प्रश्न पूर्वग्रह. AI ऐतिहासिक स्त्रोतांमधील पूर्वाग्रहांचे पुनरुत्पादन करू शकले असते (एका गटाकडे दुर्लक्ष करून, एका दृष्टिकोनाची बाजू घेत)?

प्रमाणीकरण स्तर

प्रश्न

कोण करतो

अस्तित्व

हे संसाधन खरोखर अस्तित्वात आहे का?

आपण कॅटलॉगमध्ये आहात.

सामग्री

हे खरेच कागदपत्रात म्हटले आहे का?

दस्तऐवजात तुम्ही

पुष्टीकरण

इतर कोणताही स्त्रोत त्यास समर्थन देतो का?

तू, क्रॉस

विश्वसनीयता

स्त्रोत विश्वसनीय आहे का?

तज्ञांचा निर्णय

कालावधी

काही anachronisms आहेत?

तज्ञांचा निर्णय

पूर्वग्रह

कोणाचा आवाज गहाळ/विकृत आहे?

तज्ञांचा निर्णय

तीन लहान प्रकरणे

केस 1 - सहा बनावट संदर्भ. एका संशोधकाने एआयला एका विषयावरील स्त्रोतांची यादी विचारली. YZ ने परिपूर्ण स्वरूपनासह 6 संग्रहण संदर्भ प्रदान केले. कॅटलॉग शोधात, 6 पैकी 4 गहाळ होते, त्यापैकी 2 चुकीचे नंबर होते. जर संशोधकाने पडताळणी केली नसती, तर अस्तित्वात नसलेल्या स्त्रोतांचा उल्लेख करणारा अभ्यास समोर आला असता. धडा: प्रत्येक संदर्भ कॅटलॉगमध्ये सत्यापित केला जातो.

केस 2 - मेड-अप कोट. एक लेखक एक धक्कादायक कोट वापरेल ज्याचे श्रेय AI एखाद्या ऐतिहासिक व्यक्तीला देते. जेव्हा त्याने स्त्रोताची चौकशी केली तेव्हा त्याने पाहिले की त्या व्यक्तीने असे काही सांगितले आहे हे सिद्ध करणारे कोणतेही दस्तऐवज नव्हते आणि विधान AI ने "बनवलेले" होते. धडा: प्राथमिक किंवा विश्वासार्ह स्त्रोताकडून पडताळणी केल्याशिवाय कोट वापरले जाऊ शकत नाहीत.

केस 3 - पूर्वग्रहाचे पुनरुत्पादन. एका विद्यार्थ्याने एआयला एखाद्या प्रदेशाचा इतिहास समजावून सांगितला होता. आउटपुटने त्या क्षेत्रातील विशिष्ट समुदायाकडे पूर्णपणे दुर्लक्ष केले कारण एआयने ज्या स्त्रोतांकडून शिकले होते त्यांनी देखील त्यांच्याकडे दुर्लक्ष केले होते. विद्यार्थ्याने हे अंतर लक्षात घेतले आणि क्रॉस-रेफरन्ससह दुरुस्त केले. धडा: AI स्त्रोतांमध्ये शांतता आणि पूर्वाग्रह पुनरुत्पादित करते; कोणाचा आवाज गायब आहे हे विचारले पाहिजे.

चार कॉपी करण्यायोग्य टेम्पलेट्स

1) संदर्भ पडताळणी यादी:

खालील मजकुरातील सर्व स्त्रोत, संदर्भ, कोट, तारीख आणि व्यक्तींची नावे वेगळ्या यादीत दिसतात. प्रत्येकासाठी एक टीप जोडा: "या मजकुरात दावा केला आहे, स्वतंत्रपणे सत्यापित करणे आवश्यक आहे." तुम्ही काहीही न निवडल्यास, "सत्यापित करा"; सत्यापित करण्यासाठी फक्त एक सूची तयार करा जेणेकरून मी ती कॅटलॉग/स्रोत वरून तपासू शकेन. मजकूर: [येथे]

2) ॲनाक्रोनिझम स्कॅनिंग:

खालील [कालावधी] बद्दलचा मजकूर तपासा. या कालावधीशी संबंधित नसलेल्या अटी, संस्था, संकल्पना आणि मूल्ये हायलाइट करा. प्रत्येकासाठी, आपण का संशयास्पद आहात हे थोडक्यात लिहा. अंतिम निर्णय घेणे; तज्ञ तपासतील अशा शंकांची यादी तयार करा. मजकूर: [येथे]

3) स्त्रोत टीका फ्रेमवर्क:

खालील स्त्रोतांबद्दल एक स्रोत टीका मसुदा तयार केला आहे: (1) ते कोणी तयार केले असावे, (2) केव्हा, (3) कोणत्या हेतूसाठी, (4) त्याचे संभाव्य पूर्वाग्रह काय आहेत, (5) कोणत्या मुद्द्यांवर विश्वास ठेवला पाहिजे आणि कोणत्या सावधगिरी बाळगल्या पाहिजेत. अंतिम निर्णय लादणे; प्रश्न आणि संभाव्य उत्तर पर्याय प्रदान करा. स्रोत: [येथे]

४) गहाळ आवाज/बायस नियंत्रण:

खालील ऐतिहासिक सारांशात कोणाचा आवाज आणि कोणत्या गटाचा अनुभव गहाळ किंवा एकतर्फी असू शकतो? कोणता दृष्टीकोन प्रबळ आहे, कोणता अदृश्य आहे? हे प्रश्नांची सूची म्हणून तयार करा; मी ते क्रॉस-रेफरन्सने भरेन. सारांश: [येथे]

कमकुवत प्रॉम्प्ट / मजबूत प्रॉम्प्ट

कमकुवत:

मला या विषयावरील विश्वसनीय ऐतिहासिक स्त्रोत आणि अवतरण द्या.

AI ला "स्रोत" आणि "उद्धरण" विचारले असता फॉर्ममध्ये योग्य परंतु सामग्रीमध्ये बनावट असे संदर्भ तयार करण्यास प्रवण आहे. हा प्रॉम्प्ट म्हणजे भ्रमाला थेट आमंत्रण आहे.

मजबूत:

या विषयावरील माझ्या संशोधनात मी कोणत्या प्रकारचे स्रोत (संग्रहण निधी प्रकार, प्रकाशन प्रकार, संस्था) शोधले पाहिजे ते सुचवा. विशिष्ट संदर्भ, फाइल क्रमांक किंवा कोट फिट करणे; फक्त कुठे बघायचे ते सांग. मग मला कॅटलॉगमधून खरे स्त्रोत सापडतील.

फरक: AI ला "कोठे पहावे" असे विचारले जाते, "वास्तविक संदर्भ" नाही; भ्रमाचा धोका आमूलाग्रपणे कमी केला जातो आणि पडताळणी माणसावर सोडली जाते.

सामान्य चुका

  • योग्य संदर्भावर विसंबून. तयार केलेला संदर्भ देखील निर्दोष दिसतो; कॅटलॉगमध्ये सत्यापित करणे आवश्यक आहे.
  • AI कडून थेट कोट घेणे. प्राथमिक/विश्वसनीय स्त्रोताकडून पुष्टी केल्याशिवाय कोटेशन वापरले जाऊ शकत नाहीत.
  • अनाक्रोनिझमकडे दुर्लक्ष करणे. आजच्या अटी आणि संकल्पना शांतपणे भूतकाळात डोकावतात.
  • पूर्वग्रहाचे पुनरुत्पादन. एआय स्त्रोतांकडून शांतता कॉपी करते; गहाळ आवाज बद्दल विचारणे आवश्यक आहे.
  • एकाच स्रोतावर विसंबून. गंभीर तथ्यांची किमान दोन स्वतंत्र स्त्रोतांद्वारे पुष्टी करणे आवश्यक आहे.

सारांशात

स्त्रोत सत्यापन हे इतिहास आणि संग्रहणाच्या केंद्रस्थानी आहे आणि AI च्या युगात ते अधिक गंभीर आहे. मतिभ्रम स्त्रोत, अवतरण आणि घटना तयार करतात ज्यांचे स्वरूप परिपूर्ण आहे परंतु ज्याची सामग्री काल्पनिक आहे; anachronism आजच्या दृष्टीकोनातून भूतकाळ विकृत करतो; आणि AI स्त्रोतांमध्ये पूर्वाग्रहांचे पुनरुत्पादन करते. संरक्षण ही एक शिस्त आहे: कॅटलॉगमधील प्रत्येक संदर्भ सत्यापित करा, दस्तऐवजाशी सामग्रीची तुलना करा, गंभीर तथ्ये क्रॉस-चेक करा, कालावधी आणि पूर्वाग्रहाद्वारे फिल्टर करा. AI ला "कोठे पहावे" विचारा, "वास्तविक स्त्रोत" नाही. सत्याचा रक्षक नेहमीच तज्ञ असतो.

अर्ज कार्य

AI ला तुम्ही ज्या विषयावर काम करत आहात त्यावरील संसाधनांची यादी तयार करा (जाणूनबुजून "कमकुवत प्रॉम्प्ट" सह). नंतर "संदर्भ प्रमाणीकरण सूची" टेम्पलेटसह या आउटपुटमधून सर्व संदर्भ काढा आणि प्रत्येक एक कॅटलॉगमध्ये शोधा. किती प्रत्यक्षात अस्तित्वात आहेत आणि किती बनलेले किंवा चुकीचे आहेत ते मोजा. "मजबूत प्रॉम्प्ट" ("मी कुठे पहावे") सह समान विषयाची पुनरावृत्ती करा आणि फरक अनुभवा.

चेकलिस्ट

  • [ ] मी प्रत्येक संदर्भ कॅटलॉग/विश्वसनीय स्रोतामध्ये सत्यापित केला आहे.
  • [] मी प्राथमिक/विश्वसनीय स्त्रोतासह प्रत्येक कोट सत्यापित केला आहे.
  • मी किमान दोन स्वतंत्र स्त्रोतांसह गंभीर तथ्ये तपासली आहेत.
  • [ ] मी anachronisms साठी आउटपुट फिल्टर केले.
  • [ ] मी गहाळ/विकृत आवाज आणि पक्षपाती विचार केला.