નફો:
- કૃત્રિમ બુદ્ધિમત્તા ઇતિહાસ અને આર્કાઇવ કાર્ય (ટ્રાન્સક્રિપ્શન, એડિટિંગ, સ્કેનિંગ, ડ્રાફ્ટ)માં ક્યાં સમય બચાવે છે અને ક્યાં અર્થઘટન, સ્ત્રોતની ટીકા અને અંતિમ નિર્ણય જોખમના સ્તરના આધારે નિષ્ણાત પર છોડી દેવામાં આવે છે તે પારખવામાં સક્ષમ હોવું.
- દરેક આઉટપુટને સ્ત્રોત સાથે જોડીને, તેને ક્રોસ-કન્ફર્મ કરીને અને એનેક્રોનિઝમ માટે ફિલ્ટર કરીને આભાસ સામે ચકાસણી શિસ્ત લાગુ કરવાની ક્ષમતા.
- ગોપનીયતા, કોપીરાઈટ અને સાંસ્કૃતિક સંવેદનશીલતાને શરૂઆતથી જ ઈતિહાસ અને આર્કાઈવ સામગ્રીમાં શા માટે ધ્યાનમાં લેવી જોઈએ તે સમજવા માટે.
જ્યારે કોઈ ઈતિહાસકાર અથવા આર્કાઇવિસ્ટ તેના ડેસ્ક પર બેસે છે, ત્યારે તેની સામે ઘણીવાર એક વિશાળ ઢગલો હોય છે: પીળી નોટબુક, માઇક્રોફિલ્મવાળા અખબારો, હજારો ડિજિટલ ફોટોગ્રાફ્સ, હાથથી લખેલા પત્રો, સત્તાવાર પત્રવ્યવહાર, જમીનના રેકોર્ડ્સ. આ થાંભલાને વાંચવું, ગોઠવવું, વ્યાખ્યાયિત કરવું અને સમજવું એ વર્ષોનો શ્રમ છે. આર્ટિફિશિયલ ઇન્ટેલિજન્સ (ટૂંકમાં AI; કોમ્પ્યુટર સિસ્ટમ્સ કે જે પેટર્ન શીખે છે, ટેક્સ્ટ અને છબીઓના મોટા સમૂહમાંથી ટેક્સ્ટ જનરેટ કરે છે અને વર્ગીકૃત કરે છે) આ શ્રમના યાંત્રિક અને પુનરાવર્તિત ભાગને નાટ્યાત્મક રીતે ઝડપી કરી શકે છે. પરંતુ ચોક્કસ રીતે ઇતિહાસ અને આર્કાઇવિંગ જેવા ક્ષેત્રમાં, જે પુરાવા, સ્ત્રોતો અને સચોટતા પર આધાર રાખે છે, તમારે શરૂઆતથી જાણવું પડશે કે AI ક્યાં મદદરૂપ છે અને ક્યાં જોખમી છે.
આ એકમ સમગ્ર મોડ્યુલનું હોકાયંત્ર છે. અહીં, અમે ચર્ચા કરીશું કે AI ઇતિહાસ અને આર્કાઇવ કાર્યમાં ક્યાં સમય બચાવે છે, જ્યાં માનવ નિષ્ણાતનો નિર્ણય અનિવાર્ય છે, શા માટે દરેક આઉટપુટ ચકાસવું આવશ્યક છે, અને આ ક્ષેત્રની ચોક્કસ નૈતિક સીમાઓ.
AI ને યોગ્ય રીતે સ્થાન આપવું: સહાયક, નિર્ણય લેનાર નહીં
સૌથી મૂળભૂત નિયમ આ છે: AI એ સહાયક છે, ઇતિહાસકાર અથવા આર્કાઇવિસ્ટ નથી. AI; તે એક ઝડપી સહાયક છે જે દસ્તાવેજને ટ્રાંસ્ક્રાઇબ કરે છે, સંગ્રહનો સારાંશ આપે છે, ટેક્સ્ટનો અનુવાદ કરે છે, સંગ્રહ માટે મેટાડેટા સૂચવે છે અને પેટર્નને ફ્લેગ કરે છે. પરંતુ નિર્ણયો કે જેમાં ચુકાદો, અર્થઘટન અને જવાબદારીની જરૂર હોય, જેમ કે "શું આ દસ્તાવેજ વાસ્તવિક છે", "આ ઘટનાનો અર્થ શું છે", "શું આ સ્ત્રોત વિશ્વસનીય છે", "આ સંગ્રહ કેવી રીતે ગોઠવવો જોઈએ" તે નિષ્ણાતના છે.
ચાલો કોષ્ટક સાથે આ તફાવતને સ્પષ્ટ કરીએ:
વ્યવસાય પ્રકાર
શું AI શક્તિશાળી છે?
જવાબદારી કોની?
પ્રિન્ટેડ ટેક્સ્ટને મશીન ટેક્સ્ટમાં રૂપાંતરિત કરવું (OCR)
હા, ખૂબ જ ઝડપી
મનુષ્ય સાચો છે
હસ્તપ્રત ટ્રાન્સક્રિપ્શન ડ્રાફ્ટ
આંશિક રીતે, ભૂલનું માર્જિન ઊંચું છે
લોકો ચોક્કસપણે તેને ઠીક કરશે
હજારો દસ્તાવેજોનો સારાંશ/સ્કેન કરો
હા
માનવ સ્ત્રોત પર આવે છે
મેટાડેટા (તારીખ, સ્થાન, વિષય) રૂપરેખા
હા
માનવ મંજૂરી આપે છે
દસ્તાવેજની અધિકૃતતા પર નિર્ણય લેવો
ના
માત્ર નિષ્ણાત
ઐતિહાસિક અર્થઘટન અને કારણ અને અસરની સ્થાપના
ના
માત્ર ઇતિહાસકાર
સ્ત્રોતની વિશ્વસનીયતાનું મૂલ્યાંકન કરો
ના
માત્ર નિષ્ણાત
આ ચિત્રને એક વાક્યમાં સારાંશ આપવા માટે: AI ડેટા તૈયાર કરે છે, નિષ્ણાત સમજણ આપે છે અને નિર્ણય લે છે.
શા માટે ચકાસણી આવશ્યક છે: આભાસ અને અનાક્રોનિઝમ
માનવતા અને સામાજિક વિજ્ઞાનમાં AI નો ઉપયોગ કરવાનો સૌથી મોટો ભય આભાસ છે. ભ્રમણા ત્યારે થાય છે જ્યારે AI વિશ્વાસપૂર્વક માહિતી, સ્ત્રોત અથવા ક્વોટ કે જે વાસ્તવમાં અસ્તિત્વમાં નથી. "મને ખબર નથી" કહેવાને બદલે, AI વિશ્વાસપાત્ર લાગે તેવા બનાવેલા જવાબ સાથે ખાલી જગ્યા ભરવાનું વલણ ધરાવે છે. ઇતિહાસમાં, આ જીવલેણ છે: અસ્તિત્વમાં નથી તેવા દસ્તાવેજનો સંદર્ભ, બનાવટી ઇતિહાસ, વાસ્તવમાં ન બોલાયેલો શબ્દ, એક ઘટના જે બની નથી.
બીજો મોટો ખતરો એ અનાક્રોનિઝમ છે. એનાક્રોનિઝમ એ એક સમયગાળાના તત્વ (એક શબ્દ, સંસ્થા, તકનીક, ખ્યાલ) બીજા સમયગાળામાં ખોટી જગ્યાએ મૂકવું છે. AI આજની ભાષા અને વિભાવનાઓ સાથે પ્રશિક્ષિત હોવાથી, તે આજના લેન્સ દ્વારા ભૂતકાળને સમજાવવા અને અસ્તિત્વમાં ન હોય તેવી સંસ્થાઓ અથવા શરતોને ભૂતકાળમાં સ્થાનાંતરિત કરવાની સંભાવના છે. ઉદાહરણ તરીકે, 16મી સદીના દસ્તાવેજનો સારાંશ આપતી વખતે, તે એવા શીર્ષક અથવા વહીવટી એકમનો ઉપયોગ કરી શકે છે જે તે સમયે અસ્તિત્વમાં ન હતા.
સાવધાન: દરેક તારીખ, નામ, નંબર, ક્વોટ અને સ્ત્રોત કે જે AI ઉત્પન્ન કરે છે તે દાવો છે, હકીકત નથી, જ્યાં સુધી તમે સ્વતંત્ર રીતે તેની ચકાસણી ન કરો. "એઆઈએ આમ કહ્યું" ઇતિહાસલેખનમાં સ્ત્રોત નથી; તે માત્ર એક ચાવી છે જે તમને વાસ્તવિક સ્ત્રોત તરફ દોરી જાય છે.
ચકાસણી શિસ્ત: ત્રણ પગલાં
ચાલો એક માન્યતા આદત સૂચવીએ જે આપણે આ મોડ્યુલ દરમિયાન પુનરાવર્તન કરીશું:
1. સ્ત્રોત સાથે કનેક્ટ કરો. AI ના દરેક મોટા દાવાને મૂળ દસ્તાવેજ, આર્કાઇવલ સંદર્ભ અથવા વિશ્વસનીય પ્રકાશન પર આધારીત કરો. એવા દાવાનો ઉપયોગ કરશો નહીં કે જેનો કોઈ સ્ત્રોત નથી.
2. ક્રોસ-કન્ફર્મ. નિર્ણાયક હકીકત (તારીખ, નામ, ઘટના) માટે, ઓછામાં ઓછા બે સ્વતંત્ર સ્ત્રોતોનો સંપર્ક કરો. શું AI નો સારાંશ વાસ્તવિક દસ્તાવેજ જે કહે છે તે જ છે?
3. એનાક્રોનિઝમ અને સુસંગતતા દ્વારા ફિલ્ટર કરો. શું એવો કોઈ શબ્દ છે જે સમયગાળાને બંધબેસતો નથી, એક અશક્ય તારીખ, આઉટપુટમાં અસંગત નામ છે? પૂછો "શું તે આ સમયગાળાને અનુકૂળ છે?" નિષ્ણાતના દૃષ્ટિકોણથી.
ત્રણ નાના કેસો
કેસ 1 — ફેબ્રિકેટેડ આર્કાઇવ સંદર્ભ. એક સ્નાતક વિદ્યાર્થીએ AI ને વિષય પર "આર્કાઇવલ સ્ત્રોતો" માટે પૂછ્યું. YZ એ 6 આર્કાઇવ રેફરન્સ પરત કર્યા જેનું ફોર્મેટ પરફેક્ટ જણાતું હતું: ફંડનું નામ, ફાઇલ નંબર, તારીખ. જ્યારે વિદ્યાર્થીએ આર્કાઇવ કેટલોગ શોધ્યો, ત્યારે તેને જાણવા મળ્યું કે 6 માંથી 4 સંદર્ભો બિલકુલ અસ્તિત્વમાં નથી. બાકીના 2 ખોટા નંબરો હતા. પાઠ: સૂચિમાં ચકાસણી વિના AI દ્વારા જનરેટ કરાયેલ કોઈપણ સંદર્ભનો ઉપયોગ કરી શકાતો નથી.
કેસ 2 — OCR 40 કલાક ઘટાડીને 6 કલાક કરે છે. મ્યુનિસિપલ આર્કાઇવમાં 1950 અને 1970 ની વચ્ચે પ્રિન્ટેડ કાઉન્સિલ મિનિટના 3,200 પૃષ્ઠોનું ડિજિટાઇઝેશન કરવામાં આવ્યું છે. મેન્યુઅલ રિરાઇટ 40 કામકાજના દિવસોમાં અંદાજવામાં આવ્યો હતો. OCR સાથે, કાચું લખાણ મિનિટોમાં બહાર આવ્યું; સ્ટાફ મેમ્બરે 6 કામકાજના દિવસોમાં ટેક્સ્ટને સુધારી અને ચકાસ્યો. AI એ યાંત્રિક કાર્યમાં 85% ઘટાડો કર્યો, પરંતુ અંતિમ વાંચન અને સંપાદન માનવ પાસે જ રહ્યું.
કેસ 3 — એનાક્રોનિસ્ટિક સારાંશ. એક આર્કાઇવિસ્ટ પાસે 18મી સદીના પાયાના રેકોર્ડનો સારાંશ YZ હતો. સારાંશ અસ્ખલિત હતો, પરંતુ તેમાં આધુનિક વહીવટી શબ્દનો ઉપયોગ કરવામાં આવ્યો હતો જે દસ્તાવેજમાં દેખાતો નથી અને તે સમયગાળા સાથે સંબંધિત નથી. જો આર્કાઇવિસ્ટ મૂળ દસ્તાવેજ પર ન ગયો હોત, તો આ અનાક્રોનિઝમ કેટલોગ રેકોર્ડમાં રેકોર્ડ કરવામાં આવ્યું હોત. પાઠ: અમૂર્ત હંમેશા મુખ્ય દસ્તાવેજ સાથે સરખાવવામાં આવે છે.
ચાર નકલ કરી શકાય તેવા નમૂનાઓ
1) ઓપનિંગ જે ભૂમિકાઓ અને સીમાઓ નક્કી કરે છે:
તમારી ભૂમિકા: ઇતિહાસ અને આર્કાઇવ્સમાં કામ કરતી સહાયક. તમારા કાર્યોમાં ટેક્સ્ટનું સંપાદન કરવું, રૂપરેખા તૈયાર કરવી અને પેટર્નને ચિહ્નિત કરવી શામેલ છે. કડક નિયમો: (1) મેં તમને આપેલા ટેક્સ્ટ પર જ આધાર રાખો, તમારી પોતાની "મેમરી" માંથી હકીકતો, તારીખો અથવા સ્ત્રોતો ઉમેરશો નહીં. (2) જો તમને ખાતરી ન હોય, તો "અનિશ્ચિત" લખો, તેને બનાવશો નહીં. (3) કોઈ એવો દાવો ન કરો કે જેનો કોઈ સ્ત્રોત ન હોય. જો તમે સમજો છો તો ખાતરી કરો, પછી હું લખાણ આપીશ.
2) આભાસ વિરોધી સૂચના:
નીચેના ટેક્સ્ટનો સારાંશ આપો. નિયમો: લખાણમાં સ્પષ્ટ રીતે ઉલ્લેખિત ન હોય તેવા કોઈપણ નામ, તારીખો, સ્થાનો અથવા નંબરો ઉમેરશો નહીં. ટેક્સ્ટમાં ન હોય તેવી "કદાચ" માહિતી પણ ઉમેરશો નહીં. જો કોઈ માહિતી ટેક્સ્ટમાં શામેલ નથી, તો "ટેક્સ્ટમાં ઉલ્લેખિત નથી" લખો. ટેક્સ્ટ: [અહીં]
3) એનાક્રોનિઝમ તપાસ:
નીચે [ટર્મ] પેપરના ડ્રાફ્ટ સારાંશની સમીક્ષા કરો. ધ્વજની શરતો, સંસ્થાઓ, શીર્ષકો અને વિભાવનાઓ જે આ સમયગાળા સાથે સંબંધિત ન હોઈ શકે. દરેક માટે, સંક્ષિપ્તમાં લખો કે તે શા માટે શંકાસ્પદ છે. અંતિમ નિર્ણય ન કરો; ફક્ત એવા મુદ્દાઓની સૂચિ બનાવો કે જે માનવ નિષ્ણાતે તપાસવી જોઈએ. ડ્રાફ્ટ: [અહીં]
4) સ્ત્રોત-દાવા પાર્સર:
નીચેના લખાણમાંના દરેક વાક્યને બે શ્રેણીઓમાં વિભાજીત કરો: (A) સ્ત્રોતમાં સીધી લખાયેલ હકીકત, (B) અર્થઘટન/અનુમાન. દરેક વિધાનને પણ ચિહ્નિત કરો કે જેના સ્ત્રોત અસ્પષ્ટ છે "ચકાસણીની જરૂર છે" તરીકે. ટેક્સ્ટ: [અહીં]
નબળા પ્રોમ્પ્ટ / મજબૂત પ્રોમ્પ્ટ
નબળા:
મને આ ઓટ્ટોમન દસ્તાવેજ વિશે કહો.
આ પ્રોમ્પ્ટ AI ને તેની પોતાની "મેમરી" થી બોલવા માટે આમંત્રિત કરે છે, જેમાં બનાવટી વિગતો અને અનાક્રોનિઝમ ઉમેરવામાં આવે છે.
મજબૂત:
તમારી ભૂમિકા ઇતિહાસ સહાયક છે. ફક્ત દસ્તાવેજના આધારે મેં નીચે ટ્રાન્સક્રિપ્ટ પેસ્ટ કરી છે: (1) દસ્તાવેજમાં ઉલ્લેખિત લોકો, સ્થાનો અને તારીખોની સૂચિ બનાવો, (2) દસ્તાવેજના પ્રકારનું અનુમાન કરો પરંતુ તમે "મને ખાતરી નથી" કહી શકો છો, (3) ટેક્સ્ટમાં ન હોય તેવી કોઈપણ માહિતી ઉમેરો, (4) [?] સાથે શંકાસ્પદ/વાંચી ન શકાય તેવા વિસ્તારોને ચિહ્નિત કરો. દસ્તાવેજ: [અહીં]
તફાવત સ્પષ્ટ છે: ભૂમિકા, એક સ્ત્રોત પર નિર્ભરતા, બનાવટ પર પ્રતિબંધ, ધ્વજ અસ્પષ્ટતાની પરવાનગી અને સ્પષ્ટ આઉટપુટ માળખું આઉટપુટને વિશ્વસનીય બનાવે છે.
નૈતિકતા, ગોપનીયતા અને સાંસ્કૃતિક સંવેદનશીલતા
ઇતિહાસ અને આર્કાઇવ સામગ્રી લખાણનો નિર્દોષ ઢગલો નથી. તેમાં લોકોનો અંગત ડેટા (સિવિલ રેકોર્ડ્સ, હેલ્થ ફાઈલો, કોર્ટના દસ્તાવેજો), સંવેદનશીલ સમુદાયની યાદો, કોપીરાઈટ કરેલા કાર્યો અને સાંસ્કૃતિક રીતે સંવેદનશીલ સામગ્રી હોઈ શકે છે. થોડા સિદ્ધાંતો:
- ગોપનીયતા: સાર્વજનિક AI સાધનોમાં જીવંત વ્યક્તિઓને ઓળખી શકાય તેવા (વ્યક્તિગત ડેટા) બનાવે તેવા સંવેદનશીલ દસ્તાવેજો અપલોડ કરવા એ કાનૂની અને નૈતિક ઉલ્લંઘન બંને હોઈ શકે છે. તમારી સંસ્થાની ડેટા નીતિ અને સંબંધિત કાયદાનું અવલોકન કરો.
- કૉપિરાઇટ: તમે ડિજિટાઇઝ કરો છો તે દરેક દસ્તાવેજ સાર્વજનિક ડોમેનમાં હોઈ શકે નહીં. AI ને આપતા પહેલા અધિકારોનો વિચાર કરો.
- સાંસ્કૃતિક સંવેદનશીલતા: કેટલાક સમુદાયો કહે છે કે તેમની ઐતિહાસિક સામગ્રીનો ઉપયોગ કેવી રીતે થાય છે. AI ની "કાર્યક્ષમ" દરખાસ્ત સમુદાયની સંવેદનશીલતાને અવગણી શકે નહીં.
- પારદર્શિતા: રેકોર્ડ કરો કે AI-જનરેટેડ ટ્રાંસ્ક્રિપ્શન અથવા મેટાડેટા AI ની મદદથી બનાવવામાં આવી હતી. આ જરૂરી છે જેથી અનુગામી સંશોધકો ચકાસી શકે.
ટીપ: ક્લાઉડ-આધારિત AI ટૂલ પર દસ્તાવેજ અપલોડ કરતા પહેલા, એક પ્રશ્ન પૂછો: "જો આ દસ્તાવેજની સામગ્રી ઇન્ટરનેટ પર દેખાય તો કોને નુકસાન થશે?" જો જવાબ "કોઈ નહિ" હોય, તો પહેલા કોર્પોરેટ મંજૂરી અને સલામત સાધનો શોધો.
સામાન્ય ભૂલો
- ઇતિહાસકાર માટે AI ભૂલ કરવી. AI અર્થઘટન અથવા નિર્ણય કરતું નથી; તેઓ તૈયાર છે. અર્થ અને જવાબદારી તમારી સાથે રહે છે.
- આઉટપુટને માન્ય કર્યા વિના તેનો ઉપયોગ કરવો. દરેક તારીખ, નામ, અવતરણ અને સંદર્ભ દાવો છે; જ્યાં સુધી સ્ત્રોત દ્વારા તેની પુષ્ટિ ન થાય ત્યાં સુધી તે હકીકત નથી.
- બનાવટી સ્ત્રોતો પર આધાર રાખવો. AI વિશ્વસનીય પરંતુ અસ્તિત્વમાં નથી તેવા સંદર્ભો ઉત્પન્ન કરી શકે છે; કેટલોગમાં શોધો.
- અનાક્રોનિઝમની અવગણના. પિરિયડ પરિપ્રેક્ષ્ય સાથે આજની ભાષામાં ભૂતકાળનું વર્ણન કરતા આઉટપુટને ફિલ્ટર કરો.
- સંવેદનશીલ દસ્તાવેજો આડેધડ અપલોડ કરી રહ્યા છે. શરૂઆતથી વ્યક્તિગત ડેટા, કૉપિરાઇટ અને સાંસ્કૃતિક સંવેદનશીલતાને ધ્યાનમાં લો.
સારાંશમાં
ઇતિહાસ અને આર્કાઇવિંગમાં, AI એ એક શક્તિશાળી સહાયક છે જે યાંત્રિક અને પુનરાવર્તિત કાર્ય (ટ્રાન્સક્રાઇબિંગ, એડિટિંગ, સ્કેનિંગ, ડ્રાફ્ટિંગ મેટાડેટા) ને ખૂબ જ ઝડપી બનાવે છે. પરંતુ તે પુરાવાના આ ક્ષેત્રમાં ચોક્કસપણે છે કે ભ્રામકતા અને અનાક્રોનિઝમ વાસ્તવિક જોખમો છે. દરેક આઉટપુટને સ્ત્રોત, ક્રોસ-વેલિડેટ, પિરિયડ-ફિલ્ટર સાથે લિંક કરો; અર્થઘટન, નિર્ણય અને અંતિમ જવાબદારી હંમેશા તમારી પાસે રાખો. પહેલા દિવસથી ગોપનીયતા, કૉપિરાઇટ અને સાંસ્કૃતિક સંવેદનશીલતાનું અવલોકન કરો. આ શિસ્ત સાથે, AI એક સાધન બની જાય છે જે ઐતિહાસિક સંશોધનને વેગ આપે છે, તેને ધીમું કરતું નથી.
એપ્લિકેશન કાર્ય
તમારી પાસે એક ઐતિહાસિક દસ્તાવેજ પસંદ કરો, કાં તો પ્રિન્ટ અથવા ડિજિટલ. "ઓપનિંગ સેટિંગ રોલ અને બાઉન્ડ્રી" ટેમ્પલેટ સાથે AI ને પ્રથમ સ્થાન આપો. પછી દસ્તાવેજનો સારાંશ આપતી વખતે "આભાસ વિરોધી સૂચના" નો ઉપયોગ કરો. આઉટપુટને "સ્રોત-દાવા પાર્સર" સાથે ટેગ કરો અને વાસ્તવિક દસ્તાવેજ સાથે "ચકાસાયેલ હોવું આવશ્યક છે" ચિહ્નિત દરેક નિવેદનની તુલના કરો. નોંધ કરો કે એઆઈ દ્વારા કેટલા પોઈન્ટ ઉમેરવામાં આવ્યા છે અથવા વિકૃત કરવામાં આવ્યા છે.
ચેકલિસ્ટ
- [ ] મેં AI ને સહાયક તરીકે સ્થાન આપ્યું છે, નિર્ણય નિર્માતા તરીકે નહીં.
- [ ] હું ઇચ્છું છું કે તે મેં આપેલા સ્ત્રોત પર આધારિત હોય.
- [ ] મેં દરેક તારીખ, નામ અને સંદર્ભની સ્વતંત્ર રીતે ચકાસણી કરી છે.
- [ ] મેં એનાક્રોનિઝમ માટે આઉટપુટ ફિલ્ટર કર્યું છે.
- [ ] મેં સંવેદનશીલ દસ્તાવેજોમાં ગોપનીયતા, કોપીરાઈટ અને સાંસ્કૃતિક સંવેદનશીલતાનું અવલોકન કર્યું છે.