سود:
- توانایی تشخیص اینکه هوش مصنوعی کجا در تاریخ و کار بایگانی در زمان صرفه جویی می کند (رونویسی، ویرایش، اسکن، پیش نویس) و جایی که تفسیر، انتقاد منبع و تصمیم نهایی بسته به سطح خطر به متخصص واگذار می شود.
- امکان اعمال یک رشته تأیید در برابر توهم با اتصال هر خروجی به منبع، تأیید متقاطع آن و فیلتر کردن آن برای نابهنگاری.
- برای درک اینکه چرا محرمانگی، کپی رایت و حساسیت فرهنگی باید از همان ابتدا در تاریخ و مواد آرشیو در نظر گرفته شود.
وقتی یک مورخ یا آرشیودار پشت میزش می نشیند، اغلب انبوهی عظیم در مقابل او قرار می گیرد: دفترچه های زرد رنگ، روزنامه های میکروفیلم شده، هزاران عکس دیجیتال، نامه های دست نویس، مکاتبات رسمی، اسناد زمین. خواندن، سازماندهی، تعریف و معنا بخشیدن به این توده کاری است که سال ها طول می کشد. هوش مصنوعی (به اختصار AI؛ سیستمهای رایانهای که الگوها را یاد میگیرند، متن را از تودههای بزرگ متن و تصاویر تولید و طبقهبندی میکنند) میتواند به طور چشمگیری سرعت بخش مکانیکی و تکراری این کار را افزایش دهد. اما دقیقاً در زمینه ای مانند تاریخ و بایگانی که بر شواهد، منابع و دقت تکیه دارد، از همان ابتدا باید بدانید که هوش مصنوعی کجا مفید است و کجا خطرناک است.
این واحد قطب نمای کل ماژول است. در اینجا، در مورد جایی که هوش مصنوعی در تاریخ و کار بایگانی در زمان صرفه جویی می کند، جایی که قضاوت یک متخصص انسانی ضروری است، چرا هر خروجی باید تأیید شود و مرزهای اخلاقی خاص این زمینه بحث خواهیم کرد.
قرار دادن درست هوش مصنوعی: دستیار، نه تصمیم گیرنده
اساسی ترین قانون این است: هوش مصنوعی یک دستیار است، نه یک مورخ یا آرشیو. هوش مصنوعی این یک کمک کننده سریع است که یک سند را رونویسی می کند، یک مجموعه را خلاصه می کند، متن را ترجمه می کند، ابرداده را برای یک مجموعه پیشنهاد می کند، و الگوها را پرچم گذاری می کند. اما تصمیماتی که نیاز به قضاوت، تفسیر و مسئولیت دارد، مانند «آیا این سند واقعی است»، «این رویداد به چه معناست»، «آیا این منبع قابل اعتماد است»، «این مجموعه چگونه باید سازماندهی شود» متعلق به کارشناس است.
بیایید این تمایز را با یک جدول روشن کنیم:
نوع کسب و کار
آیا هوش مصنوعی قدرتمند است؟
مسئولیت کیست؟
تبدیل متن چاپ شده به متن ماشینی (OCR)
بله خیلی سریع
انسان درست است
پیش نویس رونویسی نسخه خطی
تا حدی، حاشیه خطا زیاد است
مردم حتما درستش خواهند کرد
هزاران سند را خلاصه/اسکن کنید
بله
انسان به سرچشمه می رسد
طرح کلی ابرداده (تاریخ، مکان، موضوع).
بله
انسان تایید می کند
تصمیم گیری در مورد صحت یک سند
نه
فقط کارشناس
تفسیر تاریخی و ایجاد علت و معلول
نه
فقط مورخ
اعتبار منبع را ارزیابی کنید
نه
فقط کارشناس
این تصویر را در یک جمله خلاصه میکنیم: هوش مصنوعی دادهها را آماده میکند، متخصص معنا مییابد و تصمیم میگیرد.
چرا تأیید ضروری است: توهم و آناکرونیسم
بزرگترین خطر استفاده از هوش مصنوعی در علوم انسانی و اجتماعی توهم است. توهم زمانی است که یک هوش مصنوعی با اطمینان اطلاعات، منبع یا نقل قولی را جعل می کند که در واقع وجود ندارد. هوش مصنوعی به جای گفتن «نمیدانم»، جای خالی را با پاسخی ساختگی پر میکند که باورپذیر به نظر میرسد. در تاریخ، این مرگبار است: اشاره به سندی که وجود ندارد، تاریخ ساختگی، کلمه ای که واقعاً گفته نشده است، رویدادی که اتفاق نیفتاده است.
دومین خطر بزرگ نابهنگامی است. آناکرونیسم عبارت است از قرار دادن نادرست عنصر یک دوره (یک کلمه، نهاد، تکنولوژی، مفهوم) در دوره دیگر. از آنجایی که هوش مصنوعی با زبان و مفاهیم امروزی آموزش دیده است، مستعد توضیح گذشته از طریق لنزهای امروزی و انتقال نهادها یا اصطلاحات ناموجود به گذشته است. به عنوان مثال، هنگام خلاصه کردن یک سند قرن شانزدهم، ممکن است از عنوان یا واحد اداری استفاده کند که در آن زمان وجود نداشت.
احتیاط: هر تاریخ، نام، شماره، نقل قول و منبعی که هوش مصنوعی تولید می کند یک ادعا است، نه یک واقعیت، تا زمانی که به طور مستقل آن را تأیید نکنید. «هوش مصنوعی چنین گفته است» منبعی در تاریخ نگاری نیست. این صرفا یک سرنخ است که شما را به منبع واقعی هدایت می کند.
نظم و انضباط تأیید: سه مرحله
بیایید یک عادت اعتبارسنجی را پیشنهاد کنیم که در طول این ماژول تکرار خواهیم کرد:
1. به منبع متصل شوید. هر ادعای اصلی هوش مصنوعی را بر اساس سند اصلی، مرجع بایگانی یا انتشار قابل اعتماد قرار دهید. از ادعایی که منبع ندارد استفاده نکنید.
2. تایید متقابل. برای یک واقعیت مهم (یک تاریخ، یک نام، یک رویداد)، حداقل به دو منبع مستقل مراجعه کنید. آیا خلاصه هوش مصنوعی همان چیزی است که سند واقعی می گوید؟
3. از طریق نابهنگاری و سازگاری فیلتر کنید. آیا اصطلاحی وجود دارد که با دوره، تاریخ غیرممکن، نام متناقض در خروجی مناسب نباشد؟ بپرسید "آیا برای این دوره مناسب است؟" از دیدگاه کارشناسی
سه کیف کوچک
مورد 1 - مرجع آرشیو ساختگی. یک دانشجوی فارغ التحصیل از هوش مصنوعی «منابع آرشیوی» در مورد موضوعی را درخواست کرد. YZ 6 مرجع بایگانی را که قالب آنها عالی به نظر می رسید برگرداند: نام صندوق، شماره پرونده، تاریخ. وقتی دانش آموز کاتالوگ آرشیو را جست و جو کرد، متوجه شد که از هر 6 مرجع، 4 مرجع اصلا وجود ندارد. 2 باقیمانده اعداد اشتباهی داشتند. درس: هیچ مرجع تولید شده توسط هوش مصنوعی را نمی توان بدون تأیید در کاتالوگ استفاده کرد.
مورد 2 - OCR 40 ساعت به 6 ساعت کاهش یافت. یک آرشیو شهرداری 3200 صفحه از صورتجلسات چاپی شورا را بین سالهای 1950 و 1970 دیجیتالی کرده است. بازنویسی دستی 40 روز کاری تخمین زده شد. با OCR، متن خام در عرض چند دقیقه منتشر شد. یکی از کارکنان متن را ظرف 6 روز کاری تصحیح و تأیید کرد. هوش مصنوعی کار مکانیکی را تا 85 درصد کاهش داد، اما خواندن و ویرایش نهایی در اختیار انسان باقی ماند.
مورد 3 - خلاصه نابهنگام. یک بایگانشناس از YZ خواست که سابقه بنیاد قرن 18 را خلاصه کند. خلاصه روان بود، اما از یک اصطلاح اداری مدرن استفاده می کرد که در سند وجود ندارد و متعلق به دوره نیست. اگر بایگانی به سراغ اصل سند نمی رفت، این نابهنگامی در پرونده کاتالوگ ثبت می شد. درس: چکیده همیشه با سند اصلی مقایسه می شود.
چهار قالب قابل کپی
1) دهانه ای که نقش ها و مرزها را مشخص می کند:
نقش شما: دستیار کار در تاریخ و بایگانی. وظایف شما شامل ویرایش متن، تولید خطوط کلی و علامت گذاری الگوها است. قوانین سختگیرانه: (1) فقط به متنی که به شما دادم تکیه کنید، حقایق، تاریخ یا منابع را از "حافظه" خود اضافه نکنید. (2) اگر مطمئن نیستید، بنویسید «نامشخص»، آن را درست نکنید. (3) هیچ ادعایی که منبع ندارد مطرح نکنید. اگر متوجه شدید تایید کنید بعد متن رو میدم.
2) دستورالعمل ضد توهم:
متن زیر را خلاصه کنید. قوانین: هیچ نام، تاریخ، مکان یا شماره ای که به وضوح در متن ذکر نشده است را اضافه نکنید. حتی اطلاعات "احتمالا" را که در متن نیست اضافه نکنید. اگر اطلاعاتی در متن موجود نیست، بنویسید "در متن مشخص نشده است". متن: [اینجا]
3) بررسی آناکرونیسم:
خلاصه پیش نویس مقاله [ترمی] را در زیر مرور کنید. عبارات، نهادها، عناوین و مفاهیمی را که ممکن است متعلق به این دوره نباشند، پرچم گذاری کنید. برای هر کدام به طور خلاصه بنویسید که چرا مشکوک است. قضاوت نهایی نکنید؛ فقط نکاتی را که متخصص انسانی باید بررسی کند فهرست کنید. پیش نویس: [اینجا]
4) تجزیه کننده منبع ادعا:
هر جمله در متن زیر را به دو دسته تقسیم کنید: (الف) واقعیتی که مستقیماً در منبع نوشته شده است، (ب) تفسیر/استنتاج. همچنین هر عبارتی که منبع آن نامشخص است را به عنوان "نیاز به تایید" علامت گذاری کنید. متن: [اینجا]
اعلان ضعیف / اعلان قوی
ضعیف:
از این سند عثمانی بگویید.
این درخواست هوش مصنوعی را دعوت می کند تا از "حافظه" خود صحبت کند، جزئیات ساختگی و نابهنگامی را اضافه کند.
قوی:
نقش شما دستیار تاریخ است. فقط بر اساس سند، رونوشت را در زیر چسباندم: (1) افراد، مکانها و تاریخهای ذکر شده در سند را فهرست کنید، (2) نوع سند را حدس بزنید اما میتوانید بگویید "مطمئن نیستم"، (3) اطلاعاتی را که در متن نیست اضافه کنید، (4) مناطق مشکوک/غیرقابل خواندن را با [؟] علامتگذاری کنید. سند: [اینجا]
تفاوت واضح است: نقش، وابستگی به منبع واحد، ممنوعیت ساخت، اجازه پرچم گذاری ابهام، و ساختار خروجی واضح خروجی را قابل اعتماد می کند.
اخلاق، حریم خصوصی و حساسیت فرهنگی
تاریخ و مطالب بایگانی انبوهی از متن بی گناه نیست. ممکن است حاوی اطلاعات شخصی افراد (سوابق مدنی، پرونده های بهداشتی، اسناد دادگاه)، خاطرات حساس جامعه، آثار دارای حق چاپ و مطالب حساس فرهنگی باشد. چند اصل:
- حریم خصوصی: آپلود اسناد حساسی که افراد زنده را قابل شناسایی (داده های شخصی) می کند در ابزارهای عمومی هوش مصنوعی می تواند نقض قانونی و اخلاقی باشد. خط مشی داده های موسسه و قوانین مربوطه را رعایت کنید.
- حق چاپ: هر سندی که دیجیتالی می کنید ممکن است در مالکیت عمومی نباشد. قبل از دادن حقوق به هوش مصنوعی، حقوق را در نظر بگیرید.
- حساسیت فرهنگی: برخی از جوامع در مورد نحوه استفاده از مواد تاریخی خود نظر دارند. پیشنهاد "کارآمد" هوش مصنوعی نمی تواند حساسیت یک جامعه را نادیده بگیرد.
- شفافیت: ثبت کنید که رونویسی یا ابرداده تولید شده توسط هوش مصنوعی با کمک هوش مصنوعی تولید شده است. این امر ضروری است تا محققان بعدی بتوانند تأیید کنند.
نکته: قبل از آپلود یک سند در ابزار هوش مصنوعی مبتنی بر ابر، یک سوال بپرسید: "اگر محتوای این سند در اینترنت ظاهر شود چه کسی آسیب می بیند؟" اگر پاسخ «هیچ کس» است، ابتدا به دنبال تأییدیه شرکت و ابزارهای ایمن باشید.
اشتباهات رایج
- اشتباه گرفتن هوش مصنوعی با یک مورخ هوش مصنوعی تفسیر یا تصمیم نمی گیرد. آنها آماده هستند. معنی و مسئولیت با شماست.
- استفاده از خروجی بدون اعتبارسنجی هر تاریخ، نام، نقل قول و مرجع یک ادعا است. تا زمانی که منبع آن را تایید نکرده باشد، واقعیت ندارد.
- با تکیه بر منابع ساختگی هوش مصنوعی می تواند ارجاعات معتبر اما ناموجود تولید کند. در کاتالوگ جستجو کنید
- نادیده گرفتن نابهنگاری. خروجی هایی را که گذشته را به زبان امروزی توصیف می کنند با چشم انداز دوره فیلتر کنید.
- آپلود اسناد حساس به صورت تصادفی اطلاعات شخصی، کپی رایت و حساسیت فرهنگی را از ابتدا در نظر بگیرید.
به طور خلاصه
در تاریخچه و بایگانی، هوش مصنوعی دستیار قدرتمندی است که به سرعت کارهای مکانیکی و تکراری (رونویسی، ویرایش، اسکن، پیش نویس ابرداده) را به شدت افزایش می دهد. اما دقیقاً در این زمینه شواهد است که توهم و آناکرونیسم خطرات واقعی هستند. هر خروجی را به منبع پیوند دهید، اعتبارسنجی متقاطع، فیلتر دوره. همیشه تفسیر، تصمیم و مسئولیت نهایی را برای خود نگه دارید. حریم خصوصی، کپی رایت و حساسیت فرهنگی را از روز اول رعایت کنید. با این رشته، هوش مصنوعی به ابزاری تبدیل میشود که تحقیقات تاریخی را تسریع میکند، نه کند کردن آن.
وظیفه کاربردی
یک سند تاریخی را که دارید، چاپی یا دیجیتالی انتخاب کنید. ابتدا هوش مصنوعی را با الگوی "Opening setting role and boundary" قرار دهید. سپس هنگام خلاصه کردن سند از "دستورالعمل ضد توهم" استفاده کنید. خروجی را با "تجزیه کننده منبع ادعا" برچسب گذاری کنید و هر عبارتی که "باید تایید شود" را با سند واقعی مقایسه کنید. توجه داشته باشید که چند نقطه توسط هوش مصنوعی اضافه یا تحریف شده است.
چک لیست
- [ ] من هوش مصنوعی را به عنوان یک دستیار، نه به عنوان یک تصمیم گیرنده، قرار دادم.
- [ ] فقط می خواستم بر اساس منبعی که دادم باشد.
- [ ] من به طور مستقل هر تاریخ، نام و مرجع را تأیید کرده ام.
- [ ] من خروجی را برای موارد نابهنگام فیلتر کردم.
- [ ] من محرمانگی، کپی رایت و حساسیت فرهنگی را در اسناد حساس رعایت کرده ام.