Κέρδη:
- Δυνατότητα επεξεργασίας μιας συλλογής σε ροή εργασιών 7 σταδίων, από τον ηθικό έλεγχο έως τη δημοσίευση, με ανθρώπινο σημείο ελέγχου σε κάθε στάδιο
- Κατανοήστε πώς τα πρώιμα σημεία ελέγχου εμποδίζουν τη διάδοση ενός σφάλματος (λανθασμένη ημερομηνία/όνομα) σε όλη την αλυσίδα
- Δυνατότητα εφαρμογής των αρχών διατήρησης του κύριου αρχείου, μη αποθήκευσης στην επαλήθευση και δήλωσης χρήσης AI σε ένα ολιστικό έργο
Οι προηγούμενες ενότητες κάλυψαν μεμονωμένες δεξιότητες: ψηφιοποίηση, μεταγραφή, μεταδεδομένα, σάρωση, μετάφραση, επαλήθευση, ανάλυση προτύπων, ανάκτηση, διατήρηση και ηθική. Αυτή η τελευταία ενότητα τα συνδυάζει όλα. Ένα πραγματικό έργο αρχειοθέτησης βιώνει αυτά τα βήματα όχι ξεχωριστά αλλά ως διασυνδεδεμένη ροή εργασίας. Εδώ, θα δούμε πώς μπορείτε να επεξεργαστείτε μια συλλογή από την αρχή μέχρι το τέλος με μια διαδικασία που υποστηρίζεται από AI αλλά ελέγχεται από τον άνθρωπο, βήμα προς βήμα και με μια αλυσίδα ελέγχου.
Ο στόχος είναι να τοποθετηθεί η τεχνητή νοημοσύνη ως συνεργάτης που «επιταχύνει κάθε βήμα, αλλά δεν έχει τελικό λόγο σε κανένα βήμα». Όταν ολοκληρώσετε αυτήν την ενότητα, θα σας μείνει μια ολιστική μέθοδος που μετατρέπει έναν ακατάστατο σωρό εγγράφων σε μια συλλογή έτοιμη για έρευνα, επαληθευμένη, ηθικά καθαρή.
Σενάριο: αυτό που έχουμε
Ας υποθέσουμε ότι λαμβάνετε μια συλλογή 250 εγγράφων: μερικά έντυπα (έντυπη αλληλογραφία, διαφημίσεις), μερικά χειρόγραφα (γράμματα, σημειωματάρια), από διαφορετικές ημερομηνίες, μερικά περιέχουν ευαίσθητα προσωπικά δεδομένα. Στόχος: ψηφιοποίηση, μεταγραφή, καταλογογράφηση και διάθεση αυτής της συλλογής στους ερευνητές. Ας αναλύσουμε τη διαδικασία σε επτά στάδια.
Ροή εργασίας επτά βημάτων
Φάση 1 — Αξιολόγηση και δεοντολογικός έλεγχος. Γνωρίστε πρώτα τη συλλογή. Ποια έγγραφα περιέχουν ευαίσθητα προσωπικά δεδομένα; Ποια είναι η κατάσταση πνευματικών δικαιωμάτων; Υπάρχει πολιτισμική ευαισθησία; Αυτή η σάρωση καθορίζει ποια έγγραφα μπορούν να δοθούν σε εργαλεία τεχνητής νοημοσύνης που βασίζονται σε σύννεφο και ποια θα υποβληθούν σε επεξεργασία μόνο σε κλειστό/εγκεκριμένο περιβάλλον. Εάν παραλειφθεί αυτό το στάδιο, ολόκληρο το έργο βρίσκεται σε ηθικό κίνδυνο.
Στάδιο 2 — Ψηφιοποίηση. Σαρώστε έγγραφα σε υψηλή ανάλυση (τουλάχιστον 300-400 DPI, καλή αντίθεση). Διατηρήστε τα αρχικά (κύρια) αρχεία ανέγγιχτα. Όλη η επεξεργασία θα γίνει στα αντίγραφα.
Στάδιο 3 — Εξαγωγή κειμένου. Εφαρμόστε OCR για έντυπα έγγραφα και HTR για χειρόγραφα. Ζητήστε από το AI να καθαρίσει την ακατέργαστη έξοδο με οδηγίες "ασφαλούς διόρθωσης" — μόνο σφάλματα οπτικής/αναγνώρισης, κανένα σχόλιο περιεχομένου, μη αναγνώσιμα μέρη [?]. Εναλλακτικός έλεγχος ανάγνωσης και παλαιογράφου για το οθωμανικό/χειρόγραφο.
Στάδιο 4 — Μεταδεδομένα και καταλογογράφηση. Να έχουν συνταχθεί τυπικά μεταδεδομένα (Dublin Core/ISAD(G)) για κάθε έγγραφο. Με άδεια από το "αφήστε κενό το ανύπαρκτο πεδίο". Αντιστοιχίστε τους όρους θέματος στην ελεγχόμενη λίστα. Επαληθεύστε τις ημερομηνίες και τα ονόματα με την τεκμηρίωση.
Στάδιο 5 — Εμπλουτισμός και διαμόρφωση. Εξαγωγή οντοτήτων (πρόσωπο/τόπος/οργανισμός), ομαλοποίηση, παραγωγή περιγραμμάτων σχέσεων και χρονοδιαγράμματος. Επαληθεύστε κάθε μοτίβο στο έγγραφο. Δεν υπάρχουν επινοημένες συνδέσεις και καμία χρονολογία.
Στάδιο 6 — Πρόσβαση σε εργαλεία. Δημιουργήστε περίγραμμα βοήθειας εύρεσης για συλλογή. Βασίστε την ενότητα ιστορικού μόνο σε επαληθευμένες σημειώσεις. Σημειώστε με σαφήνεια τους περιορισμούς πρόσβασης (απόρρητο/πνευματικά δικαιώματα).
Στάδιο 7 — Επαλήθευση, δήλωση και δημοσίευση. Επαληθεύστε τα κρίσιμα πεδία (ημερομηνία, όνομα, απόσπασμα, αναφορά) για τελευταία φορά. Δηλώστε τη χρήση του AI. Ο εμπειρογνώμονας δίνει την τελική έγκριση. Η συλλογή είναι ανοιχτή για έρευνα.
Συμβουλή: Βάλτε ένα "ανθρώπινο σημείο ελέγχου" σε κάθε στάδιο: Ένας ειδικός επικυρώνει την έξοδο του AI πριν προχωρήσει στο επόμενο στάδιο. Χωρίς αυτά τα σημεία ελέγχου, ένα σφάλμα στο πρώτο στάδιο (μια ημερομηνία εσφαλμένης ανάγνωσης) θα διαδοθεί σε όλη την αλυσίδα και τελικά θα διαρρεύσει στον κατάλογο, το μοτίβο και τον οδηγό.
Τραπέζι με αλυσίδα ελέγχου
Σκηνή
δουλειά του AI
ανθρώπινο σημείο ελέγχου
1. Ηθικός έλεγχος
Σήμανση ευαίσθητων δεδομένων
Απόφαση εγκατάστασης
2. Ψηφιοποίηση
(Βελτίωση εικόνας)
Ποιότητα, κύρια προστασία
3. Εξαγωγή κειμένου
OCR/HTR + ασφαλής διόρθωση
Επαλήθευση ονόματος/ημερομηνίας/ανάγνωσης
4. Μεταδεδομένα
τυπικό σχέδιο
Επιβεβαίωση πεδίου, αντιστοίχιση όρων
5. Μοτίβο
οντότητα, σχέση, χρονοδιάγραμμα
Επικύρωση σε έγγραφο
6. Εργαλείο πρόσβασης
Εξεύρεση σχεδίου βοήθειας
Ιστορικό και έγκριση περιορισμών
7. Απελευθέρωση
—
Τελική έγκριση, δήλωση
τρεις μίνι θήκες
Περίπτωση 1 — Εντοπίστηκε σφάλμα αλυσίδας. Σε ένα έργο, στη φάση 3, η ημερομηνία ενός εγγράφου έγραφε "1868" αντί για "1888". Εάν το σημείο ελέγχου του σταδίου 3 δεν είχε εντοπίσει αυτό το σφάλμα, η ημερομηνία θα είχε κατανεμηθεί στον κατάλογο (4), στη γραμμή χρόνου (5) και στον οδηγό (6). Χάρη στο σημείο ελέγχου, το σφάλμα διορθώθηκε σε ένα μέρος. Μάθημα: Ο έγκαιρος έλεγχος αποτρέπει τη διάδοση του σφάλματος στην αλυσίδα.
Περίπτωση 2 — Η ηθική εξέταση έσωσε το έργο. Τα 18 από τα 250 έγγραφα περιείχαν ευαίσθητα δεδομένα ζωντανών προσώπων. Ο ηθικός έλεγχος στη φάση 1 επισήμανε αυτά. Αυτά τα 18 έγγραφα υποβλήθηκαν σε επεξεργασία σε κλειστό περιβάλλον, τα υπόλοιπα με τυπικά εργαλεία. Θα ήταν σοβαρή παραβίαση εάν η σάρωση παραλείπονταν και ανέβαιναν όλα στο cloud. Μάθημα: ο έλεγχος ηθικής είναι το πρώτο βήμα, όχι μια επιδιόρθωση που προστέθηκε αργότερα.
Περίπτωση 3 — Χρόνος και προσπάθεια. Χρησιμοποιώντας την παραδοσιακή μέθοδο, θα χρειαστούν περίπου 8-10 μήνες για την πλήρη επεξεργασία μιας συλλογής 250 εγγράφων. Με τη ροή εργασίας σημείου ελέγχου που υποστηρίζεται από AI, η διαδικασία μειώθηκε σε περίπου 3 μήνες. Αλλά η εξοικονόμηση προήλθε όχι από το «Το AI έκανε τα πάντα», αλλά από το «Το AI έκανε τη μηχανική εργασία, επικεντρωμένη στην ανθρώπινη επαλήθευση». Ο χρόνος που αφιερώνεται στην επαλήθευση δεν έχει μειωθεί. Ο χρόνος που αφιερώνεται στη μηχανική εργασία έχει μειωθεί.
Τέσσερα πρότυπα με δυνατότητα αντιγραφής
1) Αρχικό σχέδιο έργου:
Έχω μια συλλογή από [αριθμός] έγγραφα: [μίξη εκτύπωσης/χειρογράφου], [περίοδος], μερικά από τα οποία μπορεί να περιέχουν ευαίσθητα δεδομένα. Δημιουργήστε ένα σχέδιο ροής εργασίας 7 βημάτων για την ψηφιοποίηση και την καταλογογράφηση αυτής της συλλογής: καθορίστε την εργασία του AI και το σημείο ελέγχου HUMAN σε κάθε στάδιο. Βάλτε πρώτα τον έλεγχο ηθικής.
2) Λίστα ελέγχου μετάβασης σταδίου:
Τελείωσα το στάδιο [όνομα σκηνής]. Δημιουργήστε μια λίστα ελέγχου με κρίσιμα σημεία που πρέπει να επαληθεύσω πριν προχωρήσω στο επόμενο στάδιο: ποια γεγονότα (ημερομηνία/όνομα/αναφορά) πρέπει να επαληθευτούν, ποια σφάλματα μπορούν να διαδοθούν στην αλυσίδα; Έχω την τελική έγκριση. Μου δίνεις τη λίστα ελέγχου.
3) Έλεγχος ποιότητας από άκρο σε άκρο:
Παρακάτω είναι όλα τα επίπεδα ενός επεξεργασμένου εγγράφου: μεταγραφή, μεταδεδομένα, εξαγόμενα στοιχεία. ΕΝΝΟΙΕΣ ΣΧΗΜΑΤΩΝ μεταξύ επιπέδων: ταιριάζει μια ημερομηνία στη μεταγραφή με τα μεταδεδομένα, υπάρχουν πράγματι οι οντότητες στο κείμενο; Επιβολή διόρθωσης; Δημιουργήστε μια λίστα ασυνεπειών. Επίπεδα: [εδώ]
4) Κλείσιμο και δήλωση έργου:
Σε αυτό το έργο συλλογής, χρησιμοποίησα AI στα ακόλουθα στάδια: [λίστα]. Για την τεκμηρίωση του έργου: (1) ποια υποστήριξη AI χρησιμοποιήθηκε σε ποιο στάδιο, (2) πώς έγινε η ανθρώπινη επαλήθευση, (3) ποια όρια/περιορισμοί υπάρχουν — γράψτε μια ειλικρινή σημείωση κλεισίματος και προσχέδιο δήλωσης χρήσης τεχνητής νοημοσύνης που να τα περιλαμβάνει.
Αδύναμη προτροπή / Ισχυρή προτροπή
Αδύναμο:
Επεξεργαστείτε προσεκτικά αυτήν τη συλλογή με AI και ετοιμάστε την για έρευνα.
Μια ενιαία οδηγία «κάντε οτιδήποτε» παρακάμπτει τον ηθικό έλεγχο, τα σημεία ελέγχου και την επαλήθευση. τα σφάλματα διαδίδονται κατά μήκος της αλυσίδας.
Δυνατό:
Ρυθμίστε μια ροή εργασίας 7 σταδίων για αυτήν τη συλλογή, με ένα ανθρώπινο σημείο ελέγχου σε κάθε στάδιο. Αφήστε το 1ο στάδιο να είναι ο έλεγχος ηθικής/απόρρητου. Η έξοδος που παράγεται από το AI σε κάθε στάδιο θα επαληθευτεί πριν μεταβείτε στο επόμενο στάδιο. επισημάνετε κρίσιμα γεγονότα (ημερομηνία/όνομα/αναφορά). Σε κανένα στάδιο το AI δεν έχει τον τελευταίο λόγο.
Η διαφορά: η σταδιακή δομή, η προτεραιότητα ηθικής, τα σημεία ελέγχου και η αρχή «οι άνθρωποι έχουν τον τελευταίο λόγο» καθιστούν ολόκληρο το έργο ασφαλές και υπερασπίσιμο.
Συνήθη λάθη
- Αφήνοντας τον ηθικό έλεγχο για το τέλος. Η σάρωση απορρήτου/πνευματικών δικαιωμάτων είναι το πρώτο βήμα. Εάν προστεθεί αργότερα, η παράβαση έχει ήδη συμβεί.
- Παράκαμψη σημείων ελέγχου. Ένα σφάλμα που δεν επαληθεύεται εξαπλώνεται σε όλη την αλυσίδα.
- Δεν προστατεύει το κύριο αρχείο. Εάν το πρωτότυπο δεν διατηρηθεί ανέγγιχτο, η επιστροφή καθίσταται αδύνατη.
- Εξοικονόμηση στην επαλήθευση. Το AI συντομεύει τη μηχανική εργασία. Εάν ο χρόνος επαλήθευσης μειωθεί, η ποιότητα μειώνεται.
- Μη δήλωση χρήσης AI. Η διαφάνεια αποτελεί μέρος της επιστημονικής αξιοπιστίας της συλλογής.
Συνοπτικά
Ένα έργο αρχείου από άκρο σε άκρο συνδέει μεμονωμένες δεξιότητες σε μια αλυσίδα ελέγχου: ηθική σάρωση, ψηφιοποίηση, εξαγωγή κειμένου, μεταδεδομένα, μοτίβο, εργαλείο ανάκτησης και δημοσίευση. Σε κάθε στάδιο, η τεχνητή νοημοσύνη επιταχύνει τη μηχανική εργασία. Σε κάθε στάδιο, ένα ανθρώπινο σημείο ελέγχου έχει τον τελευταίο λόγο. Ο ηθικός έλεγχος είναι το πρώτο στάδιο, το κύριο αρχείο προστατεύεται, τα σφάλματα εντοπίζονται έγκαιρα, ώστε να μην εξαπλωθούν στην αλυσίδα και η χρήση της τεχνητής νοημοσύνης δηλώνεται με ειλικρίνεια. Η εξοικονόμηση πόρων δεν προέρχεται από την τεχνητή νοημοσύνη που κάνει τα πάντα, αλλά από τον άνθρωπο που απελευθερώνεται από τη μηχανική εργασία και επικεντρώνεται στην επαλήθευση. Το AI επιταχύνει. Ο άνθρωπος διασφαλίζει την ακρίβεια και την ακεραιότητα της ιστορίας.
Εργασία εφαρμογής
Επιλέξτε μια μικρή συλλογή (10-20 έγγραφα, δικό σας υλικό ή δείγμα σετ). Δημιουργήστε μια ροή εργασίας 7 βημάτων με το πρότυπο "project startup plan". Εκτελέστε τουλάχιστον δύο έγγραφα μέσω αυτής της ροής: ηθική σάρωση, εξαγωγή κειμένου, μεταδεδομένα και ένα επίπεδο μοτίβου. Επαληθεύστε κάθε στάδιο με μια "λίστα ελέγχου μετάβασης σταδίου". Τέλος, τεκμηριώστε τη χρήση της τεχνητής νοημοσύνης με το πρότυπο «closure and statement» του έργου. Σημειώστε ποια σφάλματα εντοπίστηκαν στα πρώτα σημεία ελέγχου.
λίστα ελέγχου
- [ ] Έκανα τον έλεγχο ηθικής/απόρρητου στο πρώτο στάδιο.
- [ ] Κράτησα ανέγγιχτα τα κύρια αρχεία.
- [ ] Βάζω ένα ανθρώπινο σημείο ελέγχου σε κάθε στάδιο.
- [ ] Επιβεβαίωσα κρίσιμα γεγονότα προτού διαδοθούν στην αλυσίδα.
- [ ] Δήλωσα τη χρήση AI στο κλείσιμο του έργου.
Εξέταση Ενοτήτων
1. Ποια είναι η καταλληλότερη τοποθέτηση για την τεχνητή νοημοσύνη στην ιστορία και την αρχειοθέτηση;
- Α) Το AI είναι ένα εργαλείο σύνοψης, επεξεργασίας και σύνταξης. Το σχόλιο, η κριτική πηγής και η τελική ευθύνη ανήκουν στον ειδικό ✔
- Β) Η τεχνητή νοημοσύνη μπορεί να αποφασίσει την αυθεντικότητα και το νόημα του εγγράφου από μόνη της, όπως ένας ιστορικός
- Γ) Η τεχνητή νοημοσύνη λειτουργεί μόνο για τη μετάφραση κειμένου, δεν έχει καμία σχέση με άλλες εργασίες αρχειοθέτησης
- Δ) Δεδομένου ότι η τεχνητή νοημοσύνη είναι πάντα πιο αμερόληπτη από τους ανθρώπους, η ιστορική ερμηνεία θα πρέπει να αφεθεί σε αυτήν.
Περιγραφή: Τεχνητή νοημοσύνη. Είναι ένας βοηθός που επεξεργάζεται, σαρώνει, μεταφράζει και παράγει προσχέδια κειμένου. Η κριτική πηγής, η ερμηνεία, η διαπίστωση αιτίου-αποτελέσματος και η τελική απόφαση ανήκουν στον εμπειρογνώμονα. Μια μη επαληθευμένη έξοδος μπορεί να οδηγήσει σε μια κατασκευασμένη πηγή, μια ψευδή ημερομηνία ή έναν αναχρονισμό.
2. Τι είναι η ψευδαίσθηση που παράγει η τεχνητή νοημοσύνη στην ιστορική έρευνα;
- Α) Η τεχνητή νοημοσύνη επεξεργάζεται ένα έγγραφο πολύ αργά
- Β) Η τεχνητή νοημοσύνη κατασκευάζει μια ανύπαρκτη πηγή, απόσπασμα ή γεγονός ως πραγματικό ✔
- Γ) Ένα έγγραφο έχει υποστεί σωματική βλάβη
- Δ) Ένας κατάλογος αρχείων δεν είναι ενημερωμένος
Εξήγηση: Η ψευδαίσθηση είναι όταν η τεχνητή νοημοσύνη κατασκευάζει με σιγουριά πληροφορίες, πηγές, αποσπάσματα ή γεγονότα που στην πραγματικότητα δεν υπάρχουν. Αν και η μορφή του φαίνεται τέλεια, το περιεχόμενό του δεν είναι πραγματικό. Επομένως, σε κάθε κατάλογο αναφοράς, κάθε παραπομπή πρέπει να επαληθεύεται στην αρχική πηγή.
3. Ποια είναι η καλύτερη προσέγγιση για να διορθώσετε μια έξοδο OCR με τεχνητή νοημοσύνη;
- Α) Ζητώντας το κείμενο να είναι εύρυθμο και όμορφο και να συμπληρώνει λογικά τα μέρη που λείπουν.
- Β) Επιτρέποντάς του να διορθώσει όλους τους αριθμούς και τις ημερομηνίες με βάση το πλαίσιο
- Γ) Ζητώντας του να διορθώσει μόνο τα σφάλματα οπτικής αναγνώρισης, να αφήσει μη αναγνώσιμες περιοχές [?] και να μην αλλάξει αριθμούς/ημερομηνίες ✔
- Δ) Ζητώντας από τον μαθητή να συμπληρώσει τις δυσανάγνωστες λέξεις με την πιο πιθανή εικασία.
Εξήγηση: Ο χρυσός κανόνας στη διόρθωση OCR είναι η διόρθωση μόνο προφανών σφαλμάτων οπτικής αναγνώρισης (όπως rn σε m, l σε 1). μη ερμηνεία ή συμπλήρωση του περιεχομένου του κειμένου. Οι μη αναγνώσιμες περιοχές επισημαίνονται με [?]. Οι αριθμοί και οι ημερομηνίες δεν αλλάζουν, επαληθεύονται με την εικόνα.
4. Τι πρέπει να ζητηθεί από την τεχνητή νοημοσύνη όταν πρόκειται για την ανάγνωση μιας λέξης της οποίας το φωνήεν δεν είναι γραμμένο σε ένα οθωμανικό κείμενο;
- Α) Δώστε μια ενιαία, ακριβή ανάγνωση, επιταχύνοντας έτσι την εργασία
- Β) Επιλέγοντας τη λέξη που θα κάνει το νόημα πιο ευχάριστο και συμπληρώνοντας τα κενά
- Γ) Συμπλήρωση των δυσανάγνωστων μερών από τις δικές του γενικές γνώσεις.
- Δ) Προσφορά πιθανών εναλλακτικών λύσεων ανάγνωσης και επισήμανση διφορούμενων περιοχών αντί της επιβολής οριστικής ανάγνωσης ✔
Επεξήγηση: Στα οθωμανικά τουρκικά, τα μικρά φωνήεντα δεν γράφονται ως επί το πλείστον. Μια διαφορά φωνήεντος/γράμματος (abul και kabul, wali και vali) αλλάζει εντελώς το νόημα. Επομένως, αντί να επιβάλλεται οριστική ανάγνωση, θα πρέπει να ζητηθούν πιθανές εναλλακτικές, να διατηρηθούν οι μη αναγνώσιμες περιοχές και να αφεθεί η τελική απόφαση στον παλαιογράφο.
5. Ποιος είναι ο πιο αποτελεσματικός τρόπος για να αποτραπεί η ψευδαίσθηση όταν η τεχνητή νοημοσύνη παράγει πρόχειρα μεταδεδομένα (αρχείο καταλόγου);
- Α) Ρητά παραχωρήστε άδεια να αφήσετε αυτό το πεδίο κενό εάν δεν περιλαμβάνεται στο έγγραφο ✔
- Β) Αίτημα να συμπληρωθεί κάθε πεδίο και να μην μείνει ελλιπές.
- Γ) Εκτίμηση ημερομηνίας βάσει του περιεχομένου εγγράφων χωρίς ημερομηνία
- Δ) Επιτρέποντας την τεχνητή νοημοσύνη να δημιουργήσει τον κωδικό αναφοράς
Περιγραφή: Η πίεση πλήρωσης αναγκάζει το AI να δημιουργήσει το έγγραφο μαντεύοντας την ημερομηνία ή τον δημιουργό που δεν υπάρχει στο έγγραφο. Η ισχυρότερη ασπίδα έναντι αυτού είναι να παραχωρήσετε ρητά άδεια να αφήσετε το πεδίο κενό εάν δεν υπάρχει στο έγγραφο. Επιπλέον, οι όροι θέματος αντιστοιχίζονται σε ελεγχόμενο λεξιλόγιο.
6. Πώς πρέπει να τοποθετηθεί στην ιστορική έρευνα μια περίληψη εγγράφου που παράγεται από την τεχνητή νοημοσύνη;
- Α) Ως αξιόπιστα στοιχεία που μπορούν να παρατεθούν άμεσα
- Β) Ως χάρτης ανακάλυψης που σας κατευθύνει στο πραγματικό έγγραφο. Τα αποδεικτικά στοιχεία λαμβάνονται από το πρωτότυπο έγγραφο ✔
- Γ) Ως επαρκής πόρος που μπορεί να αντικαταστήσει το ίδιο το έγγραφο
- Δ) Ως κείμενο που μπορεί να χρησιμοποιηθεί στη μελέτη χωρίς να επιστρέψει ποτέ στο έγγραφο
Περιγραφή: Η περίληψη είναι ένας χάρτης ανακάλυψης, όχι μια απόδειξη. Υπάρχει κάτι τέτοιο σε αυτό το έγγραφο, λέει πηγαίνετε και κοιτάξτε. Δεν λέει ακριβώς τι λέει στο έγγραφο. Εάν ένα γεγονός, απόσπασμα ή δεδομένα πρόκειται να συμπεριληφθούν στη μελέτη, πρέπει να ληφθούν αυτολεξεί από το αρχικό έγγραφο.
7. Ποιος είναι ο σωστός τρόπος αποφυγής αναχρονισμών κατά τη μετάφραση ενός ιστορικού εγγράφου προς δημοσίευση;
- Α) Αντικατάσταση όλων των όρων περιόδου με το πλησιέστερο σημερινό ισοδύναμο
- Β) Να αποδίδουν το κείμενο όσο πιο εύρυθμα και μοντέρνα γίνεται
- Γ) Αφήστε μοναδικούς τους τίτλους περιόδου και τα ονόματα των ιδρυμάτων και προσθέστε μια εξήγηση ✔
- Δ) Προσαρμογή των κατάλληλων ονομάτων στην τρέχουσα χρήση τους
Εξήγηση: Αναχρονισμός είναι η λανθασμένη μεταφορά στοιχείων από τη μια περίοδο στην άλλη. Η αλλαγή των τίτλων εποχής, των ονομάτων ιδρυμάτων και των προσωπικών ονομάτων με τους σημερινούς όρους μεταφέρει τον αναγνώστη σε έναν κόσμο που δεν ανήκει στην περίοδο. Ο σωστός τρόπος είναι να διατηρήσετε τον όρο της περιόδου και να προσθέσετε επεξήγηση δίπλα του.
8. Πώς να βεβαιωθείτε ότι μια αναφορά αρχείου (όνομα κεφαλαίου, αριθμός αρχείου) που δίνεται από την τεχνητή νοημοσύνη είναι πραγματική;
- Α) Εμπιστευόμαστε την αναφορά γιατί η μορφή της φαίνεται σωστή
- Β) Ρωτώντας ξανά το AI εάν η αναφορά είναι σωστή
- Γ) Αποδοχή της αναφοράς ως αληθής γιατί είναι πειστική και λεπτομερής
- Δ) Με την προσωπική εύρεση και επαλήθευση της αναφοράς στον κατάλογο του αρχείου ή στην αξιόπιστη πηγή ✔
Περιγραφή: Η τεχνητή νοημοσύνη μπορεί να παράγει αναφορές που έχουν τέλεια μορφή αλλά δεν υπάρχουν στην πραγματικότητα. Μια εικονική αναφορά έχει την ίδια μορφή με μια πραγματική αναφορά. Ο μόνος τρόπος για να αποδείξετε ότι υπάρχει μια αναφορά είναι να την βρείτε όπου βρίσκεται η αρχική πηγή (κατάλογος αρχείου, βιβλιοθήκη).
9. Πώς πρέπει να αξιολογηθεί ένα μοτίβο που βρέθηκε κατά την εκτέλεση ανάλυσης προτύπων (NER, δίκτυο, χρονοδιάγραμμα) με τεχνητή νοημοσύνη;
- Α) Ως υπόθεση που πρέπει να επαληθευτεί στο έγγραφο. σημείο εκκίνησης, όχι αποτέλεσμα ✔
- Β) Ως οριστικό εύρημα που δεν απαιτεί επαλήθευση
- Γ) Είναι αδιαμφισβήτητο αντικειμενικό γεγονός γιατί είναι αριθμητικό.
- Δ) Ως αποτέλεσμα που μπορεί να τεθεί σε άμεση μελέτη γιατί βρήκε τεχνητή νοημοσύνη
Εξήγηση: Κάθε πρότυπο είναι μια υπόθεση, όχι μια απόδειξη. Οι οντότητες θα πρέπει να συνδέονται με την πηγή, οι διαφορετικές ορθογραφίες (του ίδιου ατόμου/τόπου) θα πρέπει να κανονικοποιούνται με ανθρώπινη έγκριση, οι αριθμοί θα πρέπει να αμφισβητούνται για δεδομένα που λείπουν και μεροληψία δειγματοληψίας και τα γεγονότα χωρίς ημερομηνία δεν πρέπει να χρονολογούνται.
10. Γιατί η ενότητα βιογραφικής/θεσμικής ιστορίας σε ένα βοήθημα εύρεσης απαιτεί ιδιαίτερη προσοχή;
- Α) Αυτή η ενότητα δεν είναι σημαντική και μπορεί να δημοσιευτεί χωρίς επαλήθευση
- Β) Εφόσον η τεχνητή νοημοσύνη μπορεί να προσθέσει κατασκευασμένα συμβάντα, ψευδείς ημερομηνίες και τίτλους σε αυτήν την ενότητα, θα πρέπει να βασίζεται μόνο σε επαληθευμένες πηγές ✔
- Γ) Η τεχνητή νοημοσύνη μπορεί να χρησιμοποιηθεί με ασφάλεια γιατί δεν κάνει λάθη στη συγγραφή της ιστορίας.
- Δ) Μόνο ερευνητές συμπληρώνουν αυτήν την ενότητα, ο αρχειονόμος δεν ενδιαφέρεται
Περιγραφή: Η ενότητα του ιστορικού είναι εκεί όπου η ψευδαίσθηση εμφανίζεται συχνότερα: η τεχνητή νοημοσύνη μπορεί να εισαγάγει ανύπαρκτα γεγονότα, ψευδείς ημερομηνίες και κατασκευασμένους τίτλους ενώ γράφει ένα άπταιστο κείμενο από γενικές πληροφορίες για ένα άτομο ή ένα ίδρυμα. Αυτή η ενότητα θα πρέπει να βασίζεται μόνο σε επαληθευμένες πηγές.
11. Πώς πρέπει να απαντά η τεχνητή νοημοσύνη στην ερώτηση ενός ερευνητή σε μια υπηρεσία αναφοράς (συμβουλευτικής);
- Α) Η απάντηση στο ερώτημα θα πρέπει να δοθεί άμεσα και ως βέβαιο γεγονός.
- Β) Πρέπει να παρουσιάσει μια αξιόπιστη ημερομηνία ή όνομα και να το μεταφέρει στον ερευνητή.
- Γ) Αντί να δίνει άμεσα γεγονότα, θα πρέπει να κατευθύνει τον ερευνητή στη σχετική συλλογή και πηγή ✔
- Δ) Θα πρέπει να παρέχει πλήρη απάντηση, ώστε ο ερευνητής να μην χρειάζεται να πάει στην πηγή.
Εξήγηση: Στην υπηρεσία αναφοράς, η τεχνητή νοημοσύνη δεν πρέπει να δίνει μια άμεση απάντηση σε γεγονότα, αλλά θα πρέπει να κατευθύνει τον ερευνητή στην πηγή. Επειδή η άμεση τεκμηριωμένη απάντηση που δίνεται από την τεχνητή νοημοσύνη μπορεί να είναι κατασκευασμένη και ο ερευνητής να την μπερδέψει με την πηγή. Αντί να λέει "Η απάντηση είναι αυτή", θα πρέπει να λέει "Δείτε αυτά τα έγγραφα σε αυτήν τη συλλογή".
12. Ποιες λειτουργίες είναι αποδεκτές και απαράδεκτες κατά την επεξεργασία μιας κατεστραμμένης εικόνας εγγράφου με τεχνητή νοημοσύνη;
- Α) Όλα τα είδη χειρισμών είναι δωρεάν, συμπεριλαμβανομένης της συμπλήρωσης των εξαρτημάτων που λείπουν.
- Β) Δεν πρέπει να γίνει καμία ενέργεια, η εικόνα δεν πρέπει να αγγίζεται ποτέ
- Γ) Η συμπλήρωση των ενοτήτων που λείπουν είναι η πιο πολύτιμη ενέργεια γιατί συμπληρώνει το έγγραφο.
- Δ) Οι χειρισμοί αναγνωσιμότητας όπως η αντίθεση/θόρυβος είναι αποδεκτοί. Δεν είναι βολικό να συμπληρώσετε τα μέρη που λείπουν με εικασίες ✔
Επεξήγηση: Οι διαδικασίες που βελτιώνουν την αναγνωσιμότητα (αντίθεση, φωτισμός, μείωση θορύβου) είναι αποδεκτές επειδή δεν αλλάζουν το περιεχόμενο. Ωστόσο, η συμπλήρωση τμημάτων που λείπουν/μη αναγνώσιμα με εικασίες είναι ο κίνδυνος να δημιουργηθεί αυτό που δεν υπάρχει στο έγγραφο, δηλαδή ιστορική πλαστογραφία. Το πρωτότυπο διατηρείται, οι συναλλαγές καταγράφονται.
13. Τι πρέπει να γίνει πριν από την επεξεργασία ενός αρχείου εγγράφου που περιέχει ευαίσθητα προσωπικά δεδομένα;
- Α) Σάρωση απορρήτου και ανωνυμοποίηση εάν είναι απαραίτητο ή με χρήση κλειστού/εγκεκριμένου εργαλείου ✔
- Β) Ανέβασμα του εγγράφου απευθείας σε δημόσιο όχημα χωρίς καν να το σκεφτώ
- Γ) Αγνοώντας τις ανησυχίες για την προστασία της ιδιωτικής ζωής για αποτελεσματικότητα
- Δ) Υπέρβαση των περιορισμών πρόσβασης για λόγους αποτελεσματικότητας
Αποκάλυψη: Η μεταφόρτωση εγγράφων που περιέχουν ευαίσθητα δεδομένα που ταυτοποιούν ζωντανά άτομα (υγεία, θρησκεία, εθνικότητα, διεύθυνση) σε δημόσια εργαλεία που βασίζονται στο cloud μπορεί να αποτελεί σοβαρή παραβίαση απορρήτου. Θα πρέπει πρώτα να γίνει έλεγχος απορρήτου, η ανωνυμοποίηση ή ένα κλειστό/εγκεκριμένο εργαλείο θα πρέπει να χρησιμοποιηθεί εάν είναι απαραίτητο.
14. Ποιος είναι ο κύριος σκοπός ενός ανθρώπινου σημείου ελέγχου σε ένα έργο αρχείου από άκρο σε άκρο;
- Α) Επιβράδυνση του έργου της τεχνητής νοημοσύνης και καθυστέρηση του έργου
- Β) Για να αποτρέψετε ένα σφάλμα (λανθασμένη ημερομηνία/όνομα) σε ένα στάδιο από το να συνδεθεί σε όλα τα επόμενα στάδια ✔
- Γ) Αύξηση της ανθρώπινης εργασίας και πλήρης εγκατάλειψη του αυτοματισμού
- Δ) Διασφάλιση ότι η τεχνητή νοημοσύνη έχει τον τελευταίο λόγο
Περιγραφή: Ένα ανθρώπινο σημείο ελέγχου σε κάθε στάδιο διασφαλίζει ότι η έξοδος του AI επαληθεύεται πριν προχωρήσετε στο επόμενο στάδιο. Χωρίς αυτό, ένα σφάλμα στο πρώτο στάδιο (μια ημερομηνία εσφαλμένης ανάγνωσης) θα εξαπλωθεί στην αλυσίδα μέσω του καταλόγου, του μοτίβου και του οδηγού. Ο έγκαιρος έλεγχος διασφαλίζει ότι το σφάλμα διορθώνεται σε ένα σημείο.
15. Τι απαιτεί η διαφάνεια και η αυθεντικότητα στη χρήση της τεχνητής νοημοσύνης στις ανθρωπιστικές και κοινωνικές επιστήμες;
- Α) Κρατώντας μυστική τη χρήση της τεχνητής νοημοσύνης, διασφαλίζοντας ότι κανείς δεν γνωρίζει
- Β) Να παρουσιάζει κάθε κείμενο που παράγεται από την τεχνητή νοημοσύνη ως δική του πρωτότυπη ιδέα
- Γ) Να δηλώνει με ειλικρίνεια τη χρήση της τεχνητής νοημοσύνης και να μην παρουσιάζει τα αποτελέσματά της ως πρωτότυπη δουλειά ✔
- Δ) Κοινή χρήση μόνο των αποτελεσμάτων χωρίς εξήγηση των μεθόδων
Περιγραφή: Η διαφάνεια περιλαμβάνει την καταγραφή ότι μια μεταγραφή, μεταδεδομένα ή μετάφραση δημιουργήθηκε με τη βοήθεια τεχνητής νοημοσύνης. Η πρωτοτυπία απαιτεί να μην παρουσιάζεται ένα σχόλιο που παράγεται από την τεχνητή νοημοσύνη ως δική του αρχική ιδέα. Αυτό είναι απαραίτητο για την επαλήθευση από τους επόμενους ερευνητές και για την ακαδημαϊκή ακεραιότητα.