Einheit 12 / 12

End-to-End-Projekt: Bearbeitung einer Archivsammlung mit künstlicher Intelligenz

Gewinne:

  • Möglichkeit, eine Sammlung in einem 7-stufigen Arbeitsablauf zu verarbeiten, von der ethischen Prüfung bis zur Veröffentlichung, mit einem menschlichen Kontrollpunkt in jeder Phase
  • Verstehen Sie, wie frühe Prüfpunkte verhindern, dass sich ein Fehler (falsches Datum/falscher Name) in der gesamten Kette ausbreitet
  • Fähigkeit, die Grundsätze der Bewahrung der Stammdatei, des Verzichts auf Einsparungen bei der Überprüfung und der Deklaration des Einsatzes von KI in einem ganzheitlichen Projekt anzuwenden

In den vorherigen Einheiten wurden individuelle Fähigkeiten abgedeckt: Digitalisierung, Transkription, Metadaten, Scannen, Übersetzung, Verifizierung, Musteranalyse, Abruf, Bewahrung und Ethik. Diese letzte Einheit vereint alles. Bei einem echten Archivprojekt werden diese Schritte nicht einzeln, sondern als zusammenhängender Arbeitsablauf erlebt. Hier sehen wir, wie Sie eine Sammlung von Anfang bis Ende mit einem KI-gestützten, aber vom Menschen gesteuerten Prozess Schritt für Schritt und mit einer Kontrollkette abwickeln können.

Ziel ist es, KI als Partner zu positionieren, der „jeden Schritt beschleunigt, aber bei keinem Schritt das letzte Wort hat“. Wenn Sie diese Einheit abgeschlossen haben, steht Ihnen eine ganzheitliche Methode zur Verfügung, die einen unordentlichen Dokumentenstapel in eine forschungsbereite, verifizierte und ethisch einwandfreie Sammlung verwandelt.

Szenario: was wir haben

Nehmen wir an, Sie erhalten eine Sammlung von 250 Dokumenten: einige gedruckt (gedruckte Korrespondenz, Anzeigen), einige Manuskripte (Briefe, Notizbücher) mit unterschiedlichem Datum, einige enthalten sensible persönliche Daten. Ziel: Diese Sammlung zu digitalisieren, zu transkribieren, zu katalogisieren und Forschern zugänglich zu machen. Lassen Sie uns den Prozess in sieben Phasen unterteilen.

Siebenstufiger Arbeitsablauf

Phase 1 – Bewertung und ethisches Screening. Lernen Sie zunächst die Sammlung kennen. Welche Dokumente enthalten sensible personenbezogene Daten? Wie ist der Urheberrechtsstatus? Gibt es kulturelle Sensibilität? Durch dieses Scannen wird bestimmt, welche Dokumente an cloudbasierte KI-Tools übergeben werden können und welche nur in einer geschlossenen/genehmigten Umgebung verarbeitet werden. Wenn diese Phase übersprungen wird, besteht für das gesamte Projekt ein ethisches Risiko.

Stufe 2 – Digitalisierung. Scannen Sie Dokumente mit hoher Auflösung (mindestens 300-400 DPI, guter Kontrast). Lassen Sie die Originaldateien (Masterdateien) unberührt. Die gesamte Bearbeitung erfolgt auf den Kopien.

Stufe 3 – Textextraktion. Wenden Sie OCR für gedruckte Dokumente und HTR für Manuskripte an. Lassen Sie die KI die Rohausgabe mit der Anweisung „sicheres Korrekturlesen“ bereinigen – nur optische/Erkennungsfehler, kein Inhaltskommentar, unleserliche Stellen [?]. Alternative Lesart und Paläographenkontrolle für das Osmanische/Manuskript.

Stufe 4 – Metadaten und Katalogisierung. Lassen Sie für jedes Dokument Standardmetadaten (Dublin Core/ISAD(G)) entwerfen; Mit Erlaubnis von „Nicht vorhandenes Feld leer lassen“. Ordnen Sie Themenbegriffe der kontrollierten Liste zu. Überprüfen Sie Daten und Namen anhand der Dokumentation.

Stufe 5 – Anreicherung und Musterung. Extrahieren Sie Entitäten (Person/Ort/Organisation), normalisieren Sie sie, erstellen Sie Beziehungs- und Zeitleistenumrisse. Überprüfen Sie jedes Muster im Dokument. Es gibt keine erfundenen Zusammenhänge und keine Chronologie.

Stufe 6 – Zugriff auf Tools. Erstellen Sie eine Findbuchübersicht zur Abholung; Basieren Sie den Verlaufsabschnitt nur auf verifizierten Notizen. Zugriffsbeschränkungen (Datenschutz/Urheberrecht) deutlich kennzeichnen.

Stufe 7 – Überprüfung, Erklärung und Veröffentlichung. Überprüfen Sie kritische Felder (Datum, Name, Zitat, Referenz) ein letztes Mal. Erklären Sie den Einsatz von KI. Der Sachverständige gibt die endgültige Genehmigung; Die Sammlung ist für Forschungszwecke geöffnet.

Tipp: Setzen Sie in jeder Phase einen „menschlichen Kontrollpunkt“: Ein Experte validiert die Ergebnisse der KI, bevor er mit der nächsten Phase fortfährt. Ohne diese Prüfpunkte breitet sich ein Fehler in der ersten Phase (ein falsch gelesenes Datum) in der gesamten Kette aus und dringt schließlich in den Katalog, das Muster und den Leitfaden ein.

Steuerkettentabelle

Bühne

Der Job der KI

menschlicher Kontrollpunkt

1. Ethisches Screening

Kennzeichnung sensibler Daten

Installationsentscheidung

2. Digitalisierung

(Bildverbesserung)

Qualität, Meisterschutz

3. Textextraktion

OCR/HTR + sichere Korrektur

Name/Datum/Lesebestätigung

4. Metadaten

Standardentwurf

Feldbestätigung, Begriffsübereinstimmung

5. Muster

Entität, Beziehung, Zeitleiste

Validierung im Dokument

6. Zugriffstool

Entwurf eines Findbuchs

Historie und Einschränkungsgenehmigung

7. Veröffentlichung

Endgültige Genehmigung, Erklärung

drei Mini-Koffer

Fall 1 – Kettenfehler erkannt. In einem Projekt, in Phase 3, lautete das Datum eines Dokuments „1868“ statt „1888“. Wenn der Prüfpunkt der Stufe 3 diesen Fehler nicht erkannt hätte, wäre das Datum über den Katalog (4), die Zeitleiste (5) und den Leitfaden (6) verteilt worden. Dank des Checkpoints wurde der Fehler an einer Stelle behoben. Lektion: Eine frühzeitige Überprüfung verhindert, dass sich der Fehler in der Kette ausbreitet.

Fall 2 – Ethisches Screening rettete das Projekt. 18 der 250 Dokumente enthielten sensible Daten lebender Personen. Das ethische Screening in Phase 1 hat diese festgestellt; Diese 18 Dokumente wurden in einer geschlossenen Umgebung verarbeitet, der Rest mit Standardtools. Es wäre ein schwerwiegender Verstoß gewesen, wenn der Scanvorgang übersprungen und alles in die Cloud hochgeladen worden wäre. Lektion: Ethik-Screening ist der erste Schritt, keine später hinzugefügte Lösung.

Fall 3 – Zeit und Aufwand. Mit der herkömmlichen Methode würde die vollständige Bearbeitung einer Sammlung von 250 Dokumenten etwa 8–10 Monate dauern. Mit dem KI-gestützten Checkpoint-Workflow konnte der Prozess auf ca. 3 Monate verkürzt werden. Die Einsparungen kamen jedoch nicht dadurch zustande, dass „die KI alles erledigte“, sondern dadurch, dass „die KI die mechanische Arbeit erledigte und sich auf die menschliche Verifizierung konzentrierte“. Der Zeitaufwand für die Überprüfung hat sich nicht verringert; Der Zeitaufwand für mechanische Arbeiten ist zurückgegangen.

Vier kopierbare Vorlagen

1) Ursprünglicher Projektplan:

Ich habe eine Sammlung von [Anzahl] Dokumenten: [Mischung aus Druck/Manuskript], [Punkt], von denen einige möglicherweise sensible Daten enthalten. Erstellen Sie einen 7-stufigen Arbeitsablaufplan zur Digitalisierung und Katalogisierung dieser Sammlung: Geben Sie in jeder Phase die Aufgabe der KI und den MENSCHLICHEN Kontrollpunkt an. Stellen Sie das Ethik-Screening an die erste Stelle.

2) Checkliste für den Phasenübergang:

Ich habe die Stufe [Künstlername] abgeschlossen. Erstellen Sie eine Checkliste mit kritischen Punkten, die ich überprüfen muss, bevor ich mit der nächsten Stufe fortfahre: Welche Fakten (Datum/Name/Referenz) müssen überprüft werden, welche Fehler können sich in der Kette ausbreiten? Ich habe die endgültige Genehmigung; Sie geben mir die Checkliste.

3) Durchgängige Qualitätskontrolle:

Nachfolgend sind alle Ebenen eines verarbeiteten Dokuments aufgeführt: Transkription, Metadaten, extrahierte Assets. ABBILDUNG INKONZEPTE zwischen Ebenen: Stimmt ein Datum in der Transkription mit den Metadaten überein, existieren die Entitäten tatsächlich im Text? Auferlegung einer Korrektur; Erstellen Sie eine Liste der Inkonsistenzen. Ebenen: [hier]

4) Projektabschluss und Erklärung:

In diesem Sammlungsprojekt habe ich KI in den folgenden Phasen verwendet: [Liste]. Für die Projektdokumentation: (1) Welche KI-Unterstützung wurde in welcher Phase verwendet, (2) Wie wurde die menschliche Verifizierung durchgeführt, (3) Welche Grenzen/Einschränkungen gibt es – schreiben Sie eine ehrliche Abschlussnotiz und einen Entwurf einer KI-Nutzungserklärung, die diese enthält.

Schwache Eingabeaufforderung / Starke Eingabeaufforderung

Schwach:

Verarbeiten Sie diese Sammlung gründlich mit KI und bereiten Sie sie für die Forschung vor.

Eine einzige „Alles tun“-Anweisung umgeht ethische Überprüfungen, Kontrollpunkte und Verifizierungen; Fehler breiten sich entlang der Kette aus.

Stark:

Richten Sie einen 7-stufigen Workflow für diese Sammlung ein, mit einem menschlichen Kontrollpunkt in jeder Phase. Lassen Sie die erste Stufe eine Ethik-/Datenschutzprüfung sein. Die von der KI in jeder Phase erzeugte Ausgabe wird überprüft, bevor mit der nächsten Phase fortgefahren wird. Kritische Fakten markieren (Datum/Name/Referenz). Zu keinem Zeitpunkt hat die KI das letzte Wort.

Der Unterschied: Stufenstruktur, Ethikpriorität, Kontrollpunkte und das Prinzip „Der Mensch hat das letzte Wort“ machen das gesamte Projekt sicher und vertretbar.

Häufige Fehler

  • Lassen Sie die ethische Überprüfung bis zum Ende. Datenschutz-/Urheberrechtsprüfungen sind der erste Schritt; Wenn es später hinzugefügt wird, liegt der Verstoß bereits vor.
  • Umgehen von Kontrollpunkten. Ein unbestätigter Fehler breitet sich in der gesamten Kette aus.
  • Die Masterdatei wird nicht geschützt. Wenn das Original nicht unberührt bleibt, ist eine Rückgabe unmöglich.
  • Sparen Sie bei der Verifizierung. KI verkürzt die mechanische Arbeit; Wird die Prüfzeit verkürzt, sinkt die Qualität.
  • Den Einsatz von KI nicht deklarieren. Transparenz ist Teil der wissenschaftlichen Glaubwürdigkeit der Sammlung.

Zusammenfassend

Ein End-to-End-Archivprojekt verbindet individuelle Fähigkeiten in einer Kontrollkette: ethisches Scannen, Digitalisierung, Textextraktion, Metadaten, Muster, Retrieval-Tool und Veröffentlichung. In jeder Phase beschleunigt die KI die mechanische Arbeit; In jeder Phase hat ein menschlicher Kontrollpunkt das letzte Wort. Die ethische Überprüfung ist die erste Stufe, die Stammdatei ist geschützt, Fehler werden frühzeitig erkannt, damit sie sich nicht in der Kette weiter ausbreiten, und der Einsatz von KI wird ehrlich erklärt. Die Einsparungen entstehen nicht dadurch, dass die KI alles erledigt, sondern dadurch, dass der Mensch von mechanischer Arbeit befreit wird und sich auf die Verifizierung konzentriert. KI beschleunigt sich; Der Mensch sorgt für die Genauigkeit und Integrität der Geschichte.

Anwendungsaufgabe

Wählen Sie eine kleine Sammlung aus (10–20 Dokumente; Ihr eigenes Material oder ein Musterset). Erstellen Sie einen 7-stufigen Workflow mit der Vorlage „Projektstartplan“. Führen Sie mindestens zwei Dokumente durch diesen Ablauf: ethisches Scannen, Textextraktion, Metadaten und eine Musterebene. Überprüfen Sie jede Phase mit einer „Checkliste für den Phasenübergang“. Dokumentieren Sie abschließend Ihren Einsatz von KI mit der Vorlage „Projektabschluss und -erklärung“. Beachten Sie, welche Fehler an frühen Prüfpunkten erkannt wurden.

Checkliste

  • [ ] Ich habe in der ersten Phase die Ethik-/Datenschutzprüfung durchgeführt.
  • [ ] Ich habe die Masterdateien unberührt gelassen.
  • [ ] Ich habe in jeder Phase einen menschlichen Kontrollpunkt eingerichtet.
  • [ ] Ich habe kritische Fakten überprüft, bevor sie in der Kette weitergegeben wurden.
  • [ ] Ich habe den Einsatz von KI beim Projektabschluss erklärt.

Modulprüfung

1. Welche Positionierung ist für Künstliche Intelligenz in der Geschichts- und Archivierung am besten geeignet?

  • A) KI ist ein Zusammenfassungs-, Bearbeitungs- und Entwurfstool. Kommentar, Quellenkritik und Endverantwortung obliegen dem Experten ✔
  • B) Künstliche Intelligenz kann wie ein Historiker selbstständig über die Authentizität und Bedeutung des Dokuments entscheiden
  • C) Künstliche Intelligenz funktioniert nur bei der Übersetzung von Texten, sie hat nichts mit anderen Archivierungsaufgaben zu tun
  • D) Da künstliche Intelligenz immer unparteiischer ist als der Mensch, sollte ihr die historische Interpretation überlassen werden.

Beschreibung: Künstliche Intelligenz; Es handelt sich um einen Assistenten, der Texte bearbeitet, scannt, übersetzt und Entwürfe erstellt. Quellenkritik, Interpretation, Ursache-Wirkungs-Ermittlung und endgültige Entscheidung obliegen dem Sachverständigen; Eine nicht überprüfte Ausgabe kann zu einer gefälschten Quelle, einem falschen Datum oder einem Anachronismus führen.

2. Was ist die Halluzination, die künstliche Intelligenz in der Geschichtsforschung hervorruft?

  • A) Künstliche Intelligenz verarbeitet ein Dokument sehr langsam
  • B) Künstliche Intelligenz fabriziert eine nicht existierende Quelle, ein Zitat oder ein Ereignis als real ✔
  • C) Ein Dokument ist physisch beschädigt
  • D) Ein Archivkatalog ist nicht aktuell

Erklärung: Von einer Halluzination spricht man, wenn künstliche Intelligenz selbstbewusst Informationen, Quellen, Zitate oder Ereignisse fabriziert, die in Wirklichkeit nicht existieren. Obwohl seine Form perfekt erscheint, ist sein Inhalt nicht real; Daher muss in jedem Referenzkatalog jede Zitierung anhand der Originalquelle überprüft werden.

3. Was ist der beste Ansatz, um eine OCR-Ausgabe durch künstliche Intelligenz korrigieren zu lassen?

  • A) Bitten Sie den Text, flüssig und schön zu sein und die fehlenden Teile logisch zu ergänzen.
  • B) Ermöglichen, dass alle Zahlen und Daten kontextabhängig korrigiert werden
  • C) Bitten Sie ihn, nur optische Erkennungsfehler zu korrigieren, unleserliche Bereiche zu belassen [?] und Zahlen/Daten nicht zu ändern ✔
  • D) Bitten Sie den Schüler, die unleserlichen Wörter mit der wahrscheinlichsten Vermutung einzutragen.

Erläuterung: Die goldene Regel bei der OCR-Korrektur besteht darin, nur offensichtliche optische Erkennungsfehler (z. B. rn zu m, l zu 1) zu korrigieren; Den Inhalt des Textes nicht interpretieren oder vervollständigen. Nicht lesbare Bereiche sind mit [?] gekennzeichnet; Die Zahlen und Daten werden nicht verändert, sie werden anhand des Bildes überprüft.

4. Was sollte von der künstlichen Intelligenz verlangt werden, wenn es darum geht, ein Wort zu lesen, dessen Vokal nicht in einem osmanischen Text geschrieben ist?

  • A) Geben Sie einen einzigen, präzisen Messwert an und beschleunigen Sie so die Arbeit
  • B) Wählen Sie das Wort aus, dessen Bedeutung am fließendsten ist, und füllen Sie die Lücken aus
  • C) Vervollständigung der unleserlichen Teile aus seinem eigenen Allgemeinwissen.
  • D) Mögliche Lesealternativen anbieten und unklare Bereiche markieren, anstatt eine definitive Lesart aufzudrängen ✔

Erläuterung: Im osmanischen Türkisch werden kurze Vokale meist nicht geschrieben; Ein einziger Unterschied zwischen Vokal und Buchstabe (Abul und Kabul, Wali und Vali) verändert die Bedeutung völlig. Anstatt also eine endgültige Lesart vorzuschreiben, sollte nach möglichen Alternativen gefragt werden, unlesbare Bereiche sollten erhalten bleiben und die endgültige Entscheidung sollte dem Paläographen überlassen werden.

5. Was ist der effektivste Weg, Halluzinationen zu verhindern, wenn KI einen Metadatenentwurf (Katalogdatensatz) erstellen lässt?

  • A) Erteilen Sie ausdrücklich die Erlaubnis, dieses Feld leer zu lassen, wenn es nicht im Dokument enthalten ist ✔
  • B) Aufforderung, dass jedes Feld ausgefüllt und nicht unvollständig gelassen wird.
  • C) Schätzung eines Datums basierend auf dem Inhalt undatierter Dokumente
  • D) Ermöglichen, dass künstliche Intelligenz den Referenzcode generiert

Beschreibung: Der Ausfülldruck zwingt die KI dazu, das Dokument zu erstellen, indem sie das Datum oder den Ersteller errät, der nicht im Dokument enthalten ist. Der stärkste Schutz dagegen besteht darin, ausdrücklich die Erlaubnis zu erteilen, das Feld leer zu lassen, wenn es nicht im Dokument enthalten ist. Darüber hinaus werden Themenbegriffe einem kontrollierten Vokabular zugeordnet.

6. Wie sollte eine durch künstliche Intelligenz erstellte Dokumentenzusammenfassung in der historischen Forschung positioniert werden?

  • A) Als verlässlicher Beweis, der direkt zitiert werden kann
  • B) Als Entdeckungskarte, die Sie zum eigentlichen Dokument führt; Der Nachweis erfolgt anhand des Originaldokuments ✔
  • C) Als adäquate Ressource, die das Dokument selbst ersetzen kann
  • D) Als Text, der in der Studie verwendet werden kann, ohne jemals zum Dokument zurückkehren zu müssen

Beschreibung: Die Zusammenfassung ist eine Entdeckungskarte, kein Beweis. In diesem Dokument steht so etwas: Geht hin und schaut nach; Es wird nicht genau das gesagt, was im Dokument steht. Wenn ein Ereignis, ein Zitat oder Daten in die Studie aufgenommen werden sollen, müssen diese wörtlich aus dem Originaldokument übernommen werden.

7. Wie lassen sich Anachronismen bei der Übersetzung eines historischen Dokuments zur Veröffentlichung richtig vermeiden?

  • A) Ersetzen aller Periodenbegriffe durch das heutige nächstliegende Äquivalent
  • B) Den Text möglichst flüssig und modern vermitteln
  • C) Lassen Sie die Periodentitel und Institutionsnamen eindeutig und fügen Sie eine Erklärung hinzu ✔
  • D) Eigennamen an ihren aktuellen Gebrauch anpassen

Erläuterung: Anachronismus ist die falsche Übertragung von Elementen von einer Periode auf eine andere. Die Änderung von Periodentiteln, Institutionennamen und Personennamen an heutige Begriffe versetzt den Leser in eine Welt, die nicht zu dieser Epoche gehört. Der richtige Weg besteht darin, den Punktbegriff beizubehalten und daneben eine Erklärung hinzuzufügen.

8. Wie kann sichergestellt werden, dass eine durch künstliche Intelligenz vergebene Archivreferenz (Fondsname, Aktenzeichen) echt ist?

  • A) Der Referenz vertrauen, weil ihr Format korrekt erscheint
  • B) Indem Sie die KI erneut fragen, ob die Referenz korrekt ist
  • C) Akzeptieren Sie die Referenz als wahr, weil sie überzeugend und detailliert ist
  • D) Durch persönliches Auffinden und Überprüfen der Referenz im Archivkatalog oder einer zuverlässigen Quelle ✔

Beschreibung: Künstliche Intelligenz kann Referenzen erzeugen, die zwar formal perfekt sind, aber tatsächlich nicht existieren; Eine fiktive Referenz hat die gleiche Form wie eine reale Referenz. Der einzige Weg, die Existenz einer Referenz nachzuweisen, besteht darin, sie dort zu finden, wo sich die Originalquelle befindet (Archivkatalog, Bibliothek).

9. Wie soll ein bei der Musteranalyse (NER, Netzwerk, Timeline) mit künstlicher Intelligenz gefundenes Muster bewertet werden?

  • A) Als Hypothese, die im Dokument überprüft werden muss; Ausgangspunkt, nicht Ergebnis ✔
  • B) Als endgültige Feststellung, die keiner Überprüfung bedarf
  • C) Es handelt sich um eine unbestrittene objektive Tatsache, weil sie numerisch ist.
  • D) Als Ergebnis kann es direkt untersucht werden, weil es künstliche Intelligenz gefunden hat

Erläuterung: Jedes Muster ist eine Hypothese, kein Beweis. Entitäten sollten mit der Quelle verknüpft werden, unterschiedliche Schreibweisen (der gleichen Person/des gleichen Ortes) sollten mit Zustimmung des Menschen normalisiert werden, Zahlen sollten auf fehlende Daten und Stichprobenverzerrungen hin überprüft werden und undatierte Ereignisse sollten nicht chronologisiert werden.

10. Warum erfordert der Abschnitt zur biografischen/institutionellen Geschichte in einem Findbuch besondere Aufmerksamkeit?

  • A) Dieser Abschnitt ist unwichtig und kann ohne Überprüfung veröffentlicht werden
  • B) Da künstliche Intelligenz in diesem Abschnitt erfundene Ereignisse, falsche Daten und Titel hinzufügen kann, sollte sie sich nur auf verifizierte Quellen verlassen ✔
  • C) Künstliche Intelligenz kann sicher eingesetzt werden, da sie bei der Geschichtsschreibung keine Fehler macht.
  • D) Nur Forscher füllen diesen Abschnitt aus, der Archivar ist nicht interessiert

Beschreibung: Im Geschichtsteil schleichen sich Halluzinationen am häufigsten ein: Die KI kann nicht existierende Ereignisse, falsche Daten und erfundene Titel einfügen, während sie aus allgemeinen Informationen über eine Person oder Institution einen fließenden Text schreibt. Dieser Abschnitt sollte nur auf verifizierten Quellen basieren.

11. Wie soll künstliche Intelligenz die Faktenfrage eines Forschers in einem Referenz-(Beratungs-)Dienst beantworten?

  • A) Die Antwort auf die Frage sollte direkt und als eindeutige Tatsache gegeben werden.
  • B) Es muss ein glaubwürdiges Datum oder ein glaubwürdiger Name angegeben und dem Forscher mitgeteilt werden.
  • C) Anstatt Fakten direkt anzugeben, sollte der Forscher auf die relevante Sammlung und Quelle verwiesen werden ✔
  • D) Es sollte eine vollständige Antwort liefern, sodass der Forscher nicht zur Quelle gehen muss.

Erläuterung: Im Auskunftsdienst soll künstliche Intelligenz keine direkte Faktenantwort geben, sondern den Forscher zur Quelle leiten. Denn die direkte, sachliche Antwort der künstlichen Intelligenz kann erfunden sein und der Forscher könnte sie mit der Quelle verwechseln. Statt „Die Antwort ist diese“ sollte es lauten: „Schauen Sie sich diese Dokumente in dieser Sammlung an.“

12. Welche Vorgänge sind bei der Verarbeitung eines beschädigten Dokumentbilds mit künstlicher Intelligenz akzeptabel und unzulässig?

  • A) Alle Arten von Vorgängen sind kostenlos, einschließlich des Ausfüllens der fehlenden Teile.
  • B) Es sollten keine Maßnahmen ergriffen werden, das Bild sollte niemals berührt werden
  • C) Das Ausfüllen der fehlenden Abschnitte ist die wertvollste Maßnahme, da sie das Dokument vervollständigt.
  • D) Lesbarkeitsmanipulationen wie Kontrast/Rauschen sind akzeptabel; Es ist umständlich, die fehlenden Teile durch Vermutungen auszufüllen ✔

Erläuterung: Prozesse, die die Lesbarkeit verbessern (Kontrast, Beleuchtung, Rauschunterdrückung), sind akzeptabel, da sie den Inhalt nicht verändern; Das Ersetzen fehlender/unleserlicher Teile durch Vermutungen birgt jedoch das Risiko, etwas zu produzieren, was nicht im Dokument enthalten ist, d. h. eine historische Fälschung. Das Original bleibt erhalten, Transaktionen werden erfasst.

13. Was ist vor der Verarbeitung eines Archivdokuments mit sensiblen personenbezogenen Daten zu tun?

  • A) Datenschutzscan und Anonymisierung, falls erforderlich, oder Verwendung eines geschlossenen/zugelassenen Tools ✔
  • B) Das Dokument direkt in ein öffentliches Fahrzeug hochladen, ohne darüber nachzudenken
  • C) Ignorieren von Datenschutzbedenken aus Gründen der Effizienz
  • D) Überwindung von Zugangsbeschränkungen aus Effizienzgründen

Offenlegung: Das Hochladen von Dokumenten mit sensiblen Daten zur Identifizierung lebender Personen (Gesundheit, Religion, ethnische Zugehörigkeit, Adresse) in öffentliche, cloudbasierte Tools kann eine schwerwiegende Verletzung der Privatsphäre darstellen. Zuerst sollte eine Datenschutzprüfung durchgeführt werden, bei Bedarf sollte eine Anonymisierung oder ein geschlossenes/zugelassenes Tool verwendet werden.

14. Was ist der Hauptzweck eines menschlichen Kontrollpunkts in einem End-to-End-Archivierungsprojekt?

  • A) Verlangsamung der Arbeit der künstlichen Intelligenz und Verzögerung des Projekts
  • B) Um zu verhindern, dass ein Fehler (falsches Datum/Name) in einer Stufe auf alle nachfolgenden Stufen verkettet wird ✔
  • C) Steigerung der menschlichen Arbeitskraft und völliger Verzicht auf Automatisierung
  • D) Sicherstellen, dass die künstliche Intelligenz das letzte Wort hat

Beschreibung: Ein menschlicher Kontrollpunkt in jeder Phase stellt sicher, dass die Ausgabe der KI überprüft wird, bevor mit der nächsten Phase fortgefahren wird. Ohne dies würde sich ein Fehler in der ersten Phase (ein falsch gelesenes Datum) in der Kette über den Katalog, das Muster und den Leitfaden ausbreiten. Eine frühzeitige Überprüfung stellt sicher, dass der Fehler an einer Stelle behoben wird.

15. Was erfordern Transparenz und Authentizität beim Einsatz künstlicher Intelligenz in den Geistes- und Sozialwissenschaften?

  • A) Den Einsatz künstlicher Intelligenz geheim halten und sicherstellen, dass niemand davon erfährt
  • B) Jeden von künstlicher Intelligenz erstellten Text als seine eigene Originalidee darzustellen
  • C) Den Einsatz künstlicher Intelligenz ehrlich erklären und deren Ergebnisse nicht als eigene Originalarbeit darstellen ✔
  • D) Nur die Ergebnisse teilen, ohne die Methoden zu erklären

Beschreibung: Zur Transparenz gehört die Aufzeichnung, dass eine Transkription, Metadaten oder Übersetzung mit Hilfe künstlicher Intelligenz erstellt wurde; Originalität bedeutet, einen von künstlicher Intelligenz erzeugten Kommentar nicht als eigene Originalidee darzustellen. Dies ist für die Verifizierung durch nachfolgende Forscher und für die wissenschaftliche Integrität von wesentlicher Bedeutung.