Vienība 12 / 12

Pilnīgs projekts: arhīva kolekcijas apstrāde ar mākslīgo intelektu

Ieguvumi:

  • Spēja apstrādāt kolekciju 7 pakāpju darbplūsmā, sākot no ētiskas pārbaudes līdz publikācijai, katrā posmā izmantojot cilvēka kontrolpunktu
  • Izprotiet, kā agrīnie kontrolpunkti novērš kļūdas (nepareizs datums/nosaukums) izplatīšanos visā ķēdē
  • Spēja pielietot pamatfaila saglabāšanas principus, netaupot uz verifikācijas un deklarēt AI izmantošanu holistiskā projektā

Iepriekšējās nodaļās tika apgūtas individuālās prasmes: digitalizācija, transkripcija, metadati, skenēšana, tulkošana, pārbaude, modeļu analīze, izguve, saglabāšana un ētika. Šī pēdējā vienība apvieno to visu. Īstā arhīva projektā šīs darbības tiek veiktas nevis atsevišķi, bet gan kā savstarpēji saistīta darbplūsma. Šeit mēs redzēsim, kā soli pa solim un vadības ķēdē varat apstrādāt kolekciju no sākuma līdz beigām, izmantojot AI atbalstītu, bet cilvēka kontrolētu procesu.

Mērķis ir pozicionēt AI kā partneri, kas “paātrina katru soli, bet kuram nav galīgā vārda nevienā solī”. Kad pabeigsiet šo vienību, jums tiks atstāta holistiska metode, kas netīro dokumentu kaudzi pārvērš izpētei gatavā, pārbaudītā, ētiski tīrā kolekcijā.

Scenārijs: kas mums ir

Pieņemsim, ka saņemat 250 dokumentu kolekciju: daži drukāti (drukāta korespondence, sludinājumi), daži manuskripti (vēstules, piezīmju grāmatiņas), no dažādiem datumiem, daži satur sensitīvus personas datus. Mērķis: digitalizēt, pārrakstīt, kataloģizēt un padarīt šo kolekciju pieejamu pētniekiem. Sadalīsim procesu septiņos posmos.

Septiņu soļu darbplūsma

1. posms. Novērtējums un ētiskā pārbaude. Vispirms iepazīstieties ar kolekciju. Kādi dokumenti satur sensitīvus personas datus? Kāds ir autortiesību statuss? Vai pastāv kultūras jūtīgums? Šī skenēšana nosaka, kurus dokumentus var nodot mākoņa AI rīkiem un kuri tiks apstrādāti tikai slēgtā/apstiprinātā vidē. Ja šis posms tiek izlaists, viss projekts ir pakļauts ētiskam riskam.

2. posms — digitalizācija. Skenējiet dokumentus ar augstu izšķirtspēju (vismaz 300-400 DPI, labs kontrasts). Saglabājiet oriģinālos (galvenos) failus neskartus; Visa apstrāde tiks veikta uz kopijām.

3. posms — teksta izvilkšana. Izmantojiet OCR drukātiem dokumentiem un HTR manuskriptiem. Lieciet AI notīrīt neapstrādāto izvadi, izmantojot “drošas korektūras” instrukcijas — tikai optiskās/atpazīšanas kļūdas, bez satura komentāriem, nelasāmas vietas [?]. Alternatīva lasīšana un paleogrāfa kontrole Osmaņu/manuskriptam.

4. posms — metadati un kataloģizācija. Katram dokumentam ir jābūt standarta (Dublin Core/ISAD(G)) metadatiem; Ar atļauju no "neesošu lauku atstāt tukšu". Kartējiet tēmu terminus kontrolētajā sarakstā. Pārbaudiet datumus un vārdus ar dokumentāciju.

5. posms — bagātināšana un rakstīšana. Izņemiet entītijas (persona/vieta/organizācija), normalizējiet, izveidojiet attiecību un laika skalas kontūras. Pārbaudiet katru paraugu dokumentā; Nav izdomātu savienojumu un hronoloģijas.

6. posms — piekļuves rīkiem. Sagatavot atrašanas palīglīdzekļa aprakstu savākšanai; Vēstures sadaļu veidojiet tikai ar pārbaudītām piezīmēm. Skaidri atzīmējiet piekļuves ierobežojumus (privātums/autortiesības).

7. posms — pārbaude, deklarēšana un publicēšana. Pēdējo reizi pārbaudiet kritiskos laukus (datums, nosaukums, citāts, atsauce). Deklarējiet AI izmantošanu. Eksperts sniedz galīgo apstiprinājumu; Kolekcija tiek atvērta izpētei.

Padoms: katrā posmā ievietojiet "cilvēka kontrolpunktu": eksperts apstiprina AI rezultātu, pirms pāriet uz nākamo posmu. Bez šiem kontrolpunktiem kļūda pirmajā posmā (nepareizi nolasīts datums) izplatīsies visā ķēdē un galu galā nonāks katalogā, modelī un ceļvedī.

Vadības ķēdes galds

Skatuves

AI darbs

cilvēku kontrolpunkts

1. Ētiskā pārbaude

Sensitīvu datu marķēšana

Uzstādīšanas lēmums

2. Digitalizācija

(Attēla uzlabošana)

Kvalitāte, meistara aizsardzība

3. Teksta izvilkšana

OCR/HTR + droša korekcija

Vārda/datuma/lasīšanas pārbaude

4. Metadati

standarta projekts

Lauku apstiprināšana, terminu saskaņošana

5. Raksts

entītija, attiecības, laika skala

Validācija dokumentā

6. Piekļuves rīks

Palīdzības projekta atrašana

Vēsture un ierobežojumu apstiprināšana

7. Atbrīvot

Galīgā apstiprināšana, deklarācija

trīs mini futrāļi

1. gadījums — konstatēta ķēdes kļūda. Vienā projektā 3. posmā dokumenta datums bija "1868", nevis "1888". Ja 3. posma kontrolpunktā šī kļūda nebūtu konstatēta, datums būtu izkliedēts visā katalogā (4), laika skalā (5) un ceļvedī (6). Pateicoties kontrolpunktam, kļūda tika novērsta vienuviet. Nodarbība: agrīna pārbaude neļauj kļūdai izplatīties ķēdē.

2. gadījums — ētiskā pārbaude projektu saglabāja. 18 no 250 dokumentiem saturēja sensitīvus datus par dzīvām personām. Ētiskā pārbaude 1. fāzē tās atzīmēja ar karodziņu; šie 18 dokumenti tika apstrādāti slēgtā vidē, pārējie ar standarta rīkiem. Ja skenēšana tiktu izlaista un viss tiktu augšupielādēts mākonī, tas būtu bijis nopietns pārkāpums. Nodarbība: ētikas pārbaude ir pirmais solis, nevis vēlāk pievienots labojums.

3. gadījums — laiks un pūles. Izmantojot tradicionālo metodi, 250 dokumentu kolekcijas pilnīgai apstrādei būtu nepieciešami aptuveni 8-10 mēneši. Izmantojot mākslīgā intelekta atbalstīto kontrolpunktu darbplūsmu, process tika samazināts līdz aptuveni 3 mēnešiem. Taču ietaupījumus radīja nevis “AI darīja visu”, bet gan no “AI veica mehānisko darbu, koncentrējoties uz cilvēka pārbaudi”. Verifikācijai veltītais laiks nav samazinājies; Mehāniskajam darbam veltītais laiks ir samazinājies.

Četras kopējamas veidnes

1) Projekta sākotnējais plāns:

Man ir [numurs] dokumentu kolekcija: [drukas/manuskripta kombinācija], [periods], daži no tiem var saturēt sensitīvus datus. Izveidojiet 7 pakāpju darbplūsmas plānu, lai digitalizētu un kataloģizētu šo kolekciju: katrā posmā norādiet AI uzdevumu un CILVĒKU kontrolpunktu. Novietojiet ētikas pārbaudi pirmajā vietā.

2) Posma pārejas kontrolsaraksts:

Es pabeidzu posmu [skatuves vārds]. Izveidojiet kritisko punktu kontrolsarakstu, kas man jāpārbauda, ​​pirms pāriet uz nākamo posmu: kādi fakti (datums/nosaukums/atsauce) ir jāpārbauda, ​​kādas kļūdas var izplatīties ķēdē? Man ir galīgais apstiprinājums; Jūs man iedodat kontrolsarakstu.

3) Pilnīga kvalitātes kontrole:

Tālāk ir norādīti visi apstrādātā dokumenta slāņi: transkripcija, metadati, iegūtie līdzekļi. ATTĒLS NEKONCEPCIJAS starp slāņiem: vai datums transkripcijā sakrīt ar metadatiem, vai entītijas tiešām eksistē tekstā? Korekcijas uzlikšana; Izveidojiet neatbilstību sarakstu. Slāņi: [šeit]

4) Projekta slēgšana un deklarēšana:

Šajā kolekcijas projektā es izmantoju AI šādos posmos: [saraksts]. Projekta dokumentācijai: (1) kāds AI atbalsts tika izmantots kurā posmā, (2) kā tika veikta cilvēka pārbaude, (3) kādi ierobežojumi/ierobežojumi pastāv — uzrakstiet godīgu noslēguma piezīmi un AI lietošanas paziņojuma projektu, kurā tie ir iekļauti.

Vāja uzvedne / spēcīga uzvedne

Vāji:

Rūpīgi apstrādājiet šo kolekciju ar AI un sagatavojiet to izpētei.

Viena instrukcija “dari jebko” apiet ētisko pārbaudi, kontrolpunktus un verifikāciju; kļūdas izplatās visā ķēdē.

Spēcīgs:

Šai kolekcijai iestatiet 7 pakāpju darbplūsmu ar cilvēka kontrolpunktu katrā posmā. Lai 1. posms ir ētikas/privātuma pārbaude. AI radītā produkcija katrā posmā tiks pārbaudīta pirms pārejas uz nākamo posmu; atzīmējiet kritiskos faktus (datums/nosaukums/atsauce). Nevienā posmā AI nepiešķir galīgo vārdu.

Atšķirība: pakāpeniska struktūra, ētikas prioritāte, kontrolpunkti un princips “cilvēkiem ir galavārds” padara visu projektu drošu un aizsargājamu.

Biežas kļūdas

  • Atstājot ētisko skrīningu līdz galam. Privātuma/autortiesību skenēšana ir pirmais solis; Ja to pievieno vēlāk, pārkāpums jau ir noticis.
  • Apejot kontrolpunktus. Kļūda, kas paliek nepārbaudīta, izplatās visā ķēdē.
  • Netiek aizsargāts galvenais fails. Ja oriģināls netiek turēts neskarts, atgriešana kļūst neiespējama.
  • Ietaupījums uz verifikāciju. AI saīsina mehānisko darbu; Ja verifikācijas laiks tiek saīsināts, kvalitāte pasliktinās.
  • Nedeklarējot AI izmantošanu. Pārredzamība ir daļa no kolekcijas zinātniskās ticamības.

Rezumējot

Pilnīgs arhīva projekts apvieno individuālās prasmes kontroles ķēdē: ētiskā skenēšana, digitalizācija, teksta izvilkšana, metadati, modelis, izguves rīks un publicēšana. Katrā posmā AI paātrina mehānisko darbu; Katrā posmā galīgais vārds ir cilvēka kontrolpunktam. Ētiskā pārbaude ir pirmais posms, pamatfails tiek aizsargāts, kļūdas tiek konstatētas agri, lai tās netiktu izplatītas ķēdē, un AI izmantošana tiek paziņota godīgi. Ietaupījumi rodas nevis no AI, kas visu dara, bet gan no cilvēka atbrīvotā no mehāniskā darba un koncentrējoties uz verifikāciju. AI paātrina; Cilvēks nodrošina vēstures precizitāti un integritāti.

Lietojumprogrammas uzdevums

Izvēlieties nelielu kolekciju (10-20 dokumenti; savs materiāls vai paraugu komplekts). Izveidojiet 7 pakāpju darbplūsmu, izmantojot veidni "projekta palaišanas plāns". Palaidiet vismaz divus dokumentus šajā plūsmā: ētiskā skenēšana, teksta izvilkšana, metadati un raksta slānis. Pārbaudiet katru posmu, izmantojot “posma pārejas kontrolsarakstu”. Visbeidzot, dokumentējiet savu AI izmantošanu, izmantojot veidni “projekta slēgšana un paziņojums”. Ņemiet vērā, kuras kļūdas tika konstatētas agrīnajos kontrolpunktos.

kontrolsaraksts

  • [ ] Es veicu ētikas/privātuma pārbaudi pirmajā posmā.
  • [ ] Es saglabāju neskartus pamatfailus.
  • [ ] Katrā posmā es ievietoju cilvēka kontrolpunktu.
  • [ ] Es pārbaudīju kritiskos faktus, pirms tie tika izplatīti ķēdē.
  • [ ] Es paziņoju par AI izmantošanu projekta slēgšanas brīdī.

Moduļa eksāmens

1. Kāds ir vispiemērotākais mākslīgā intelekta novietojums vēsturē un arhivēšanā?

  • A) AI ir kopsavilkuma, rediģēšanas un projektēšanas rīks; Komentārs, avota kritika un galīgā atbildība ir ekspertam ✔
  • B) Mākslīgais intelekts, tāpat kā vēsturnieks, var pats izlemt par dokumenta autentiskumu un nozīmi
  • C) Mākslīgais intelekts darbojas tikai teksta tulkošanai, tam nav nekāda sakara ar citiem arhīva uzdevumiem
  • D) Tā kā mākslīgais intelekts vienmēr ir objektīvāks par cilvēkiem, vēsturiskā interpretācija ir jāatstāj tā ziņā.

Apraksts: Mākslīgais intelekts; Tas ir palīgs, kas rediģē, skenē, tulko un veido teksta melnrakstus. Avotu kritika, interpretācija, cēloņu-seku noteikšana un galīgais lēmums pieder ekspertam; Nepārbaudīta izvade var novest pie safabricēta avota, nepatiesa datuma vai anahronisma.

2. Kas ir mākslīgā intelekta radītās halucinācijas vēstures pētījumos?

  • A) Mākslīgais intelekts apstrādā dokumentu ļoti lēni
  • B) Mākslīgais intelekts izdomā neeksistējošu avotu, citātu vai notikumu kā īstu ✔
  • C) Dokuments ir fiziski bojāts
  • D) Arhīva katalogs nav atjaunināts

Paskaidrojums: Halucinācijas ir tad, kad mākslīgais intelekts pārliecinoši safabricē informāciju, avotus, citātus vai notikumus, kas patiesībā neeksistē. Lai gan tā forma šķiet perfekta, tās saturs nav īsts; Tāpēc katrā uzziņu katalogā katrs citāts ir jāpārbauda sākotnējā avotā.

3. Kāda ir labākā pieeja OCR izvadei, ko koriģē mākslīgais intelekts?

  • A) Lūgums tekstam būt raitam un skaistam un loģiski papildināt trūkstošās daļas.
  • B) Ļaujiet tai labot visus skaitļus un datumus, pamatojoties uz kontekstu
  • C) Lūdzot viņam labot tikai optiskās atpazīšanas kļūdas, atstājiet nelasāmus laukumus [?] un nemainiet skaitļus/datumus ✔
  • D) Lūdziet skolēnam aizpildīt nelasāmos vārdus ar visticamāko minējumu.

Paskaidrojums: OCR korekcijas zelta likums ir labot tikai acīmredzamas optiskās atpazīšanas kļūdas (piemēram, rn uz m, l uz 1); neinterpretējot vai nepabeidzot teksta saturu. Nelasāmās zonas ir atzīmētas ar [?]; Cipari un datumi netiek mainīti, tie tiek pārbaudīti ar attēlu.

4. Kas būtu jāprasa no mākslīgā intelekta, ja runa ir par tāda vārda lasīšanu, kura patskanis nav rakstīts Osmaņu tekstā?

  • A) Norādiet vienu, precīzu nolasījumu, tādējādi paātrinot darbu
  • B) Atlasīt vārdu, kas padarīs nozīmi raitāk, un aizpildiet tukšās vietas
  • C) Nelasāmo daļu aizpildīšana no savām vispārējām zināšanām.
  • D) Piedāvājot iespējamās lasīšanas alternatīvas un iezīmējot neskaidras vietas, nevis uzspiežot galīgo lasījumu ✔

Paskaidrojums: Osmaņu turku valodā īsie patskaņi lielākoties netiek rakstīti; Viena patskaņa/burtu atšķirība (abul un kabul, wali un vali) pilnībā maina nozīmi. Tāpēc tā vietā, lai uzspiestu galīgo lasījumu, ir jājautā iespējamās alternatīvas, jāsaglabā nesalasāmās vietas un gala lēmums jāatstāj paleogrāfa ziņā.

5. Kāds ir visefektīvākais veids, kā novērst halucinācijas, ja mākslīgais intelekts izstrādā metadatu (kataloga ierakstu) melnrakstu?

  • A) Skaidri piešķiriet atļauju atstāt šo lauku tukšu, ja tas nav iekļauts dokumentā ✔
  • B) Pieprasīt, lai katrs lauks tiktu aizpildīts un neatstātu nepilnīgu.
  • C) Datuma noteikšana, pamatojoties uz nedatētu dokumentu saturu
  • D) Ļauj mākslīgajam intelektam ģenerēt atsauces kodu

Apraksts: aizpildīšanas spiediens liek AI izveidot dokumentu, uzminot datumu vai veidotāju, kas nav dokumentā. Spēcīgākais vairogs pret to ir nepārprotami piešķirt atļauju atstāt lauku tukšu, ja tas nav dokumentā; Turklāt tēmu termini tiek kartēti kontrolētajā vārdu krājumā.

6. Kā mākslīgā intelekta radītais dokumenta kopsavilkums būtu pozicionējams vēstures pētījumos?

  • A) Kā uzticamu pierādījumu, ko var tieši citēt
  • B) Kā atklāšanas karti, kas novirza jūs uz faktisko dokumentu; Pierādījumi ņemti no dokumenta oriģināla ✔
  • C) Kā atbilstošs resurss, kas var aizstāt pašu dokumentu
  • D) Kā teksts, ko var izmantot pētījumā, nekad neatgriežoties pie dokumenta

Apraksts: kopsavilkums ir atklājumu karte, nevis pierādījums. Šajā dokumentā ir kaut kas līdzīgs šim, tur ir rakstīts, ka ej un paskaties; Tajā nav pateikts tieši tas, kas teikts dokumentā. Ja pētījumā ir jāiekļauj kāds notikums, citāts vai dati, tie burtiski jāņem no oriģinālā dokumenta.

7. Kāds ir pareizais veids, kā izvairīties no anahronismiem, tulkojot vēsturisku dokumentu publicēšanai?

  • A) Visu perioda terminu aizstāšana ar šodienas tuvāko ekvivalentu
  • B) Nodot tekstu pēc iespējas raitāk un mūsdienīgāk
  • C) Atstājiet periodu nosaukumus un iestāžu nosaukumus unikālus un pievienojiet skaidrojumu ✔
  • D) īpašvārdu pielāgošana to pašreizējam lietojumam

Paskaidrojums: Anahronisms ir nepareiza elementu pārnešana no viena perioda uz otru. Perioda nosaukumu, iestāžu nosaukumu un personvārdu maiņa pret mūsdienu terminiem lasītāju pārved uz pasauli, kas nepieder šim periodam. Pareizais veids ir saglabāt perioda terminu un pievienot tam blakus skaidrojumu.

8. Kā pārliecināties, ka mākslīgā intelekta dotā arhīva atsauce (fonda nosaukums, faila numurs) ir īsta?

  • A) Uzticieties atsaucei, jo tās formāts šķiet pareizs
  • B) vēlreiz jautājot AI, vai atsauce ir pareiza
  • C) Atsauces pieņemšana kā patiesa, jo tā ir pārliecinoša un detalizēta
  • D) Personīgi atrodot un pārbaudot atsauci arhīva katalogā vai uzticamā avotā ✔

Apraksts: mākslīgais intelekts var radīt atsauces, kas ir ideālas formas, bet patiesībā neeksistē; Fiktīva atsauce ir tādā pašā formā kā reāla atsauce. Vienīgais veids, kā pierādīt, ka atsauce pastāv, ir atrast to vietā, kur atrodas oriģinālais avots (arhīva katalogs, bibliotēka).

9. Kā būtu jānovērtē modelis, kas atrasts, veicot modeļu analīzi (NER, tīkls, laika skala) ar mākslīgo intelektu?

  • A) Kā hipotēze, kas jāpārbauda dokumentā; sākuma punkts, nevis rezultāts ✔
  • B) Kā galīgs konstatējums, kam nav nepieciešama pārbaude
  • C) Tas ir neapstrīdams objektīvs fakts, jo tas ir skaitlisks.
  • D) Rezultātā to var tieši pētīt, jo tika atrasts mākslīgais intelekts

Paskaidrojums: katrs modelis ir hipotēze, nevis pierādījums. Vienības ir jāsaista ar avotu, dažādas rakstības (vienas un tās pašas personas/vietas) ir jānormalizē ar cilvēka apstiprinājumu, jāapšauba skaitļi, lai uzzinātu trūkstošos datus un izlases novirzes, un nedatētus notikumus nevajadzētu hronoloģizēt.

10. Kāpēc atrašanas palīglīdzeklī ir jāpievērš īpaša uzmanība biogrāfiskajai/institucionālajai vēsturei?

  • A) Šī sadaļa nav svarīga, un to var publicēt bez pārbaudes
  • B) Tā kā mākslīgais intelekts šajā sadaļā var pievienot izdomātus notikumus, viltus datumus un nosaukumus, tam vajadzētu paļauties tikai uz pārbaudītiem avotiem ✔
  • C) Mākslīgo intelektu var izmantot droši, jo tas nepieļauj nekādas kļūdas vēstures rakstīšanā.
  • D) Šo sadaļu aizpilda tikai pētnieki, arhivāru tas neinteresē

Apraksts: Vēstures sadaļa ir vieta, kur visbiežāk iezogas halucinācijas: mākslīgais intelekts var ievietot neesošus notikumus, viltus datumus un izdomātus nosaukumus, rakstot tekošu tekstu no vispārīgas informācijas par personu vai iestādi. Šai sadaļai jābūt balstītai tikai uz pārbaudītiem avotiem.

11. Kā mākslīgajam intelektam jāatbild uz pētnieka faktu jautājumu uzziņu (konsultāciju) dienestā?

  • A) Atbilde uz jautājumu ir jāsniedz tieši un kā noteikts fakts.
  • B) Jāuzrāda ticams datums vai vārds un jāpaziņo pētniekam.
  • C) Tā vietā, lai tieši sniegtu faktus, pētnieks jānovirza uz attiecīgo krājumu un avotu ✔
  • D) Tam jāsniedz pilnīga atbilde, lai pētniekam nebūtu jādodas uz avotu.

Paskaidrojums: Uzziņu dienestā mākslīgajam intelektam nevajadzētu sniegt tiešu faktu atbildi, bet gan jānovirza pētnieks pie avota. Jo mākslīgā intelekta sniegtā tiešā faktiskā atbilde var būt izdomāta un pētnieks to var sajaukt ar avotu. Tā vietā, lai teiktu "Atbilde ir šī", vajadzētu teikt: "Paskatieties uz šiem dokumentiem šajā krājumā".

12. Kuras darbības ir pieņemamas un nevēlamas, apstrādājot bojātu dokumenta attēlu ar mākslīgo intelektu?

  • A) Visu veidu darbības ir bezmaksas, ieskaitot trūkstošo daļu aizpildīšanu.
  • B) Nedrīkst veikt nekādas darbības, attēlu nekādā gadījumā nedrīkst pieskarties
  • C) Trūkstošo sadaļu aizpildīšana ir visvērtīgākā darbība, jo tā pabeidz dokumentu.
  • D) Lasāmības manipulācijas, piemēram, kontrasts/troksnis, ir pieņemamas; Ir neērti aizpildīt trūkstošās daļas ar minējumiem ✔

Paskaidrojums: Procesi, kas uzlabo lasāmību (kontrasts, apgaismojums, trokšņu samazināšana), ir pieņemami, jo tie nemaina saturu; Tomēr trūkstošo/nelasāmo daļu aizpildīšana ar minējumiem rada risku radīt to, kas dokumentā nav, tas ir, vēsturisku viltojumu. Oriģināls tiek saglabāts, darījumi tiek reģistrēti.

13. Kas jādara, pirms tiek apstrādāts arhīva dokuments, kurā ir sensitīvi personas dati?

  • A) Privātuma skenēšana un anonimizācija, ja nepieciešams, vai izmantojot slēgtu/apstiprinātu rīku ✔
  • B) Dokumenta augšupielāde tieši sabiedriskajā transportlīdzeklī, pat nedomājot par to
  • C) Ignorēt privātuma apsvērumus par efektivitāti
  • D) Piekļuves ierobežojumu pārvarēšana efektivitātes nolūkos

Informācijas atklāšana. Dokumentu, kuros ietverti sensitīvi dati, kas identificē dzīvas personas (veselība, reliģija, etniskā izcelsme, adrese), augšupielāde publiskos mākoņdatošanas rīkos var būt nopietns privātuma pārkāpums. Vispirms ir jāveic privātuma pārbaude, ja nepieciešams, jāizmanto anonimizācija vai slēgts/apstiprināts rīks.

14. Kāds ir cilvēka kontrolpunkta galvenais mērķis pilna arhīva projektā?

  • A) Mākslīgā intelekta darba palēnināšana un projekta aizkavēšana
  • B) Lai vienā posmā kļūda (nepareizs datums/nosaukums) netiktu piesaistīta visiem nākamajiem posmiem ✔
  • C) Cilvēka darbaspēka palielināšana un pilnīga atteikšanās no automatizācijas
  • D) Nodrošināt, ka mākslīgajam intelektam ir pēdējais vārds

Apraksts: cilvēka kontrolpunkts katrā posmā nodrošina, ka AI izvade tiek pārbaudīta pirms pāriešanas uz nākamo posmu. Bez tam kļūda pirmajā posmā (kļūdaini nolasīts datums) izplatītos pa ķēdi uz augšu caur katalogu, modeli un ceļvedi. Agrīna pārbaude nodrošina, ka kļūda tiek labota vienuviet.

15. Ko prasa caurspīdīgums un autentiskums mākslīgā intelekta izmantošanā humanitārajās un sociālajās zinātnēs?

  • A) mākslīgā intelekta izmantošanas noslēpums, nodrošinot, ka neviens to nezina
  • B) Katru mākslīgā intelekta radīto tekstu pasniegt kā savu sākotnējo ideju
  • C) Godīgi deklarēt mākslīgā intelekta izmantošanu un neparādīt tā produkciju kā savu oriģināldarbu ✔
  • D) Dalīties tikai ar rezultātiem, nepaskaidrojot metodes

Apraksts. Pārredzamība ietver reģistrēšanu, ka transkripcija, metadati vai tulkojums ir izveidots ar mākslīgā intelekta palīdzību; Oriģinalitāte prasa, lai mākslīgā intelekta radīts komentārs netiek pasniegts kā sava sākotnējā ideja. Tas ir būtiski, lai nākamie pētnieki veiktu pārbaudi un nodrošinātu akadēmisko integritāti.