Eenheid 7 / 11

Literatuuronderzoek, bronverificatie en het bestrijden van hallucinaties

Winst:

  • Mogelijkheid om kunstmatige intelligentie te gebruiken om echte bronnen samen te vatten en te vergelijken, waardoor de basis voor verzonnen toeschrijving met de beperking 'alleen gebaseerd op de gegeven bron' wordt geëlimineerd
  • Mogelijkheid om de discipline toe te passen van het verifiëren van elke citatie in de daadwerkelijke catalogus, het verifiëren van elke samenvatting tot aan de bron en het opvangen van DOI/imprint-hallucinaties
  • In staat zijn te begrijpen hoe actualiteit, meertaligheid en grijze literatuur de grenzen van de kennis van kunstmatige intelligentie bepalen en waarom origineel schrijven vereist is.

Archeologie en cultureel erfgoed is een cumulatieve wetenschap: elke nieuwe studie bouwt voort op eerdere publicaties over eeuwen heen. Het scannen van de literatuur (het geheel van artikelen, boeken, rapporten en scripties die over dat onderwerp zijn gepubliceerd) van een regio, een soort vondst of een periode is de eerste en meest vermoeiende stap van elk wetenschappelijk onderzoek. In deze unit zullen we diepgaand zien hoe AI het literatuuronderzoek versnelt, maar waarom bronverificatie van het grootste belang is op dit gebied en hoe we de gevaarlijkste fout van AI kunnen bestrijden: hallucinatie (verzonnen bronnen, citaten en informatie).

Basisprincipe: AI helpt de literatuur samen te vatten, te vergelijken en te ordenen; Maar geen enkel citaat kan zonder bevestiging in een echte catalogus worden gebruikt, en geen enkele samenvatting kan in een wetenschappelijke claim veranderen zonder de bron zelf te lezen. In de geesteswetenschappen vernietigt één valse bron de geloofwaardigheid van het hele werk.

Waarom is hallucinatie zo cruciaal op dit gebied?

De meest voorkomende fout bij openbare chattools is het produceren van academische bronnen die niet bestaan, maar wel erg realistisch lijken. De AI kan een ‘perfect’ uitziende citatie verzinnen door de naam van een echte auteur, de naam van een echt tijdschrift en een plausibele titel te combineren. Van waar?

  • AI produceert het “volgende meest waarschijnlijke woord”; er wordt niet naar een daadwerkelijke database gekeken (tenzij er een speciaal hulpmiddel is aangesloten).
  • Omdat academische citaten een patroon hebben, is AI erg ‘goed’ in het creëren van een citatie die in het patroon past, maar waarvan de inhoud verzonnen is.
  • In de geesteswetenschappen checkt de lezer vaak niet meteen de bron; Hierdoor kan de valse toeschrijving onopgemerkt live gaan.

Conclusie: voor een archeoloog moet elk triplet auteur-jaar-titel in de AI-uitvoer als verdacht worden beschouwd totdat het tegendeel is bewezen.

Tip: Gebruik AI niet als ‘hulpbronnenzoeker’, maar als assistent die ‘de echte hulpbronnen die u heeft, verwerkt’. Zoek zelf de artikelen zelf, geef de pdf's aan de AI en zeg vervolgens "vertrouw gewoon op de teksten die ik je heb gegeven". Zo wordt de basis voor hallucinatie grotendeels geëlimineerd.

Stappen van literatuuronderzoek

  1. Reikwijdte en vraag. Waar bent u naar op zoek? Verduidelijk onderwerp-, periode-, regio- en taalgrenzen.
  2. Verzameling van echte hulpbronnen. Vind authentieke publicaties uit bibliotheekcatalogi, institutionele databases en vertrouwde directory's. Het is riskant om in deze stap middelen voor de AI te ‘vinden’.
  3. Samenvatten en in kaart brengen. Geef de daadwerkelijke teksten die je hebt verzameld aan AI om thema’s en discussies samen te vatten en in kaart te brengen.
  4. Vergelijking en gap-analyse. Vergelijk de standpunten van verschillende auteurs, vind tegenstrijdigheden en onontdekte hiaten.
  5. Spelling en toeschrijving. Schrijf je eigen argument met geverifieerde citaten. AI geeft tocht; je herschrijft met je analyse en daadwerkelijke citaten.

Bronverificatiediscipline

Controleer voor elke citatie:

  • Is dat zo? Staan de auteur, jaartal, titel, tijdschrift/uitgever in een echte catalogus (bibliotheek, DOI, index)?
  • Zegt hij wat hij zegt? Zegt de bron echt wat de AI beweert? Open de bron en lees het relevante gedeelte.
  • Klopt de context? Is het citaat ontleend aan de bedoeling van de auteur? Wordt het tegenovergestelde standpunt toegeschreven aan de auteur?
  • Is het actueel en betrouwbaar? Is de publicatie peer-reviewed, actueel of weerspiegelt deze een achterhaalde visie?
Let op: het feit dat een door AI verstrekt DOI- of inventarisnummer in het "juiste formaat" verschijnt, betekent niet dat dat record bestaat. Zoek het nummer in het echte systeem. Een niet-bestaande DOI is een van de meest voorkomende tekenen van hallucinaties.

drie minikoffers

Geval 1 — Samenvatting heeft tijd bespaard. Een promovendus gaf 60 echte artikelen (die hij allemaal vond en downloadde) aan AI en maakte een themakaart; Hij stelde een tabel op waarin hij de mening van verschillende auteurs over een vondsttype in twee dagen in plaats van weken met elkaar vergeleek. Elke samenvatting is verzameld en geverifieerd.

Geval 2 — Een ramp met neplassen is afgewend. Een afgestudeerde student vroeg AI om "bronnen over dit onderwerp voor te stellen" en kreeg een handige lijst van vijftien citaten. Toen hij het in de bibliotheek controleerde, ontdekte hij dat negen van de lijst nooit bestonden: echte auteurs, verzonnen titels. Als deze lijst zou worden opgenomen in de bibliografie van het proefschrift, zou de geloofwaardigheid van de verdediging instorten en zou het zelfs als wetenschappelijk wangedrag kunnen worden beschouwd.

Geval 3 — Onjuiste toeschrijving gecorrigeerd. Eén team zou melden dat de AI tegen een schrijver zei "dat hij die plek in de Romeinse tijd dateerde"; Toen we ons tot de bron wendden, zagen we dat de auteur het tegenovergestelde beweerde: dat de site pre-Romeins was. AI had het beeld omgekeerd. Het lezen van de bron voorkwam een ​​ernstige fout.

Vier kopieerbare sjablonen

1) Enkel gebaseerd op de gegeven bron:

Jouw rol: literatuuroverzichtassistent. Vertrouw ALLEEN op de teksten die ik hieronder zal plakken. VOEG GEEN informatie, bronnen of verwijzingen toe van buiten deze teksten. Schrijf elk van uw beweringen op en geef aan op welk deel van de tekst die ik u heb gegeven, is gebaseerd. Als je wordt gevraagd naar iets dat niet in de tekst staat, zeg dan 'het staat niet in de gegeven bronnen'.

2) Themakaart en vergelijking:

Hieronder geef ik samenvattingen van [N] bronnen. Groepeer ze per thema en maak een vergelijkingstabel: voor elk thema, welke auteurs wat zeggen, waar ze het mee eens zijn, waar ze tegenspreken. Gebruik alleen de opvattingen in de teksten die ik heb gegeven; commentaar toevoegen.

3) Controlelijst voor citatieverificatie:

Wanneer u de onderstaande citatielijst VERIFICEERT, voer dan de stappen uit die ik voor elke citatie moet controleren (zoeken in de catalogus, DOI-bevestiging, lees de relevante pagina, contextcontrole). U BEVESTIGT NIET de juistheid van de toeschrijvingen; vertel me wat ik moet controleren. Bronvervaardiging.

4) Gap-analyse:

Op basis van de door mij verstrekte literatuuroverzichten kunt u vragen/lacunes opsommen die over dit onderwerp onvoldoende onderzocht lijken te zijn. Laat voor elke leemte zien welke bron deze open heeft gelaten. Vertrouw alleen op de teksten die ik je heb gegeven; Speculeer niet.

Zwakke prompt/sterke prompt

Zwakke prompt:

Geef de 15 belangrijkste wetenschappelijke bronnen over dit onderwerp en hun samenvattingen.

De AI produceert een realistische maar waarschijnlijk gedeeltelijk verzonnen lijst zonder naar een echte database te kijken; Dit is de valse attributieval zelf.

Krachtige prompt:

Hieronder plak ik de volledige citaten en samenvattingen van de 12 echte artikelen die ik heb gevonden. ALLEEN op basis hiervan ontstaat een themakaart en een vergelijkingstabel. VOEG nieuwe bron toe. Geef aan uit welk artikel elke regel komt. Markeer ontbrekende onderwerpen als 'niet behandeld in deze bronnenset'.

Het verschil: de eerste is beladen met het risico van verzonnen bronnen; de laatste gaat betrouwbaar om met echte hulpbronnen.

Actualiteit, taal en grijze literatuur

Drie kenmerken van de archeologische literatuur maken het gebruik van AI bijzonder riskant. De eerste is de actualiteit: de kennis van een model is op een bepaalde datum bevroren en opgravingen, nieuwe dateringen en correcties na die datum ontbreken daarin. AI kan een achterhaalde visie als nog steeds geldig presenteren; Daarom moet u actuele publicaties scannen. Ten tweede, meertaligheid: archeologie wordt geschreven in het Duits, Frans, Italiaans, Turks en in veel andere lokale talen dan het Engels. Een belangrijk opgravingsrapport kan in slechts één taal zijn gepubliceerd; Alleen vertrouwen op Engelstalige bronnen betekent dat je een groot deel van de literatuur mist. AI helpt bij het scannen van deze bronnen in vreemde talen, maar nogmaals, je moet de daadwerkelijke bron bij de hand hebben.

Ten derde, de grijze literatuur: het overgrote deel van de archeologische kennis ligt in documenten die niet in officiële tijdschriften verschijnen, zoals commerciële opgravingsrapporten, institutionele archieven en ongepubliceerde proefschriften. Grijze literatuur (rapporten geproduceerd in commerciële of bedrijfskanalen die niet direct beschikbaar zijn in traditionele publicatiegidsen) is afwezig of schaars in AI-trainingsgegevens; Daarom kent de AI deze informatie niet, of verzint ze deze. Het echte archeologische verhaal van een regio staat vaak in deze grijze literatuur, en je kunt het alleen bereiken met de echte hand uit de institutionele archieven.

Tip: Zeggen "AI kon niets vinden" of "er zijn weinig bronnen" over een onderwerp betekent niet dat er weinig werk aan dat onderwerp is; Vaak staat de bron in de grijze literatuur, in een vreemde taal of na het informatiegedeelte van het model. Vraag het echte archief naar het gebrek aan middelen, niet de AI.

Literatuur takentabel

Zoektocht

Rol van AI

menselijke beslissing

verificatie

inkoop

Zwak/in gevaar

Selectie uit echte catalogus

Catalogusbevestiging

samenvattend

Sterk (naar gegeven tekst)

nauwkeurigheid, keuze

Lees de bron

Vergelijking

Thema/tegenstrijdigheidskaart

Commentaar, gewicht

broncontext

Citaat schrijven

formaat overzicht

inhoud, nauwkeurigheid

Is er/zegt het

Gap-analyse

Vragen van kandidaten

Onderzoekswaarde

Domeinkennis

Veel voorkomende fouten

  • De AI bronnen laten "vinden". Produceert valse attributie; Zoek zelf de hulpmiddelen.
  • Vertrouwend op het DOI/imprint-formaat. Hoewel het formaat correct lijkt, kan het record verzonnen zijn; Zoek in het systeem.
  • De samenvatting gebruiken zonder de bron te lezen. AI kan de mening van de auteur omkeren.
  • Het publiceren van de AI-tekst zoals deze is. Originaliteit en risico op plagiaat; Schrijf met uw eigen analyse.
  • Het niet plaatsen van de beperking "alleen gegeven bron". Zonder beperkingen voegt AI extern verzonnen informatie toe.

Samengevat

Bij literatuuronderzoek bespaart AI veel tijd bij het samenvatten, vergelijken en analyseren van feitelijke bronnen. Maar in de geesteswetenschappen is bronverificatie niet onderhandelbaar: zoek zelf de bronnen, verifieer elke citatie in de eigenlijke catalogus, controleer elke samenvatting achteraf, leg de beperking 'alleen geciteerde bron' op en schrijf de uiteindelijke tekst met je eigen originele analyse. Een valse bron zal je werk vernietigen.

Applicatie taak

Kies een onderwerp, vind 8-10 echte publicaties in de bibliotheek/index en verzamel hun citaten. Maak een vergelijkingstabel met de sjablonen 'Alleen gebaseerd op bron' en 'Themakaart'. In een afzonderlijk experiment vertel je de AI om "een bron voor te stellen" (zonder enige beperking) en controleer je de citaten die het suggereert één voor één in de catalogus en noteer hoeveel er echt zijn.

controlelijst

  • [ ] De bronnen heb ik zelf uit echte catalogi gehaald.
  • [ ] Ik heb de beperking "alleen vertrouwen op de gegeven bron" op de AI gelegd.
  • [ ] Ik heb elke citatie bevestigd met de catalogus/DOI.
  • [ ] Elke samenvatting heb ik geverifieerd door terug te gaan naar de bron.
  • [ ] Ik schreef de uiteindelijke tekst met mijn eigen originele analyse en bevestigde referenties.