Jednotka 5 / 12

Skenování, zjišťování a sumarizace zdrojů

zisky:

  • Schopnost urychlit zjišťování skenováním velkých hromad dokumentů pomocí umělé inteligence, odstraněním a shrnutím toho, co je relevantní
  • Pochopte, že shrnutí je mapa objevů, nikoli důkaz, a umět propojit každý důležitý bod a citaci zpět k původnímu dokumentu.
  • Schopnost skenovat případy a kontrolovat eliminaci pomocí vzorků, aniž by umělá inteligence produkovala výsledky/komentáře

Jedním z největších úzkých míst v historickém výzkumu je nalezení „toho, co funguje“ v obrovské hromadě materiálu. Výzkumník možná bude muset naskenovat stovky dokumentů, svazky novin, rejstříky nebo soubory korespondence kvůli práci nebo článku. Tento úkol kontroly zdrojů tradičně vyžaduje čtení stránku po stránce a může trvat týdny. Umělá inteligence otevírá toto úzké hrdlo tím, že rychle skenuje a shrnuje velké kusy textu a označuje relevantní místa. Ale i zde je nebezpečí jasné: shrnutí AI nenahrazuje zdroj; je to pouze mapa, která vás nasměruje ke skutečnému zdroji.

V této jednotce se naučíte, jak skenovat rozsáhlý historický materiál pomocí AI, vytvářet spolehlivá shrnutí, najít relevantní pasáže a vyhnout se nejnebezpečnějšímu úskalu synopse: „důvěřovat synopsi, aniž byste museli jít ke zdroji“. Cílem je využít AI pro rychlost a přitom nikdy obětovat přesnost; Při dobrém použití tyto dva cíle nejsou v rozporu, ale spíše se navzájem vyživují.

Souhrn nenahrazuje zdroj

Pojďme si od začátku popsat základní princip: AI ​​brief je nástroj pro objevování, nikoli důkaz. Pokud se historik chystá do své studie zahrnout událost, citát nebo údaj, musí je převzít z původního dokumentu, nikoli ze shrnutí AI. Shrnutí říká: "v tomto dokumentu je něco takového, podívejte se na to"; Neříká „přesně to stojí v dokumentu“. Protože souhrnný proces komprimuje, vybírá, někdy zkresluje a někdy přidává něco, co vůbec neexistuje.

Umělou inteligenci můžete použít ve třech výkonných úlohách při skenování:

  1. Skenujte a prosévejte: Rychle označte mezi stovkami dokumentů, které jsou relevantní pro vaše téma.
  2. Shrnutí: Nastínění obrysů, osob a témat dlouhého dokumentu.
  3. Vyhledání pasáže: Označení otázky „Kde jsou místa, kde se o tomto tématu mluví“ v dokumentu.

Ve všech třech je výstupem "přesměrování"; Důkazy jsou převzaty z původního dokumentu.

Přehlíženým nebezpečím je zde limit kontextového okna AI – množství textu, které model dokáže zpracovat najednou. Když dáte velmi velký stoh dokumentů najednou, AI ​​může „zapomenout“ nebo prolistovat střední části; má tendenci klást důraz na to, co se děje na začátku a na konci. Namísto vměstnání stovek dokumentů do jediné žádosti je tedy jejich rozdělení do logických skupin a skenování každé skupiny zvlášť poskytuje spolehlivější výsledky. Kromě toho je kontrola vzorků nezbytná k rozlišení, zda dokument, který AI „nikdy nezmiňuje“, je skutečně irelevantní nebo vynechaný.

Pracovní postup: krok za krokem

1. Ujasněte si výzkumnou otázku. Jasná otázka spíše než vágní „shrňte mi to“: „Kde jsou místa v těchto 40 dokumentech, která zmiňují spor o vodní práva?“

2. Připravte si ingredience. Upravte texty, které chcete skenovat (přepis nebo výstup OCR). Ke každému dílu připojte název/odkaz zdroje, aby bylo možné propojit shrnutí se zdrojem.

3. Zadejte pokyny pro skenování/souhrn. Požádejte AI, aby se spoléhala pouze na text, který poskytnete, aby propojila každý nárok se zdrojem (dokumentem/stránkou) a nepřidala nic, co neexistuje.

4. Propojte shrnutí zpět se zdrojem. Najděte a ověřte v původním dokumentu každý důležitý bod označený souhrnem. Vezměte citace z dokumentu doslovně.

5. Otázky mezery a zaujatost. Co mohla AI vynechat? Zdůraznil jen to, co je zřejmé? Vybral ten, který odpovídá vaší otázce, a skryl opak?

Upozornění: Při generování souhrnu může umělá inteligence přidat odkaz nebo výsledek, který není v dokumentu, protože to „vypadá logicky“. Zejména "jaký závěr lze z těchto dokumentů vyvodit?" Otázky, jako jsou tyto, vyzývají AI, aby vytvářela interpretace a závěry. Udržujte souhrnnou žádost věcnou; komentář si nechte pro sebe.

Skenování úloh s tabulkou

Quest

Příspěvek AI

Riziko

ověření

Odstraňte příslušný dokument

rychlost

Přeskočit relevantní

kontrola vzorku

Shrnutí dokumentu

obrys

Pokřivit/přidat

Porovnej se zdrojem

Hledání pasáže/citátu

záložkování

špatné umístění

najít v dokumentu

Srovnávací shrnutí

vzorové značení

montážní odkaz

Potvrďte každý nárok

Citování

návrh

substituce slov

slovo od slova

Shrnutí: AI ukazuje, kde se nachází; Skutečný dokument říká, co se stalo.

tři mini pouzdra

Případ 1 – 300 dokumentů zkráceno na 2 dny. Výzkumník studoval spor města v letech 1900-1920 o vodní práva. Ruční skenování série 300 dokumentů by zabralo týdny. AI označila každý dokument jako „souvisí s vodními právy“; 42 ze 300 dokumentů se ukázalo jako relevantních. Výzkumník četl pouze těchto 42 do hloubky. Ale také zkontroloval 20 z 258 dokumentů označených jako irelevantní jako vzorek; Zjistil jsem, že 2 spolu skutečně souvisí, a opravil to. Poučení: eliminace se zrychluje, ale musí být kontrolována vzorkem.

Případ 2 – Falešný výsledek. Student požádal YZ, aby shrnul 15 dokumentů a požádal o „závěr z těchto dokumentů“. AI napsala vztah příčiny a následku, který v dokumentech neexistoval, jako „výsledek“ v plynulém jazyce. Když si student prošel dokumenty, viděl, že takový závěr nemá oporu v žádném dokumentu. Lekce: nenechte AI produkovat interpretaci a závěr; Proveďte sken případu a vy rozhodnete o výsledcích.

Případ 3 – Upravená nabídka. Autor by do svého článku vložil „citát“ z abstraktu AI. Když to porovnal s dokumentem, všiml si, že AI zjednodušila větu a změnila několik slov. Citát již nebyl úplně stejný, jako byl napsán v dokumentu. Lekce: každý citát je převzat doslovně z dokumentu, nikoli z abstraktu.

Čtyři kopírovatelné šablony

1) Skenování závislé na zdroji:

Níže jsou uvedeny části dokumentu, z nichž každá je označena svým odkazem. Moje výzkumná otázka: [otázka]. U každého dokumentu jednoduše označte „relevantní/irelevantní/nejistý“ a případně uveďte, pro kterou větu/pasáž se týká, a odkaz na dokument. Přidávání komentářů, vyvozování závěrů. Dokumentace: [zde]

2) Věrné shrnutí:

Shrňte dokument níže. Pravidla: (1) Pište jen to, co je v textu, NEPŘIDÁVEJTE závěry/komentáře/závěry. (2) Propojte každý důležitý bod s jeho místem (odstavcem/stránkou) v dokumentu. (3) Pokud potřebujete citovat, dejte to slovo od slova, neměňte to. (4) Napište „nespecifikované“ informace, které nejsou v textu. Dokument: [zde]

3) Vyhledávač průchodů:

VŠECHNY zmínky o tomto tématu najdete v textu níže: [téma]. U každého uveďte stručnou nabídku (doslovně) a její umístění. Přidávání míst, která nezahrnují téma. Označte shodu, kterou si nejste jisti, jako [nejasné]. Text: [zde]

4) Srovnávací případová studie:

Níže jsou dva/tři dokumenty. Uveďte, CO každý dokument říká na toto téma [téma], samostatně, s jeho zdrojem. VYTVOŘENÍ „závěru“ nebo „celkového hodnocení“ mezi dokumenty; Stačí dát každému dokumentu jeho vlastní prohlášení jako fakt. Dokumentace: [zde]

Slabá výzva / Silná výzva

slabé:

Přečtěte si tyto dokumenty a shrňte, co mi říkají o tématu, výsledcích a jejich důležitosti.

Chtít „následky“ a „významnost“ tlačí AI k odklonu od skutečnosti a vymýšlení interpretací a souvislostí; Nepřipojuje se ani ke zdroji.

Silný:

Vyjmenujte fakta o [téma] v následujících dokumentech, přičemž každý uveďte odkaz na dokument. PŘIDEJTE komentář, závěr nebo hodnocení důležitosti. Dejte uvozovky slovo od slova. Není-li téma v dokumentu uvedeno, napište „není uvedeno“. Dokumentace: [zde]

Rozdíl: věrnost faktu, odkaz na zdroj, zákaz interpretace a doslovná citace proměňují shrnutí ve spolehlivou mapu objevů.

Časté chyby

  • Záměna shrnutí za důkaz. Souhrn vede; Důkazy jsou převzaty z původního dokumentu.
  • Říkat AI, aby „vyvodila závěry“. Výklad a příčina a následek jsou prací historika; AI skenuje případy.
  • Přebírání citátu z abstraktu. AI zjednodušuje/nahrazuje uvozovky; Každá citace je doslovně převzata z dokumentu.
  • Vůbec nedohlíží na eliminaci. Pokud nejsou označeny jako „irelevantní“ porovnány se vzorkem, důležité dokumenty budou chybět.
  • Nežádá o mezery. Je třeba si položit otázku, co AI opomíjí a co zkresluje.

V souhrnu

Skenování a sumarizace zdrojů je jednou z oblastí, kde umělá inteligence šetří při historickém výzkumu nejvíce času: prohledává stovky dokumentů, shrnuje je a označuje relevantní pasáže. Ale shrnutí je mapa objevů, nikoli důkazy. Propojte každý klíčový bod zpět s původním dokumentem, vezměte doslovné citace z dokumentu, nenechte AI vytvářet závěry a interpretace, kontrolujte eliminaci vzorkováním a ptejte se, co AI vynechala. AI vás zavede na správnou stránku; Vaším úkolem je si tu stránku přečíst a dát jí smysl.

Aplikační úkol

Nasbírejte alespoň 10 kusů dokumentace související s vaším tématem a ke každé připojte reference. Odstraňte ty, které se týkají vzoru „skenování založeného na zdroji“; pak si sami zkontrolujte některé z těch označených jako „irelevantní“ jako vzorek. Nechte si „věrným shrnutím“ shrnout jeden z relevantních výstupů a najděte a ověřte každý klíčový bod ve shrnutí v dokumentu. Všimněte si, kolik bodů AI přidá nebo naruší.

kontrolní seznam

  • [ ] Začal jsem jasnou výzkumnou otázkou.
  • [ ] Ke každé dokumentaci přikládám odkaz na zdroj.
  • [ ] Každý bod shrnutí jsem propojil zpět s původním dokumentem.
  • [ ] Citace jsem převzal doslovně z dokumentu.
  • [ ] Kontroloval jsem eliminaci vzorkováním a zpochybnil mezery.