Dobički:
- Sposobnost razumevanja poteka dela EDRM in koncepta TAR/prediktivnega kodiranja ter pospešitev faze pregleda z umetno inteligenco
- Sposobnost razumevanja ravnovesja med odpoklicem in natančnostjo ter zagotovitev, da ne zamudite ustreznih dokumentov z dajanjem prednosti visokemu odpoklicu v forenzičnem kontekstu
- Razumevanje, da je pravna odgovornost za odločitve o zaupnosti in osebnih podatkih na strani pravnika in da je potrebna preglednost metodologije
V civilni tožbi ali regulativni preiskavi ena stranka zahteva elektronske dokumente, ki jih ima druga: e-pošto, pogodbe, dnevnike klepetov, datoteke. Postopek zbiranja teh dokumentov v skladu z zakonom, njihovega pregleda, razvrščanja relevantnih in predaje nasprotni stranki/sodišču se imenuje e-discovery - iskanje, pregled in predstavitev elektronskih dokazov v okviru pravnega spora. E-odkrivanje je področje, kjer je računalniška forenzika najbolj prepletena s pravom in je morda najbolj zrela in razširjena uporaba umetne inteligence. V tej enoti se boste naučili poteka dela EDRM, koncepta TAR/prediktivnega kodiranja in kako AI preoblikuje ta proces.
EDRM: standardni potek dela e-odkrivanja
E-discovery v svetu večinoma deluje v okviru EDRM (Electronic Discovery Reference Model - referenčni model, ki definira standardne stopnje procesa e-discovery). Glavne faze:
- Upravljanje informacij in identifikacija: Ugotavljanje, kateri podatki so kje.
- Ohranjanje in zbiranje: Preprečevanje izbrisa ustreznih podatkov (pravno zadržanje — obveznost prenehanja brisanja podatkov v pričakovanju sodnih sporov) in njihovo celovito zbiranje.
- Obdelava: Omogoča iskanje po podatkih, odstranjevanje dvojnikov, pretvorba formata.
- Pregled: Odločanje, ali so dokumenti občutljivi ali privilegirani – zajeti v privilegiju odvetnik-stranka in ne bodo predani.
- Izdelava: Dostava ustreznih dokumentov drugi stranki/sodišču.
Najdražja in najbolj zahtevna faza je pregled. Prebrati odvetnike na stotine tisoč dokumentov enega za drugim je zelo drago in zelo počasno. To je točno tisto, kjer umetna inteligenca ustvari revolucijo.
TAR in prediktivno kodiranje
Ključna tehnologija, ki pospeši pregled, je TAR (Technology Assisted Review). Najpogostejša oblika je prediktivno kodiranje: strokovni odvetnik vzorčne dokumente označi kot "ustrezne/neustrezne"; Sistem se uči iz teh primerov in samodejno razvrsti preostalih sto tisoč dokumentov. Tako se preberejo le najverjetneje relevantni dokumenti, ostale pa se preveri z vzorčenjem.
Sodobna umetna inteligenca (veliki jezikovni modeli) naredi to še korak dlje: lahko razloži, zakaj je dokument ustrezen, povzame temo, označi privilegij, ne le "ustrezno/nepomembno". Toda osnovno načelo se ne spremeni: AI predlaga, da je pravna odgovornost za odločitev o pomembnosti in privilegijih na strani odvetnika.
Ubranljivost TAR je odvisna od postopka, ki ga je mogoče revidirati. Primeri usposabljanja, ki jih označi strokovnjak pravnik, sistem, ki se uči iz teh primerov in razvršča preostale dokumente, se ponavljajo v ciklu; Natančnost se meri z vzorčenjem v vsakem krogu. Ta cikel zagotavlja dokumentirane odgovore na vprašanja "kaj je stroj gledal, kaj se je naučil, kako natančen je bil?" Druga stran pogosto postavlja pod vprašaj to metodologijo; Zato se velikost nabora za usposabljanje, odločilni pragovi in stopnje vzorčenja validacije beležijo od začetka. Bolj kot je postopek pregleden in ponovljiv, večja je verjetnost, da bo izid sprejet na sodišču.
Namig: Da bo vaš postopek TAR branljiv, dokumentirajte svoje vzorce »usposabljanja«, meritve validacije (priklic/natančnost) in pragove odločitve. Druga stranka vpraša "kaj je stroj zamudil?" lahko vpraša; Transparentna metodologija zagotavlja zaupanje.
Dve metriki: priklic in natančnost
Pri e-odkrivanju sta pomembna dva koncepta. Odpoklic (občutljivost – koliko vseh ustreznih dokumentov vam je dejansko uspelo najti) meri tveganje pogrešitve; To je pravno kritično, saj lahko nepredložitev ustreznega dokumenta povzroči sankcije. Natančnost – koliko tega, kar najdete, je dejansko relevantnega – meri nepotrebno bralno obremenitev; vpliva na stroške. Obstaja ravnovesje med obema: če sprostite prag, se poveča odpoklic, povečajo pa se tudi nepotrebni dokumenti. V forenzičnem/pravnem kontekstu se pogosto daje prednost visokemu odpoklicu – pomembnejše od prebranega je, da ne zamudite.
Privilegij in zasebnost: rdeča črta
Najbolj nevarna napaka pri e-odkrivanju je nenamerna predaja privilegiranega dokumenta drugi strani (privilege waiver). Ko je korespondenca med odvetnikom in stranko dostavljena, jo je zelo težko pridobiti. AI pomaga pri označevanju privilegijev, vendar mora vsako odločitev o privilegijih potrditi človeški odvetnik. Dodatno se lahko zahteva redakcija dokumentov, ki vsebujejo osebne podatke (obseg KVKK/GDPR); Umetna inteligenca zastavi maskiranje kandidatov, končna kontrola je pri človeku.
Pozor: pri nalaganju neobdelanih podatkov podjetja v AI upoštevajte pravila o zasebnosti podatkov in pristojnosti (podatki katere države, kam gredo). Privilegirane in osebne podatke je treba obdelovati na vozilih, katerih podatki ne gredo na usposabljanje modelov, po pogodbi in v ustrezni pristojnosti.
trije mini kovčki
Primer 1 – znižani stroški TAR. V komercialnem primeru z 1,3 milijona dokumentov je bila ocena klasičnega linearnega pregleda 14 mesecev. S prediktivnim kodiranjem so pravniki označili 8000 dokumentov; sistem je razvrstil preostanek in človeški pregled se je zmanjšal na 90.000 dokumentov. Postopek je bil skrajšan na 6 tednov, 92 % potrjeno z vzorčenjem po odpoklicu.
Primer 2 — Privilegij shranjen. Predprodukcijska umetna inteligenca je 240 dokumentov v kompletu za dostavo označila kot "morda privilegirane". Odvetniška ekipa je pregledala; 210 je bila dejansko korespondenca med odvetnikom in stranko in ni bila dostavljena. Brez umetne inteligence bi lahko ti dokumenti pomotoma prišli do druge strani.
Primer 3 – Tveganje pretirane samozavesti. Ena ekipa je natančno nastavila prag TAR za visoko natančnost; Sistem je brez vzorčenja izločil tiste, ki so se mu zdeli "nepomembni". Kasnejša revizija je pokazala, da je bilo več kritičnih e-poštnih sporočil zgrešenih zaradi strogega praga. Napaka je bila opažena pozno, ker vzorčenje klicev ni bilo izvedeno.
Štiri predloge za kopiranje
1) Osnutek protokola pregleda:
Vaša vloga: svetovalec za e-odkrivanje. Predmet primera: [kršitev pogodbe]. Zame sestavite osnutek protokola pregleda: merila odzivnosti, zastavice privilegijev, pravila za maskiranje osebnih podatkov in koraki preverjanja TAR (odpoklic/natančno vzorčenje). Navedite, da je vsaka odločitev predmet potrditve odvetnika.
2) Ustreznost predhodne razvrstitve:
Vsebina in kriteriji ustreznosti: [tukaj]. Dal vam bom povzetke dokumentov. Za vsak dokument: ustrezen/neustrezen/negotov in KRATKO utemeljitev. Označite »nejasne«; ti bodo šli v pregled odvetnika. Tiste, ki jih boste označili za nepomembne, bomo preverili z vzorčenjem, ne gre za dokončno izločitev.
3) Pregledovanje privilegijev:
Označite naslednje dokumente, ki MOGOČE predstavljajo privilegij med odvetnikom in stranko: imena odvetnikov, "zaupno/privilegirano" besedilo, vsebina pravnega mnenja. To niso DOKONČNE odločbe, gre za kandidate, ki jih potrdi odvetnik. Podajte utemeljitev in ustrezno vrstico za vsak znak.
4) Kandidati za maskiranje osebnih podatkov:
Navedite kandidate za osebne podatke, ki jih je treba prikriti v teh dokumentih, ki jih je treba dostaviti pred izdelavo: TR, IBAN, zdravstveni podatki, zasebni podatki tretjih oseb. Označi samo kot kandidata; Jaz bom sprejel končno odločitev o maskiranju. Spremeni besedilo.
Šibek poziv/močan poziv
Šibek poziv:
Med temi dokumenti izberite tiste, ki so pomembni za primer.
Brez meril ustreznosti, brez ekskluzivnosti in brez preverjanja; Umetna inteligenca sprejema subjektivne odločitve, lahko zgreši kritičen dokument ali uhaja privilegirano.
Močan poziv:
Vaša vloga: pomočnik pri pregledu e-odkrivanja. Primer: Trditev, da je podjetje X kršilo dobavno pogodbo z Y. Merila ustreznosti: dobavni roki, spremembe cen, pritožbe glede kakovosti, pogajanja o prekinitvi. Dal vam bom povzetke dokumentov. Navedite ustrezno/nepomembno/negotovo + utemeljitev za vsak dokument. TUDI tiste, ki vsebujejo odvetnikovo ime ali pravno mnenje, označite kot "morda privilegirane". Ne štejte nobene odločitve za dokončno; Vsi so predmet potrditve odvetnika.
Vsebinska merila, preverjanje privilegijev in omejitev "preverjanja odvetnika" naredijo postopek branljiv.
Stopnje EDRM in tabela AI
Oder
Prispevek AI
človeška odgovornost
zbirka
predloga, načrt
Pravno držanje, integriteta
Obdelava
De-dup, format, imenik
nadzor kakovosti
pregled
TAR, priporočilo glede ustreznosti
Odločitev o ustreznosti
privilegij
Označevanje kandidata
končna odločitev, potrditev
Proizvodnja
kandidat za maskiranje
Končni pregled, dostava
Pogoste napake
- Pustiti TAR brez nadzora. Če rečete "stroj je rekel, da ga ne zanima", ne da bi opravili vzorec klica, boste povzročili ugrabitev.
- Prepuščanje odločitve o privilegijih AI. Pri napačni dostavi obstaja nevarnost nepreklicne odpovedi.
- Osredotočanje le na natančnost namesto na priklic. Tesen prag zgreši ustrezni dokument; Po zakonu ima odpoklic prednost.
- Brez dokumentiranja metodologije. Druga stranka lahko dvomi o postopku TAR; preglednost je nujna.
- Nalaganje osebnih/privilegiranih podatkov v neustrezno orodje. Upoštevajte pravila o pristojnosti in zaupnosti.
Če povzamem
E-discovery je proces iskanja in dostave ustreznih dokazov iz elektronskih podatkov podjetja na zakonit način in deluje v okviru EDRM. AI preoblikuje najdražjo fazo, pregledovanje, s TAR/prediktivnim kodiranjem: človek bere samo najverjetneje ustrezne in dvoumne dokumente. Toda pravno odgovornost za odločitev o pomembnosti in še posebej o privilegijih nosi odvetnik; Vzorčenje odpoklica, preglednost metodologije in varstvo osebnih podatkov zagotavlja človeška disciplina.
Aplikacijska naloga
Določite fiktivni primer in 4-5 elementov kriterijev pomembnosti. Pripravite 20-25 povzetkov dokumentov (nekaj privilegiranih, nekaj nejasnih). Uporabite predlogi »Predhodna klasifikacija ustreznosti« in »Pregled privilegijev«; Nato ročno preverite odpoklic z vzorčenjem iz nabora "nepomembnih" in potrdite kandidate za privilegije, ki jih je AI označil.
kontrolni seznam
- [ ] Upošteval sem stopnje EDRM in zakonsko obveznost zadržanja.
- [ ] Preveril sem rezultat TAR/predhodne klasifikacije z vzorčenjem po odpoklicu.
- [ ] Vsako odločitev o privilegiju sem povezal s potrditvijo odvetnika.
- [ ] Kandidate za maskiranje osebnih podatkov sem odobril s končnim preverjanjem.
- [ ] Dokumentiral sem metodologijo in pragove, ki sem jih uporabil.