Eenheid 11 / 12

Authenticatie, grenzen, privacy en ethiek

Winst:

  • Begrijpt dat het model hallucinaties kan veroorzaken en dat elke output moet worden geverifieerd
  • Kent de risico's en veilige alternatieven van het direct beschikbaar stellen van vertrouwelijke en persoonlijke gegevens
  • Past ethische, auteursrecht- en aansprakelijkheidslimieten toe bij het gebruik van kunstmatige intelligentie

Het is niet voldoende om het schrijven van aanwijzingen onder de knie te krijgen; Ook is het nodig om op een verantwoorde manier met kunstmatige intelligentie om te gaan. Deze eenheid is de beveiligingslaag die bovenop de technische vaardigheden moet worden geplaatst. AI levert antwoorden op die snel, overtuigend en vaak accuraat zijn; Maar soms produceert het met hetzelfde vertrouwen volledig valse informatie, kan het gevoelige gegevens in gevaar brengen en ethische grenzen verleggen. In deze unit behandelen we het verifiëren van de output, de beperkingen van het model, de vertrouwelijkheid en ethische verantwoordelijkheid. Zonder deze kennis blijven alle andere technieken onvolledig.

Hallucinatie: passend bij het model

Er is sprake van een hallucinatie als het model onwerkelijke informatie produceert in een zelfverzekerde taal. Een niet-bestaande bron, een onjuiste datum, een verzonnen statistiek of een wet die nooit is geschreven zijn hiervan voorbeelden. Waarom gebeurt het? Omdat het model niet is ontworpen om ‘de waarheid te kennen’, maar om ‘de mogelijke voortzetting te genereren’ (denk aan de logica in de eerste eenheid). Het feit dat een zin grammaticaal mogelijk is, betekent niet dat deze feitelijk waar is.

De praktische implicatie hiervan is duidelijk: elk door AI geproduceerd feit is een claim en geen feit totdat het onafhankelijk is geverifieerd. Controleer vooral altijd:

  • Cijfers en statistieken
  • Namen, data, plaatsnamen
  • Citaten en bronvermeldingen
  • Juridische clausules, technische normen, medische/financiële informatie

Validatie gewoonte

U kunt de verificatie verminderen, maar niet resetten, met een snelle techniek. Werk in twee lagen:

  1. Promptlaag: Geef de modelbeperkingen op, zoals "vertrouw alleen op de bron die ik geef, voeg geen informatie toe die niet bestaat, schrijf 'Ik weet het niet' als u het niet zeker weet, toon de bron van elke claim." Dit vermindert het passen.
  2. Menselijke laag: Controleer elk kritisch feit zelf vanaf de bron. Deze stap is niet onderhandelbaar; Het is vooral verplicht voor inhoud die zal worden gepubliceerd, die de basis zal vormen voor beslissingen of die van invloed zal zijn op anderen.

Grenzen: wat het model niet goed doet

gebied

Risico

juiste aanpak

actuele gebeurtenissen

Trainingsgegevens kunnen verouderd zijn

Verifieer op basis van een gedateerde/huidige bron

exacte cijfers

De kans op aanpassing is groot

Controleer met rekenmachine/bron

Juridisch/medisch/financieel

Risico op ernstige schade

Raadpleeg een echte expert, vertrouw er niet alleen op

Bron/citaat

Kan niet-bestaande hulpbronnen produceren

Controleer zelf de authenticiteit van de bron

Zeldzaam/niche-onderwerp

Oppervlakkig of onnauwkeurig

Vergelijk met deskundige kennis

Het model is een assistent, niet de uiteindelijke autoriteit. De verantwoordelijkheid ligt altijd bij de persoon die er gebruik van maakt.

Privacy en persoonlijke gegevens

Tekst die u in een openbare AI-tool typt, valt onder het verwerkingsbeleid van die tool en valt mogelijk buiten de controle van uw organisatie. Daarom vormt het zonder nadenken invoeren van vertrouwelijke en persoonlijke gegevens een ernstig risico. De verwerking van persoonsgegevens in Türkiye wordt gereguleerd door KVKK (Wet bescherming persoonsgegevens); Instellingen hebben ook vaak een eigen databeleid.

Veilige manieren van werken:

  • Anonimiseren/maskeren: schrijf "klant" in plaats van echte naam, "[rekeningnummer]" in plaats van echt nummer. Meestal volstaat het om te zeggen dat u een zakelijke klant van drie jaar bent.
  • Gebruik een door de instelling goedgekeurde tool: Sommige instellingen bieden gecontracteerde/institutionele tools aan die geen gegevens lekken. Verwerk gevoelige gegevens alleen daarop.
  • Geef niet weg wat niet nodig is: Voeg geen gevoelige details toe die niet echt essentieel zijn voor het uitvoeren van de taak.
  • Ken het beleid: Leer en volg de gebruiksregels voor kunstmatige intelligentie van uw organisatie.

Ethiek en auteursrecht

Verantwoord gebruik houdt niet op bij privacy. Drie principes:

  1. Transparantie: Geef op passende wijze erkenning aan door AI gegenereerde inhoud als de context dit vereist (bijvoorbeeld wanneer menselijke arbeid wordt verwacht). Vermijd misleidend gebruik.
  2. Auteursrecht en originaliteit: De uitvoer van het model kan op andere werken lijken. Controleer originaliteit en rechtenstatus vóór commercieel gebruik; Imiteer het merk/werk van iemand anders niet.
  3. Niet schadelijk: niet gebruiken om inhoud te creëren die misleidend, discriminerend, manipulatief of doelgericht is. De kracht van de tool vergroot de verantwoordelijkheid.

Vier kopieerbare sjablonen

1) Beperkende montage:

Vertrouw gewoon op de onderstaande bron. Voeg geen informatie toe die niet in de bron staat. Schrijf "niet in de bron" als u het niet zeker weet. Geef naast elke belangrijke claim de regel aan waarop deze is gebaseerd. Bron: [tekst]

2) Verificatielijst uitpakken:

Vermeld in onderstaande tekst alle feiten (nummer, datum, naam, claim) die geverifieerd moeten worden. Geef kort aan hoe ik voor elk kan verifiëren. Tekst: [uitvoer]

3) Anonimisering:

Masker alle persoonlijke/vertrouwelijke gegevens af in de volgende tekst: maak namen [PERSON], bedrijf [COMPANY], nummers [NUMBER]. Geef een geanonimiseerde versie met de betekenis intact. Tekst: [tekst]

4) Ethische toetsing:

Evalueer deze inhoud ethisch voordat u deze publiceert: is deze misleidend, discriminerend of oneerlijk? Markeer dit als dit het geval is en stel correcties voor. Inhoud: [tekst]

Zwakke prompt/sterke prompt

Zwak (risicovol):

Zoek de problemen in het contract van Ahmet Yılmaz (TC: ...) en vergelijk het met sectorgemiddelden.

Sterk (veilig):

Vind de risicovolle clausules in de contracttekst hieronder. - Gebruik van persoonsgegevens; Laat de partijen worden aangeduid als [BEDRIJF-A] en [PERSON]. - Vertrouw alleen op wat er in de tekst staat; branchegemiddelde opgemaakt, schrijf "data niet beschikbaar".- Toon elk risico met zijn item.Tekst (geanonimiseerd): [tekst]

De krachtige versie beschermt zowel persoonlijke gegevens als blokkeert valse branchegegevens; De output is klaar voor beoordeling door het juridische team.

Drie mini-hoesjes

Geval 1 — Verzonnen bron. Een onderzoeker heeft drie door het model gegeven "academische bronnen" in de presentatie gestopt zonder ze te verifiëren; Twee van de bronnen waren helemaal niet beschikbaar. Een collega merkte het al vóór de presentatie op. Daarna nam het team de regel over om "elke bron persoonlijk te vinden en te openen voordat deze wordt gepubliceerd".

Geval 2 — Vertrouwelijkheid. Een medewerker plakte het daadwerkelijke klantcontract intact in een openbare tool en vroeg om een ​​samenvatting. Toen het informatiebeveiligingsteam van de instelling dit constateerde, werd het proces herzien; Gevoelige documenten worden nu alleen verwerkt in de door de instelling goedgekeurde bedrijfstool en worden geanonimiseerd.

Geval 3 — Beslissingsverantwoordelijkheid. Een eigenaar van een klein bedrijf stond op het punt actie te ondernemen op basis van de belastinginterpretatie van het model; De opmerking was niet in overeenstemming met de huidige wetgeving. De fout werd opgemerkt toen hij zijn financieel adviseur raadpleegde. De les is duidelijk: de AI bereidt zich voor, de expert en de mens beslissen.

Tip: Maak er een gewoonte van om een ​​feit als ‘niet-geverifieerd’ te markeren. Plaats een vinkje naast elk nummer en elke bron in de uitvoer totdat u het bevestigt; Deze eenvoudige discipline voorkomt dat verkeerde informatie zich stilletjes verspreidt.
Let op: "AI zei het" is geen excuus. U bent verantwoordelijk voor alle inhoud die u publiceert, verzendt of waarop u uw beslissingen baseert. De snelheid van het voertuig ontslaat u niet van uw keuringsplicht.

Veel voorkomende fouten

  • Vloeiende uitvoer als correct beschouwen. Overtuigende taal verwarren met bewijs van de waarheid.
  • De bron gebruiken zonder deze te controleren. Het publiceren van een niet-bestaande bron.
  • Zonder nadenken vertrouwelijke gegevens invoeren. Gevoelige documenten plakken zonder ze te anonimiseren.
  • Laat de expertise alleen aan het model over. Het niet verifiëren van juridische/medische/financiële beslissingen.
  • De verantwoordelijkheid bij het voertuig leggen. Controle ontwijken door te zeggen: "AI zei het".

Samengevat

  • Er is sprake van hallucinatie als het model zelfverzekerd produceert wat niet echt is; Elk feit is een claim totdat het is geverifieerd.
  • Verificatie is tweeledig: snelle beperkingen verminderen de fabricage, en menselijke controle vangt het op.
  • Het model beperkt zich tot actuele, precieze, juridische/medische/financiële zaken; is niet de uiteindelijke autoriteit.
  • Anonimiseer vertrouwelijke en persoonsgegevens of verwerk deze uitsluitend in de door de instelling goedgekeurde tool (KVKK en instellingsbeleid).
  • Voldoen aan ethische, auteursrechtelijke en niet-schadelijke principes; De verantwoordelijkheid voor de inhoud ligt altijd bij de persoon.

Applicatie taak

Neem een ​​afdruk die u onlangs hebt gemaakt en extraheer alle feiten daarin (nummer, datum, naam, bron, bewering) als verificatielijst. Schrijf voor elk de verificatiemethode op en controleer er minimaal drie. Controleer ook of er vertrouwelijke/persoonlijke gegevens in de invoer van dezelfde uitvoer zitten en anonimiseer deze indien nodig.

controlelijst

  • [ ] Ik kan uitleggen wat een hallucinatie is en waarom deze optreedt.
  • [ ] Ik verifieer feitelijke output uit een onafhankelijke bron.
  • [ ] Ik anonimiseer vertrouwelijke/persoonlijke gegevens of verwerk deze in een beveiligde tool.
  • [ ] Ik raadpleeg een echte deskundige op juridisch/medisch/financieel gebied.
  • [ ] Ik aanvaard dat ik verantwoordelijk ben voor de inhoud.