단위 11 / 12

인증, 경계, 개인 정보 보호 및 윤리

이득:

  • 모델이 환각을 생성할 수 있으며 각 출력을 검증해야 한다는 점을 이해합니다.
  • 기밀 및 개인 데이터를 즉시 입력하는 데 따른 위험과 안전한 대안을 알고 있습니다.
  • 인공지능 사용에 윤리, 저작권, 책임 제한을 적용합니다.

프롬프트 작성 방법을 익히는 것만으로는 충분하지 않습니다. 인공지능을 책임감 있게 활용하는 방법도 배워야 한다. 이 단위는 기술적 능력 위에 배치되어야 하는 보안 계층입니다. AI는 빠르고 설득력 있고 정확한 답변을 제공합니다. 그러나 때로는 동일한 확신을 갖고 완전히 잘못된 정보를 생성하여 민감한 데이터를 위험에 빠뜨리고 윤리적 경계를 허물 수 있습니다. 이 단원에서는 출력 검증, 모델의 한계, 기밀성 및 윤리적 책임에 대해 다룹니다. 이 지식이 없으면 다른 모든 기술은 불완전한 상태로 유지됩니다.

환각: 모델 피팅

환각은 모델이 자신감 있는 언어로 비현실적인 정보를 생성하는 경우입니다. 존재하지 않는 출처, 부정확한 날짜, 조작된 통계, 작성되지 않은 법률 등이 이에 대한 예입니다. 왜 이런 일이 발생합니까? 모델은 "진실을 아는 것"이 ​​아니라 "가능한 연속을 생성"하도록 설계되었기 때문입니다(첫 번째 단위의 논리를 기억하십시오). 문장이 문법적으로 가능하다고 해서 그것이 사실이라는 의미는 아닙니다.

이에 대한 실질적인 의미는 분명합니다. AI가 생성한 모든 사실은 독립적으로 검증되기 전까지는 사실이 아니라 주장입니다. 특히 다음 사항을 항상 확인하세요.

  • 숫자와 통계
  • 이름, 날짜, 장소 이름
  • 인용문 및 출처 참조
  • 법령, 기술기준, 의료/금융정보

검증 습관

프롬프트 기술을 사용하면 검증을 줄일 수는 있지만 재설정할 수는 없습니다. 두 개의 레이어로 작업:

  1. 프롬프트 레이어: "제가 제공하는 출처에만 의존하고, 존재하지 않는 정보는 추가하지 마세요. 확실하지 않은 경우 '모르겠습니다'라고 기재하고, 각 주장의 출처를 표시하세요."와 같은 모델 제한 사항을 부여합니다. 이로 인해 피팅이 줄어듭니다.
  2. 인간 계층: 소스에서 각 중요한 사실을 직접 확인합니다. 이 단계는 협상할 수 없습니다. 이는 게시되거나 결정의 기초가 되거나 다른 사람에게 영향을 미칠 콘텐츠에 특히 필수입니다.

한계: 모델이 제대로 수행하지 못하는 것

지역

위험

올바른 접근

시사

학습 데이터가 오래되었을 수 있습니다.

날짜/현재 소스에서 확인

정확한 숫자

맞을 확률이 높다

계산기/소스로 확인

법률/의료/금융

심각한 피해를 입을 위험이 있음

혼자만 의지하지 말고 진짜 전문가와 상담하세요

출처/인용

존재하지 않는 자원을 생산할 수 있음

출처의 진위 여부를 직접 확인해보세요

희귀/틈새 주제

피상적이거나 부정확함

전문지식과 비교해보세요

모델은 조력자이지 최종 권위자는 아니다. 책임은 언제나 사용하는 사람에게 있습니다.

개인 정보 보호 및 개인 데이터

공용 AI 도구에 입력하는 텍스트는 해당 도구의 처리 정책을 따르며 조직의 통제 범위를 벗어날 수 있습니다. 따라서 기밀 및 개인 데이터를 아무 생각 없이 입력하는 것은 심각한 위험입니다. 터키에서의 개인 데이터 처리는 KVKK(개인 데이터 보호법)에 의해 규제됩니다. 기관에는 자체 데이터 정책이 있는 경우도 많습니다.

안전한 작업 방법:

  • 익명화/마스크: 실명 대신 "고객", 실수 대신 "[계좌번호]"라고 기재합니다. 대부분의 경우 "3년차 기업 고객"이라고 말하면 됩니다.
  • 기관 승인 도구 사용: 일부 기관에서는 데이터를 유출하지 않는 계약/기관 도구를 제공합니다. 민감한 데이터만 처리하세요.
  • 필요하지 않은 것을 제공하지 마십시오. 작업을 수행하는 데 실제로 필수적이지 않은 민감한 세부 정보를 포함하지 마십시오.
  • 정책을 숙지하세요: 조직의 인공 지능 사용 규칙을 배우고 준수하세요.

윤리와 저작권

책임 있는 사용은 개인정보 보호로 끝나지 않습니다. 세 가지 원칙:

  1. 투명성: 상황에 따라 AI 생성 콘텐츠의 출처를 적절하게 표시합니다(예: 인간의 노동이 필요한 경우). 사기성 사용을 피하십시오.
  2. 저작권 및 독창성: 모델의 출력은 다른 저작물과 유사할 수 있습니다. 상업적으로 사용하기 전에 독창성과 권리 상태를 검토하십시오. 타인의 브랜드/작품을 모방하지 마세요.
  3. 비악의성: 오해의 소지가 있거나 차별적이거나 조작적이거나 표적이 되는 콘텐츠를 만드는 데 사용하지 마십시오. 도구의 힘은 책임감을 증가시킵니다.

복사 가능한 템플릿 4개

1) 제약 제한 피팅:

아래 소스를 참고하시면 됩니다. 출처에 없는 정보는 추가하지 마세요. 확실하지 않은 경우에는 "소스에 없음"이라고 기재하세요. 각각의 중요한 주장 옆에 그 주장의 근거가 되는 줄을 표시하십시오. 출처: [텍스트]

2) 검증 목록 추출:

확인해야 할 모든 사실(번호, 날짜, 이름, 주장)을 아래 텍스트에 나열하십시오. 각각에 대해 어떻게 확인할 수 있는지 간략하게 제안해 보세요. 텍스트: [출력]

3) 익명화:

다음 텍스트의 모든 개인/기밀 데이터를 마스킹합니다. 이름은 [PERSON], 회사는 [COMPANY], 숫자는 [NUMBER]입니다. 의미가 그대로 담긴 익명 버전을 제공하세요. 텍스트: [텍스트]

4) 윤리적 검토:

이 콘텐츠를 게시하기 전에 윤리적으로 평가하십시오. 오해의 소지가 있거나 차별적이거나 불공평합니까? 그렇다면 신고하고 수정 사항을 제안하세요. 내용: [텍스트]

약한 프롬프트 / 강한 프롬프트

약함(위험함):

Ahmet Yılmaz(TC: ...) 계약에서 문제점을 찾아 업계 평균과 비교해 보세요.

강력함(안전함):

아래 계약서 본문에서 위험한 조항을 찾아보세요. - 개인 데이터의 사용 당사자는 [COMPANY-A], [PERSON]으로 기재합니다. - 본문에 기재된 내용만 참고하세요. 업계 평균은 "데이터를 사용할 수 없음"이라고 기재하십시오.- 항목과 함께 각 위험을 표시하십시오. 텍스트(익명): [text]

강력한 버전은 개인 데이터를 보호하고 가짜 업계 데이터를 차단합니다. 결과는 법무팀에서 검토할 준비가 되었습니다.

미니 케이스 3개

사례 1 - 조작된 소스. 연구자는 모델이 제공한 3개의 "학술적 출처"를 검증하지 않고 프레젠테이션에 넣었습니다. 소스 중 두 개는 전혀 사용할 수 없었습니다. 프레젠테이션 전에 동료가 그것을 알아차렸습니다. 이후 팀에서는 "출판 전 각 리소스를 직접 찾아 열어본다"는 원칙을 채택했습니다.

사례 2 - 기밀성. 한 직원이 실제 고객 계약을 그대로 공개 도구에 붙여넣고 요약을 요청했습니다. 해당 기관의 정보보안팀이 이를 탐지했을 때 프로세스를 재검토했습니다. 민감한 문서는 이제 기관에서 승인한 기업 도구에서만 처리되며 익명으로 처리됩니다.

사례 3 - 결정 책임. 한 소상공인이 모델이 제시한 세금 해석을 토대로 조치를 취하려던 참이었다. 해당 의견은 현행법을 준수하지 않았습니다. 그가 재정 고문과 상담했을 때 실수가 발견되었습니다. 교훈은 분명합니다. AI가 준비하고 전문가와 인간이 결정합니다.

팁: 사실을 '확인되지 않음'으로 표시하는 습관을 들이세요. 확인할 때까지 출력의 각 번호와 소스 옆에 확인 표시를 하십시오. 이 간단한 규율은 잘못된 정보가 조용히 퍼지는 것을 방지합니다.
주의: "AI가 그렇게 말했다"는 변명이 되지 않습니다. 귀하는 귀하가 게시, 전송 또는 결정의 근거가 되는 모든 콘텐츠에 대한 책임을 집니다. 차량 속도로 인해 검사 의무가 면제되는 것은 아닙니다.

일반적인 실수

  • 유창한 출력을 올바른 것으로 착각합니다. 설득력 있는 언어를 진실의 증거로 착각합니다.
  • 출처를 확인하지 않고 그대로 사용합니다. 존재하지 않는 소스를 게시합니다.
  • 아무 생각 없이 기밀 데이터를 입력합니다. 민감한 문서를 익명화하지 않고 붙여넣습니다.
  • 전문성을 모델에게만 맡기는 것입니다. 법적/의료/재정적 결정을 확인하지 못했습니다.
  • 차량에 책임을 전가합니다. "AI가 그랬다"고 말하며 통제를 회피한다.

요약하면

  • 환각은 모델이 실제가 아닌 것을 자신있게 생성하는 경우입니다. 모든 사실은 확인되기 전까지는 주장입니다.
  • 검증은 두 가지로 이루어집니다. 즉각적인 제약으로 제작이 줄어들고, 사람이 확인하여 이를 포착합니다.
  • 이 모델은 현재의 정확한 법률/의료/재무 문제로 제한됩니다. 최종 권한은 아닙니다.
  • 기관에서 승인한 도구(KVKK 및 기관 정책)를 통해서만 기밀 및 개인 데이터 또는 프로세스를 익명화합니다.
  • 윤리적, 저작권 및 무해성 원칙을 준수합니다. 콘텐츠에 대한 책임은 언제나 본인에게 있습니다.

응용과제

최근에 제작한 인쇄물을 가지고 그 안에 있는 모든 사실(번호, 날짜, 이름, 출처, 주장)을 검증 목록으로 추출하세요. 각각에 대한 검증 방법을 적고, 그 중 3개 이상을 실제로 확인해보세요. 또한 동일한 출력의 입력에 기밀/개인 데이터가 있는지 확인하고 필요한 경우 익명화합니다.

체크리스트

  • [ ] 나는 환각이 무엇이고 왜 일어나는지 설명할 수 있다.
  • [ ] 나는 독립적인 출처에서 나온 사실적인 결과를 확인합니다.
  • [ ] 나는 기밀/개인 데이터를 익명화하거나 보안 도구에서 처리합니다.
  • [ ] 법률/의료/금융 문제에 대해 실제 전문가와 상담합니다.
  • [ ] 나는 콘텐츠에 대한 책임이 나에게 있음을 인정합니다.