단위 8 / 11

연구 윤리, 기밀 유지 및 익명화

이득:

  • 사전동의, 비악의성, 비밀유지 원칙을 사회 연구에 적용할 수 있는 능력
  • 인공 지능에 데이터를 제공하기 전에 직접 및 간접 식별자를 모두 삭제하여 데이터를 적절하게 익명화하는 기능
  • 사용된 인공지능 도구의 데이터 보유 정책을 조회하고 민감한 데이터에 대해 승인된 미디어만 사용하는 기능

사회탐구는 사람과 함께 하는 일이고, 여기에는 막중한 책임이 따른다. 사람들은 자신의 삶과 의견, 때로는 가장 연약한 경험에 대해 이야기합니다. 연구 윤리는 이러한 신뢰를 유지하기 위한 일련의 규칙입니다. 즉, 참가자에게 해를 끼치지 않고, 동의를 얻고, 신원을 보호하고, 데이터를 오용하지 않는 것입니다. AI 시대에는 참가자 데이터를 AI 도구에 붙여넣는 것이 이제 자신도 모르게 해당 데이터를 유출하는 것을 의미할 수 있기 때문에 이러한 책임이 더욱 커졌습니다. 본 단원에서는 연구 윤리의 기본 원칙, AI 사용 시 기밀을 보호하는 방법, 데이터를 적절하게 익명화하는 방법(사람을 알아볼 수 없게 만드는 방법)을 배우게 됩니다.

세 가지 기본 원칙은 모든 사회 연구의 중추입니다. 사전 동의: 참가자는 연구가 무엇인지, 자신의 데이터가 어떻게 사용되는지 이해하고 자유롭게 "예"라고 대답해야 합니다. 비악의성: 연구는 참가자에게 신체적, 정신적, 사회적 해를 끼치지 않아야 합니다. 기밀성 및 기밀성: 참가자의 신원과 데이터는 보호되어야 합니다. AI 도구는 이러한 정책을 촉진하거나(예: 동의 텍스트 작성, 익명화 제어) 이를 손상시킬 수 있습니다(예: 개인 식별 가능한 기록을 클라우드에 업로드). 차이점은 사용자가 의식이 있는지 여부입니다.

단계별: 윤리적이고 안전한 연구

1. 윤리적 승인을 얻습니다. 대부분의 기관(대학, 기관)에서 인간을 대상으로 하는 연구는 윤리위원회(연구가 참가자에게 해를 끼치지 않도록 보장하는 위원회)의 승인이 필요합니다. AI는 지원서 초안 작성을 돕습니다. 승인 자체는 해당 기관에 속합니다.

2. 동의문을 명확하게 작성합니다. 참가자는 무거운 법적 언어가 아닌 이해할 수 있는 언어로 정보를 받아야 합니다. AI는 간단하고 완전한 동의문 초안을 작성합니다. 각 항목을 확인합니다.

3. AI에 데이터를 제공하기 전에 데이터를 익명화하세요. 이름, 주소, 전화번호, 직장, 식별 정보는 삭제되어야 합니다. 단순히 이름을 삭제하는 것만으로는 충분하지 않은 경우가 많습니다. "자녀 셋을 둔 동네 X 유일한 약사" 등의 설명도 그 사람의 모습을 드러낸다.

4. 어떤 도구가 데이터를 저장하는지, 어떻게 저장하는지 알아보세요. AI 도구에 붙여넣은 데이터는 해당 도구의 서버에서 처리되며 일부 서비스의 교육에 사용될 수 있습니다. 민감한 데이터의 경우 이는 허용되지 않을 수 있습니다. 기관에서 승인한 데이터 보호 보증 도구를 사용하세요.

5. 데이터를 안전하게 저장하고 적시에 삭제하십시오. 동의 시 약속한 보관 기간 및 삭제 약속을 준수합니다.

주의: 개인 식별 정보(명명된 성적표, 연락처 정보, 민감한 개인 데이터)가 포함된 원시 참가자 데이터를 AI 도구에 붙여넣는 것은 심각한 윤리적, 법적 위반입니다. 먼저 데이터를 익명화하세요. 익명화할 수 없는 경우 해당 데이터를 외부 도구에 제공하지 마십시오.

세 개의 미니 케이스

사례 1 - 익명화가 충분하지 않습니다. 연구원은 녹취록에서 이름을 삭제하고 AI에 전달했습니다. 하지만 한 참가자는 "지난해 지자체 유일의 여성 조사관으로…"라고 말했다. 이 정의만으로도 그 사람을 멀리하게 되었습니다. AI에게 “모든 기록에서 식별 세부정보를 찾아라”고 지시함으로써 11개의 잠재 식별자가 나타나 일반화되었습니다.

사례 2 — 동의 텍스트가 단순화되었습니다. 한 팀의 동의서는 무거운 법률 용어로 작성되었습니다. 참가자들은 이해하지 못한 채 서명을 하고 있었습니다. YZ는 텍스트를 8학년 읽기 수준으로 줄이고 각 기사를 일반 터키어로 만들었습니다. 이제 참가자들은 진심으로 이해하고 동의했습니다. 윤리위원회도 이를 승인했다.

사례 3 - 차량 선택으로 위기를 피했습니다. 한 박사 과정 학생이 피해자와의 민감한 인터뷰를 일반 AI 도구에 업로드하여 요약하려고 했습니다. 그의 고문은 데이터가 익명화되지 않았으며 차량의 데이터 보존 정책을 알 수 없다는 점을 상기시켰습니다. 데이터는 먼저 기관에서 승인한 데이터 보호가 보장되는 환경에서만 완전히 익명화되고 처리되었습니다.

복사 가능한 템플릿 4개

1) 익명화 관리:

아래 텍스트에 이름, 위치, 직장, 고유한 역할(“유일한”), 날짜, 관계, 질병, 희귀한 특성 등 개인을 직간접적으로 식별할 수 있는 모든 세부 사항을 표시하십시오. 각각에 대해 익명 응답을 제안합니다(예: "참여자 7", "카운티 X"). 텍스트: [여기]

2) 사전 동의 초안:

연구에 대한 일반 언어(8학년 수준) 사전 동의 텍스트 초안을 작성합니다. 여기에는 연구 목적, 수행할 작업, 기간, 자발성 및 철회 권리, 데이터 저장/삭제 방법, 기밀 보장, 커뮤니케이션이 포함됩니다. 법적 전문 용어를 피하십시오. 제목: [x]

3) 윤리적 위험 선별:

내 연구 설계: [요약]. 참가자: [누구]. 잠재적인 피해, 권력 불균형, 취약 집단, 개인 정보 보호 위험, 동의 문제 등 가능한 윤리적 위험을 나열합니다. 각 위험에 대한 완화 권장 사항을 제공합니다. 취약한 그룹이 있는 경우 특별한 주의 사항을 표시합니다.

4) AI 차량 안전 제어:

다음과 같은 유형의 데이터가 있습니다: [type]. AI 도구에서 이를 처리하기 전에 물어봐야 할 보안 질문 체크리스트를 생각해 보세요. 데이터는 어디에 저장되어 있는지, 교육에 사용되는지, 익명인지, 기관 승인이 있는지, 민감한 데이터인지 등입니다. 결정 기준을 제안합니다.

약한 프롬프트 / 강한 프롬프트

약한 프롬프트:

이 인터뷰 기록을 요약하면 다음과 같습니다. "저는 Kadıköy의 교사인 Ayşe Yılmaz입니다. 제 아내는 작년에..." [성명, ID가 포함된 텍스트]

이는 자격 증명을 외부 도구로 직접 유출하여 심각한 개인 정보 보호 위반입니다. 데이터는 전혀 익명화되지 않습니다.

강력한 프롬프트:

아래의 내용을 요약하세요. 텍스트는 사전에 익명 처리되었습니다. 이름은 "참가자 3"과 같은 코드로 대체되었고, 위치는 "카운티 X"와 같은 일반적인 문구로 대체되었으며, 식별 세부정보는 생략되었습니다. 새로운 식별자 추가 익명성을 침해하는 추론을 하지 마십시오.텍스트: [익명화된 텍스트]

차이점: 두 번째 접근 방식에서는 참가자의 신원이 도구에 전혀 도달하지 않습니다. 개인정보는 처음부터 보호됩니다.

윤리 원칙과 AI 실천

원리

의미

AI로 인한 위험

보호

사전 동의

고지된 무료 동의

간단한 동의문

해를 끼치 지 마십시오

참가자에게 해를 끼치 지 않음

잘못된 귀인

로열티 감사

개인 정보 보호

신원은 보호됩니다

데이터 유출

익명화

데이터 보안

안전한 보관

클라우드 처리

승인 차량

정직

피팅 없음

환각

소스 확인

일반적인 실수

  • 그냥 이름을 삭제하고 익명 처리한 것 같아요. 간접적인 설명어("유일한 사람")는 그 사람을 다른 사람에게 알려줍니다.
  • 원시 ID 데이터를 외부 도구에 붙여넣습니다. 이는 가장 심각한 개인정보 침해 중 하나입니다.
  • 동의문을 전문 용어로 작성합니다. 이해되지 않는 동의는 진정한 동의가 아닙니다.
  • 차량의 데이터 정책을 모릅니다. 귀하의 데이터가 어디에 저장되고 사용되는지 알아보세요.
  • 윤리적 승인을 형식적으로 처리합니다. 윤리위원회는 참가자를 보호합니다. 진지하게 받아들이십시오.

요약하면

사회 연구의 핵심은 참가자에 대한 책임입니다. 사전 동의, 비악의성 및 기밀 유지는 모든 연구의 중추입니다. 일체 포함; 이는 동의 텍스트 단순화, 윤리적 위험 심사 및 익명화 제어에 도움이 될 수 있습니다. 그러나 원시 ID 데이터를 AI 도구에 제공하는 것은 심각한 위반입니다. 먼저 데이터를 완전히 익명화하고, 간접 식별자를 명확하게 하고, 기관에서 승인한 보안 도구만 사용하고, 약속한 모든 것을 지키세요. 윤리는 연구의 장식이 아니라 전제 조건입니다.

응용과제

식별 정보가 포함된 간단한 샘플 기록을 준비합니다(직접 편집). "익명화 제어" 템플릿을 사용하여 AI에서 모든 직접 및 간접 식별자를 찾고 일반화합니다. 비밀 식별자가 몇 개나 나오는지 세어보세요. 그런 다음 "동의서 초안"을 사용하여 간단한 동의문을 작성하고 친구에게 읽어보게 하여 정말 이해할 수 있는지 테스트해 보세요.

체크리스트

  • [ ] 윤리적 승인요건 및 절차를 확인하였습니다.
  • [ ] 나는 간단하고 이해하기 쉬운 언어로 동의서를 작성했습니다.
  • [ ] AI에 데이터를 제공하기 전에 직접 및 간접 식별자를 모두 지웠습니다.
  • [ ] 내가 사용하는 AI 도구의 데이터 보존 정책을 배웠습니다.
  • [ ] 민감한 데이터를 위해 승인된 보안 미디어만 사용했습니다.