Đơn vị 11 / 12

Đạo đức, Bản quyền, Quyền riêng tư và Sự nhạy cảm về văn hóa

Lợi nhuận:

  • Khả năng quét quyền riêng tư và chọn phương pháp thích hợp (ẩn danh, công cụ đóng) trước khi tải dữ liệu cá nhân nhạy cảm lên các công cụ dựa trên đám mây
  • Khả năng làm rõ tình trạng bản quyền và tính nhạy cảm về văn hóa của tài liệu trước khi sử dụng
  • Khả năng nhận ra rằng AI tái tạo sự thiên vị trong các nguồn, thêm khung quan trọng và tuyên bố minh bạch việc sử dụng AI

Lịch sử và tài liệu lưu trữ không phải là một khối dữ liệu trung tính. Sổ đăng ký dân sự có thể chứa thông tin cá nhân của người còn sống, hồ sơ tòa án có thể chứa đời sống riêng tư nhạy cảm, tài liệu văn hóa được cộng đồng coi là thiêng liêng, tác phẩm vẫn còn bản quyền. Khi AI giúp việc thao tác vật liệu này trở nên dễ dàng hơn, hậu quả của việc sử dụng sai mục đích sẽ gia tăng. Đơn vị này đào sâu khuôn khổ đạo đức bao quanh toàn bộ mô-đun: quyền riêng tư, bản quyền, sự nhạy cảm về văn hóa cũng như tính minh bạch và tính xác thực trong việc sử dụng AI.

Những vấn đề này không phải là vấn đề kỹ thuật, nhưng ít nhất chúng cũng quan trọng như vấn đề kỹ thuật; Bởi vì vi phạm quyền riêng tư, vi phạm bản quyền hoặc bỏ qua sự nhạy cảm của cộng đồng sẽ gây ra cả hậu quả pháp lý và sự mất lòng tin không thể khắc phục.

Quyền riêng tư: quyền của người sống và người chết

Tài liệu lưu trữ thường chứa dữ liệu cá nhân: tên, địa chỉ, thông tin sức khỏe, hồ sơ tòa án, nguồn gốc tôn giáo/dân tộc. Một số trong số chúng thuộc về người sống và phải tuân theo luật bảo vệ dữ liệu cá nhân (chẳng hạn như KVKK ở Türkiye, GDPR ở Châu Âu).

  • Người sống: Tải tài liệu chứa dữ liệu nhạy cảm có thể nhận dạng lên các công cụ AI dựa trên đám mây, công khai có thể là vi phạm nghiêm trọng. Những công cụ này có thể lưu trữ dữ liệu, sử dụng dữ liệu trong giáo dục hoặc tiết lộ dữ liệu.
  • Người đã qua đời: Trách nhiệm đạo đức vẫn được duy trì ngay cả khi sự bảo vệ của pháp luật giảm bớt; Việc tiết lộ quá khứ nhạy cảm của một người một cách không cần thiết có thể gây tổn hại đến nhân phẩm của họ và gia đình họ.
  • Hạn chế truy cập: Nhiều cơ quan lưu trữ áp đặt các hạn chế truy cập đối với các tài liệu nhạy cảm trong một khoảng thời gian nhất định. “Hiệu quả” của AI không thể là lý do biện minh cho việc khắc phục những hạn chế này.
Thận trọng: Trước khi tải tài liệu lên công cụ AI dựa trên đám mây, hãy luôn hỏi: "Ai sẽ bị tổn hại nếu nội dung này bị rò rỉ ra Internet?" Nếu câu trả lời là “một trong số đó”, trước tiên hãy tìm kiếm sự chấp thuận của công ty, ẩn danh dữ liệu và công cụ cục bộ/đóng nếu có thể. Việc tải lên dữ liệu cá nhân một cách bừa bãi là không thể đảo ngược.

Bản quyền: không phải mọi tài liệu đều được công khai

Chỉ vì tài liệu nằm trong kho lưu trữ về mặt vật lý không có nghĩa là bạn có thể sử dụng nó một cách tự do. Bản quyền là quyền thuộc về người tạo ra tác phẩm được bảo vệ trong một khoảng thời gian nhất định.

  • Phạm vi công cộng: Các tác phẩm đã hết bản quyền có thể được sử dụng tự do. Thời lượng thay đổi tùy theo quốc gia và công việc.
  • Tác phẩm có bản quyền: Thư, ảnh, bài viết chưa xuất bản có thể có bản quyền; Đưa chúng cho AI hoặc xuất bản chúng có thể cấu thành hành vi vi phạm quyền.
  • AI và bản quyền: Để AI xử lý một văn bản có bản quyền đồng nghĩa với việc chuyển nó sang hệ thống của bên thứ ba (nhà cung cấp công cụ); Điều này có thể gây ra vấn đề cả về bản quyền và hợp đồng.

Sự nhạy cảm về văn hóa và quyền cộng đồng

Một số tài liệu lịch sử chạm đến ký ức, niềm tin hoặc bản sắc của một số cộng đồng nhất định. Điều này bao gồm các hồ sơ thời kỳ thuộc địa, tài liệu thuộc về cộng đồng bản địa/thiểu số và các tài liệu được coi là thiêng liêng. Nguyên tắc chỉ đạo ở đây là tôn trọng tiếng nói và quyền của cộng đồng đã tạo ra tài liệu hoặc tài liệu mà nó đại diện. Đề xuất "hiệu quả nhất" của AI không thể bỏ qua tiếng nói của cộng đồng về lịch sử của chính nó. Ngoài ra, AI có thể vô tình tái tạo ngôn ngữ thành kiến, xúc phạm hoặc loại trừ trong các nguồn lịch sử; Cần phải cảnh giác với ngôn ngữ này.

Tính minh bạch và tính xác thực

Trong ngành nhân văn, tính độc đáo (tác phẩm thực sự là sản phẩm lao động của chính bạn) và tính minh bạch (truyền đạt rõ ràng về phương pháp của bạn) là những giá trị cốt lõi.

  • Khai báo việc sử dụng AI: Nếu bản chép lại, siêu dữ liệu hoặc bản dịch được tạo ra với sự trợ giúp của AI, hãy ghi lại nó. Các nhà nghiên cứu tiếp theo sẽ có thể xác minh.
  • Giới hạn quyền sở hữu lao động: Việc trình bày nhận xét hoặc văn bản do AI tạo ra như ý tưởng ban đầu của riêng bạn là trái với sự trung thực trong học thuật.
  • Tuân theo các hướng dẫn của tổ chức và xuất bản: Nhiều tổ chức và tạp chí đã thiết lập các quy tắc về cách tuyên bố sử dụng AI.

chủ đề

câu hỏi cơ bản

Hậu quả nếu sai

Quyền riêng tư

Dữ liệu này xác định ai?

Vi phạm pháp luật, xâm hại quyền riêng tư

bản quyền

Tôi có quyền sử dụng cái này không?

Vi phạm quyền, kiện tụng

Sự nhạy cảm về văn hóa

Ký ức này là của ai?

Mất niềm tin và sự tôn trọng

minh bạch

Tôi đã đề cập đến việc tôi sử dụng AI chưa?

Vi phạm liêm chính học thuật

định kiến

Giọng nói của ai bị méo/mất?

sự bóp méo lịch sử

ba trường hợp nhỏ

Trường hợp 1 - Hồ sơ sức khỏe được tải lên. Một nhà nghiên cứu đã có một hồ sơ bệnh viện thế kỷ 20 (bao gồm thông tin xác định con cháu của những người còn sống) được tải và sao chép trực tiếp vào một công cụ AI có sẵn công khai. Nhân viên bảo vệ dữ liệu của tổ chức đã nhận thấy tình hình; tài liệu chứa dữ liệu cá nhân nhạy cảm và việc tải lên là vi phạm. Bài học: dữ liệu cá nhân nhạy cảm không được tải lên nếu không có công cụ đóng/được phê duyệt.

Trường hợp 2 - Ảnh có bản quyền. Đối với một ấn phẩm, ảnh có bản quyền từ kho lưu trữ đã được cải tiến bằng AI và được xuất bản. Những người thừa kế của nhiếp ảnh gia đã báo cáo sự vi phạm quyền lợi. Ở trong kho lưu trữ không cấp quyền sử dụng. Bài học: tình trạng bản quyền của từng tài liệu được làm rõ trước khi sử dụng.

Trường hợp 3 - Tái tạo thành kiến. Một sinh viên đã được YZ tóm tắt một hồ sơ thời thuộc địa. Bản tóm tắt sao chép mà không nghi ngờ ngôn ngữ xúc phạm và quan điểm phiến diện về nguồn; Quan điểm của cộng đồng đó hoàn toàn không có. Với lời cảnh báo của cố vấn, sinh viên đã kiểm tra lại nguồn với khuôn khổ quan trọng và bổ sung phần âm thanh còn thiếu. Bài học: AI sao chép thành kiến ​​của nguồn; Công việc của nhà nghiên cứu là bổ sung khuôn khổ quan trọng và tiếng nói còn thiếu.

Bốn mẫu có thể sao chép

1) Kiểm tra quyền riêng tư trước khi cài đặt:

Thực hiện kiểm tra quyền riêng tư TRƯỚC KHI tải văn bản tài liệu sau vào công cụ AI: (1) Có dữ liệu nhạy cảm (sức khỏe, tôn giáo, dân tộc, địa chỉ) nhận dạng các cá nhân đang sống hoặc gần đây không? (2) Nếu vậy thì đó là phần nào? (3) Có thể ẩn danh được không? Quyết định cuối cùng là của tôi; Bạn đánh dấu các khu vực nguy hiểm. Văn bản: [tại đây]

2) Đánh giá tình trạng bản quyền:

Thông tin về loại, ngày dự kiến ​​và người tạo ra tài liệu dưới đây như sau: [thông tin]. Liệt kê những câu hỏi về bản quyền mà tôi nên hỏi và những điều tôi nên làm rõ trước khi sử dụng. ĐƯA RA phán quyết pháp lý cuối cùng; Cung cấp điểm để kiểm tra.

3) Điều khiển sai lệch và thiếu âm lượng:

Trong bản tóm tắt nguồn lịch sử bên dưới: (1) thành kiến/ngôn ngữ xúc phạm của chính nguồn được sao chép ở đâu, (2) tiếng nói của nhóm/quan điểm nào bị thiếu? Hãy nêu bật những điều này và đề xuất cách chúng có thể được đóng khung một cách nghiêm túc. Tóm tắt: [tại đây]

4) Dự thảo tuyên bố sử dụng AI:

Trong một nghiên cứu, tôi đã sử dụng AI trong: [phiên âm/dịch/siêu dữ liệu/tóm tắt]. Viết bản dự thảo "Tuyên bố sử dụng AI" có thể được sử dụng để minh bạch trong học thuật: trong công việc gì, với công cụ nào, cách thức xác minh của con người được thực hiện. cường điệu; Hãy trung thực và rõ ràng.

Dấu nhắc yếu / Dấu nhắc mạnh

yếu:

Xử lý tài liệu lưu trữ này và trích xuất nội dung của nó cho tôi.

Trạng thái bảo mật, bản quyền và độ nhạy cảm của tài liệu được trao trực tiếp cho AI mà không bị thẩm vấn; Nguy cơ vi phạm vẫn vô hình.

Mạnh:

Trước khi xử lý tài liệu này: đánh dấu bất kỳ khu vực nào có thể gây rủi ro về dữ liệu cá nhân nhạy cảm, bản quyền và tính nhạy cảm về văn hóa. Nếu có phần rủi ro, tôi sẽ xem lại phương pháp xử lý của mình (ẩn danh, xác nhận, công cụ đóng). Chỉ trích xuất nội dung được phê duyệt. Tài liệu: [tại đây]

Sự khác biệt: sàng lọc rủi ro trước khi xử lý, gắn cờ nội dung rủi ro và xem xét phương pháp ngăn chặn hành vi vi phạm đạo đức ngay từ đầu.

Những lỗi thường gặp

  • Tải lên dữ liệu nhạy cảm một cách bừa bãi. Dữ liệu cá nhân sẽ không được tải lên nếu không có công cụ đóng/được phê duyệt và ẩn danh nếu cần thiết.
  • Giả sử "nó ở trong kho lưu trữ, tôi có thể sử dụng nó". Truy cập vật lý không trao bản quyền; tình hình được làm rõ.
  • Bỏ qua sự nhạy cảm về văn hóa. Quyền của một cộng đồng có tiếng nói trong lịch sử của chính mình được tôn trọng.
  • Sao chép thành kiến ​​mà không thắc mắc. Ngôn ngữ một chiều của nguồn được giải quyết bằng một khuôn khổ quan trọng và giọng nói còn thiếu sẽ được thêm vào.
  • Ẩn việc sử dụng AI. Minh bạch là yêu cầu trung thực trong học thuật; việc sử dụng được khai báo.

Tóm lại

Đạo đức là khuôn khổ bao quanh các đơn vị kỹ thuật của học phần này. Quyền riêng tư bao gồm bảo vệ dữ liệu cá nhân nhạy cảm; Làm rõ bản quyền, quyền sử dụng; sự nhạy cảm về văn hóa, tôn trọng quyền của cộng đồng có tiếng nói trong lịch sử của chính họ; Tính minh bạch và tính xác thực đòi hỏi phải khai báo trung thực việc sử dụng AI. AI cũng tái tạo những thành kiến ​​trong các nguồn; Trách nhiệm của nhà nghiên cứu là bổ sung khuôn khổ quan trọng và tiếng nói còn thiếu vào vấn đề này. Hiệu quả không bao giờ có thể biện minh cho việc vượt quá những nguyên tắc này. Khi sức mạnh kỹ thuật tăng lên, sự chú ý về mặt đạo đức cũng phải tăng lên.

Nhiệm vụ ứng dụng

Chọn một tài liệu bạn định xử lý. Trước tiên, hãy quét dữ liệu nhạy cảm bằng mẫu “kiểm tra quyền riêng tư cài đặt sẵn” và gắn cờ các phần rủi ro. Sau đó loại bỏ những câu hỏi cần làm rõ trước khi sử dụng bằng tính năng "đánh giá tình trạng bản quyền". Cuối cùng, hãy xem lại bản tóm tắt nguồn bằng cách “kiểm tra sai lệch và thiếu số lượng”. Đưa ra quyết định hợp lý về việc có phù hợp để tải tài liệu lên công cụ dựa trên đám mây hay không.

danh sách kiểm tra

  • [ ] Tôi đã quét dữ liệu cá nhân nhạy cảm trước khi tải lên.
  • [ ] Tôi đã làm rõ tình trạng bản quyền của tài liệu.
  • [ ] Tôi quan sát thấy sự nhạy cảm về văn hóa và quyền cộng đồng.
  • [ ] Tôi đã giải quyết thành kiến ​​của nguồn bằng một khuôn khổ quan trọng.
  • [ ] Tôi đã tuyên bố minh bạch việc sử dụng AI của mình.