Đơn vị 1 / 11

Đối tác mới của ngành báo chí: Vai trò, ranh giới và phản xạ xác minh

Lợi nhuận:

  • Có thể phân biệt vị trí nào trong quy trình làm báo (phiên âm, bản thảo đầu tiên, quét, dịch thuật) trí tuệ nhân tạo tiết kiệm thời gian thực và vị trí nào mà các quyết định như đánh giá độ chính xác và bảo vệ nguồn được giao cho nhà báo, tùy thuộc vào mức độ rủi ro của nhiệm vụ
  • Khả năng áp dụng kỷ luật xác minh từng đầu ra AI bằng cách liên kết nó với nguồn chính, xác nhận nó với nguồn phụ và kiểm tra số theo cách thủ công.
  • Khả năng nhận ra các giới hạn của ảo giác và sai lệch, đồng thời có được phản xạ làm sạch siêu dữ liệu và ẩn danh trước khi cung cấp các tài liệu và tài nguyên nhạy cảm cho trí tuệ nhân tạo

Đối tác mới của báo chí: Vai trò, giới hạn và phản xạ xác minh của trí tuệ nhân tạo

Trong một tòa soạn, thời gian là nguồn tài nguyên khan hiếm nhất. Phóng viên trở về từ hiện trường, mang theo hai giờ ghi âm, bảng cân đối kế toán dài bốn mươi trang và lịch sử trình duyệt mười lăm tab; Người biên tập nói: "Tôi cần một chỗ trong nửa giờ nữa." Áp lực này là lý do chính khiến trí tuệ nhân tạo (AI) - các chương trình máy tính có thể hiểu ngôn ngữ con người và tạo ra các kết quả như văn bản, tóm tắt, dịch thuật và phân loại - đang nhanh chóng có chỗ đứng trong ngành báo chí. AI giảm các công việc lặp đi lặp lại và tốn thời gian (phiên âm, bản thảo đầu tiên, quét tài liệu dài, dịch thuật) xuống còn vài phút. Nhưng báo chí là một nghề mà tỷ lệ sai sót rất nhỏ: một cái tên giả, một câu trích dẫn bịa đặt, một tuyên bố vô căn cứ khi được đăng tải có thể gây tổn hại đến tính mạng con người và danh tiếng của nhà xuất bản. Đó là lý do tại sao câu đầu tiên của mô-đun là: AI không quyết định thay cho phóng viên; bản nháp, tốc độ, bản quét—nhưng công việc của nhà báo luôn là xác minh sự thật, bảo vệ nguồn tin và quyết định nội dung nào sẽ được phát sóng.

Đơn vị đầu tiên này thiết lập ba nền tảng: phân biệt nơi nào AI tiết kiệm thời gian thực trong quy trình làm báo và nơi nào cần dừng lại; phản xạ xác minh mọi đầu ra; bảo vệ nguồn và dữ liệu nhạy cảm. Ba điều này là cơ sở bảo mật cơ bản cho tất cả các đơn vị tiếp theo.

AI tăng tốc ở đâu, quyết định thuộc về nhà báo?

Việc nghĩ đến việc báo cáo các nhiệm vụ trên trục rủi ro sẽ giúp ích. Rủi ro là mức độ thiệt hại mà nó sẽ gây ra cho công chúng, nguồn tin và ấn phẩm nếu làm sai điều gì đó.

Các nhiệm vụ có rủi ro thấp được AI tăng tốc rất nhiều: trích xuất bản ghi thô của bản ghi âm, quét các tiêu đề chính của một báo cáo dài, viết bản thảo đầu tiên của một câu chuyện tin tức, tạo ra mười lựa chọn thay thế cho tiêu đề, đóng gói lại văn bản cho các nền tảng khác nhau, nhận bản dịch thô của một tài liệu nước ngoài, liệt kê các mẫu nổi bật trong một bảng dữ liệu lớn. Ở đây AI giải quyết vấn đề “trang trống” và “sàng lọc ngăn xếp”; Nhà báo sửa chữa, chọn lọc, bổ sung thêm.

Các nhiệm vụ có rủi ro cao mà quyết định được giao cho nhà báo: Tuyên bố một tuyên bố là "đúng", xuất bản một trích dẫn, đưa ra tuyên bố buộc tội ai đó, đánh giá tính xác thực của tài liệu, xử lý thông tin chứa danh tính của một nguồn, thiết lập sự cân bằng giữa lợi ích công cộng và quyền riêng tư. Những quyết định này ảnh hưởng đến uy tín và sự an toàn của mọi người; Trách nhiệm và tiếng nói cuối cùng luôn thuộc về nhà báo. Ở đây, AI nhiều nhất chỉ gợi ý một giả thuyết hoặc danh sách kiểm tra, nó không thể đưa ra phán đoán.

Lưu ý: "AI tóm tắt như thế này" không phải là lý do mới mẻ. Nguồn của tuyên bố, tính trung thực của trích dẫn hoặc tính xác thực của tài liệu không thể được công bố nếu không có sự xác nhận của nhà báo có thẩm quyền. Đầu ra AI chưa được xác nhận giống như tin đồn về một nguồn duy nhất - nó có thể đúng, nhưng nó cần nguồn thứ hai trước khi có thể hoạt động.

Tại sao cần phải xác minh? Ảo giác và thiên vị

AI tạo ra văn bản không phải bằng cách "biết" mà bằng cách "dự đoán từ có thể". Chính vì vậy mà đôi khi nó đưa ra những thông tin cực kỳ trôi chảy nhưng thực chất lại không chính xác. Đây gọi là ảo giác: một quyết định của tòa án không tồn tại, một trích dẫn ngầm, một ngày tháng giả, một bài báo học thuật không tồn tại, một số vụ án có vẻ như thật nhưng lại bịa đặt. Điều này gây tử vong cho báo chí, vì một “nguồn” bịa đặt đã làm hỏng tin tức và dẫn đến sự phủ nhận.

Vấn đề thứ hai là sự thiên vị: AI có thể lặp lại các mô hình xã hội trong khối văn bản khổng lồ mà nó đã được đào tạo; có thể định hình một cách có hệ thống một nhóm, khu vực hoặc quan điểm tiêu cực hoặc tích cực. Nếu phóng viên vô tình đưa khuôn khổ này vào tin tức thì tính khách quan sẽ bị tổn hại.

Do hai giới hạn này, chúng tôi đề xuất áp dụng kỷ luật xác minh bốn bước cho mỗi đầu ra:

  1. Đi xuống nguồn. Quay lại tài liệu, bản ghi hoặc nguồn chính ban đầu cho mọi sự kiện, tên, ngày tháng, số và trích dẫn mà AI cung cấp. AI là hình ảnh thu nhỏ; Nó không phải là bằng chứng.
  2. Hãy tìm nguồn thứ hai. Quy tắc báo cáo không thay đổi với AI: tuyên bố quan trọng được xác nhận bởi ít nhất hai nguồn độc lập.
  3. Kiểm tra số bằng tay. Tính toán lại mọi kết quả đầu ra bằng số như tỷ lệ phần trăm, tổng, tỷ lệ, v.v. từ dữ liệu thô.
  4. Chịu trách nhiệm. Thời điểm bạn chấp thuận xuất bản, câu đó là của bạn; Lỗi còn ở chữ ký của bạn.

Bảo vệ tài nguyên: quyền riêng tư ngay từ đầu

Trong báo chí, bảo vệ nguồn tin là nguyên tắc giữ bí mật danh tính của người cung cấp thông tin và là quyền hợp pháp ở hầu hết các quốc gia; Đối với một phóng viên, đó là vấn đề danh dự trong nghề. Việc viết tên, vị trí, dấu vết nhận dạng của người cung cấp thông tin trong tài liệu anh ta đã gửi hoặc các thông tin chi tiết sẽ cho phép anh ta tiếp cận được một công cụ AI công khai sẽ ngay lập tức vi phạm biện pháp bảo vệ này. Nhiều công cụ AI miễn phí có thể lưu trữ văn bản bạn nhập hoặc sử dụng văn bản đó trong đào tạo mô hình; Vì vậy, bạn đặt dữ liệu ra khỏi tầm kiểm soát của bạn.

Quy tắc rất đơn giản: Trước tiên hãy ẩn danh và trích xuất dữ liệu nhạy cảm. Tên, số điện thoại, nơi làm việc và siêu dữ liệu trong tài liệu (tác giả, ngày tháng, thông tin vị trí được nhúng trong tệp) sẽ bị xóa mà không cần đến AI. Xóa các dòng nhận dạng trước khi băm tài liệu; khái quát hóa những người như "Nguồn A", "quan chức", v.v. Đối với các tệp nhạy cảm, nếu có thể, hãy chọn các công cụ ngoại tuyến hoặc công ty có đảm bảo xử lý dữ liệu. Chúng ta sẽ đào sâu nguyên tắc này ở bài 10; Bây giờ hãy biến nó thành một phản xạ.

Mẹo: Trước khi tải tài liệu lên AI, hãy xóa siêu dữ liệu và tìm kiếm văn bản theo tên, điện thoại, địa chỉ, tổ chức. Ngay cả chi tiết nhỏ nhất có thể tiết lộ nguồn (ngày tháng, mô tả về căn phòng) cũng phải được lược bỏ.

ba trường hợp nhỏ

Trường hợp 1 - Hồ sơ trường hợp bịa đặt. Một phóng viên của tòa án đã yêu cầu YZ cung cấp bản tóm tắt tiền lệ. YZ đã đưa ra nó bằng ngôn ngữ thuyết phục cùng với ba con số "Quyết định của Tòa án Tối cao". Phóng viên đã chạy các con số qua hệ thống tìm kiếm quyết định chính thức: hai trong số ba con số đó hoàn toàn không có. Nếu anh ta sử dụng nó mà không kiểm tra, một bản tin sẽ xuất hiện dựa trên một tiền lệ bịa đặt. Bước xác minh đảm bảo rằng nó chỉ sử dụng quyết định duy nhất hiện có; Tin tức đến muộn 20 phút nhưng chắc chắn.

Trường hợp 2 - Tiết kiệm thời gian trong phiên âm. Một nhóm điều tra thường dành ~40 giờ để giải mã thủ công 14 giờ cảnh quay cuộc họp. Sử dụng phiên âm dựa trên AI, văn bản thô được xuất ra sau 2 giờ; Nhóm đã dành thời gian còn lại để sửa 6 đoạn quan trọng dựa trên bối cảnh ghi âm và thiết lập. Tổng thời gian giảm từ 40 giờ xuống còn ~9 giờ; Độ chính xác không giảm do nhà báo đã tự tay sửa lỗi tên, số trong bản ghi thô.

Trường hợp 3 - Phản xạ bảo vệ tài nguyên. Một phóng viên đang cố gắng hỏi ý kiến ​​AI về trường hợp một công chức đã rò rỉ tài liệu cho anh ta và đã định dán tài liệu đó như cũ. Anh để ý mà không gửi; đã làm sạch siêu dữ liệu của tài liệu, xóa chữ ký và tên đơn vị, khái quát người đó là "nhân viên của một tổ chức". Những ý tưởng về chiến lược xuất bản của ông lại phát huy tác dụng; nhưng không có dấu vết nào nổi lên để tiết lộ nguồn gốc.

Mẫu có thể sao chép

1) Tách nhiệm vụ theo mức độ rủi ro:

Vai trò của bạn: trợ lý biên tập phụ cho một nhà báo. Chia các nhiệm vụ báo cáo sau thành hai danh sách: (A) những công việc có rủi ro thấp trong đó AI có thể tự tin đưa ra đề cương/tóm tắt, (B) những công việc có rủi ro cao trong đó quyết định cuối cùng phải thuộc về nhà báo. Viết một câu biện minh cho mỗi nhiệm vụ. Nhiệm vụ: [dán nhiệm vụ hàng tuần của riêng bạn]

2) Lời nhắc săn ảo giác:

Liệt kê từng sự kiện, tên, ngày tháng, con số, trích dẫn và nguồn tin được đề cập trong văn bản dưới đây. Dán nhãn cho mỗi tài liệu "phải được xác minh từ nguồn chính" và đề xuất tài liệu/hồ sơ nào cần tìm. Đừng nói ĐÚNG dựa trên kiến ​​thức của riêng bạn; Nó chỉ suy ra những gì cần được xác minh. Văn bản: [tại đây]

3) Kiểm tra trước ẩn danh:

Trước khi xuất bản văn bản bên dưới, hãy gắn cờ bất kỳ yếu tố nào có thể tiết lộ nguồn: tên, chức danh, cơ quan, địa điểm, ngày tháng, chi tiết có thể nhận biết. Đề xuất cách khái quát hóa an toàn hơn cho mỗi lá cờ (ví dụ: "một công chức"). Đừng thay đổi văn bản, chỉ báo cáo rủi ro. Văn bản: [tại đây]

4) Danh sách kiểm tra xác minh biên tập:

Bạn sẽ đánh giá một bản dự thảo tin tức. Liệt kê những thiếu sót theo các tiêu đề sau: (1) những tuyên bố từ một nguồn duy nhất, (2) những con số chưa được xác minh, (3) những trích dẫn không rõ nguồn gốc, (4) những chỗ mà các bên không được quyền phát biểu, (5) những câu có sự kết hợp giữa suy luận và thực tế. Chỉ cần tạo một danh sách kiểm tra, không viết lại tin tức. Bản nháp: [tại đây]

Dấu nhắc yếu / Dấu nhắc mạnh

Lời nhắc yếu: "Viết một câu chuyện tin tức từ tài liệu này."

Kết quả: AI tạo ra các lỗ hổng, tạo ra các xác nhận quyền sở hữu không được phân bổ, thêm ngữ cảnh không có trong tài liệu. Một nhà báo không thể phân biệt đâu là tài liệu và đâu là bịa đặt.

Lời nhắc mạnh mẽ: "Tạo khung của một câu chuyện tin tức CHỈ dựa trên tài liệu sau. Bên cạnh mỗi câu, đánh dấu đoạn nào trong tài liệu mà nó dựa vào, chẳng hạn như [P3]. Không thêm bất kỳ thông tin nào không có trong tài liệu; để trống những phần còn thiếu là '[phải được xác minh]'. Tài liệu: [tại đây]"

Sự khác biệt: Lời nhắc mạnh mẽ liên kết AI với tài liệu, giúp theo dõi từng xác nhận quyền sở hữu và làm cho ảo giác hiển thị. Nhà báo biết câu nào cần khẳng định.

biểu đồ so sánh

Nhiệm vụ

Vai trò của AI

Quyết định/trách nhiệm

Xác minh bắt buộc

Phiên âm ghi âm giọng nói

Tạo văn bản thô

Những đoạn phê phán có trong nhà báo

So sánh tên/số với bản ghi

Quét tài liệu dài

Tạo tiêu đề và tóm tắt

Tin tức thế nào là tùy nhà báo

Quay lại đoạn gốc

Viết bản thảo đầu tiên

Đề xuất bộ xương và ngôn ngữ

Trích dẫn và sự kiện là với các nhà báo

Liên kết mọi khiếu nại với nguồn

Lựa chọn trích dẫn

Dấu hiệu câu danh định

Xuất bản của nhà báo

Xác nhận nguyên văn từ hồ sơ

Xử lý nguồn/tài liệu

(có giới hạn) sự hỗ trợ

Bảo vệ danh tính cho nhà báo

Làm sạch siêu dữ liệu và tên

Những lỗi thường gặp

  • Nhầm đầu ra AI với một nguồn. AI là công cụ tạo bản nháp, không phải tài nguyên; Công bố sự thật mà không xác nhận nó từ tài liệu chính sẽ dẫn đến sự phủ nhận.
  • Dán tài liệu nhạy cảm như cũ. Không có tài liệu nào được đưa vào một công cụ công khai mà không xóa siêu dữ liệu và các tên tiết lộ nguồn.
  • Vượt qua quy luật “hai nguồn lực” với AI. Bản tóm tắt về AI là một nguồn duy nhất; Tuyên bố quan trọng một lần nữa yêu cầu hai xác nhận độc lập.
  • Tin tưởng vào những con số. AI thường xuyên tính toán sai tỷ lệ phần trăm và tổng số; kiểm tra lại từng số từ dữ liệu thô.
  • Không thừa nhận sự thiên vị. Việc sử dụng khuôn khổ AI mà không đặt câu hỏi và chuyển nó sang ngôn ngữ của tin tức sẽ phá vỡ tính khách quan.

Tóm lại

Trong đơn vị này, chúng tôi định vị AI như một trợ lý trong việc đưa tin: nó tăng tốc các nhiệm vụ lặp đi lặp lại và sàng lọc hàng loạt, nhưng việc quyết định sự thật, xuất bản trích dẫn và bảo vệ nguồn tin là tùy thuộc vào nhà báo. Ảo giác và thành kiến ​​là hai giới hạn chính; Để chống lại những điều này, kỷ luật xác minh bốn bước (truy cập nguồn, nguồn thứ hai, kiểm tra số, chịu trách nhiệm) và phản ánh quyền riêng tư ngay từ đầu (ẩn danh, làm sạch siêu dữ liệu) được áp dụng cho mọi đầu ra. Các đơn vị tiếp theo sẽ được lắp đặt trên mặt đất này.

Nhiệm vụ ứng dụng

Viết ra 8 nhiệm vụ báo cáo bạn đã làm trong tuần trước. Gắn nhãn cho mỗi mục là “rủi ro thấp - AI làm cho nó nhanh hơn” hoặc “rủi ro cao – tùy thuộc vào tôi” và thêm một câu biện minh. Sau đó chọn một và áp dụng lời nhắc “Săn ảo giác” ở trên vào văn bản thực tế; Lưu ý có bao nhiêu xác nhận mà cờ AI thực sự cần được xác minh.

danh sách kiểm tra

  • [ ] Tôi có thể tách nhiệm vụ theo mức độ rủi ro; Tôi biết những công việc mà quyền quyết định thuộc về nhà báo.
  • [ ] Tôi quy mỗi đầu ra AI cho nguồn chính; Tôi không bỏ qua quy tắc “hai tài nguyên” với AI.
  • [ ] Tôi biết những rủi ro của ảo giác và sai lệch, và tôi xử lý các con số bằng tay.
  • [ ] Tôi xóa sạch mọi dấu vết siêu dữ liệu và danh tính trước khi cung cấp tài liệu/tài nguyên nhạy cảm cho AI.
  • [ ] Tôi đã hiểu rằng lời biện minh "AI đã nói" không hợp lệ để phát sóng.