единица 1 / 11

Новият партньор на журналистиката: роли, граници и рефлекс за проверка

Печалби:

  • Възможността да се разграничи къде в работния процес на журналистиката (транскрипция, първа чернова, сканиране, превод) изкуственият интелект спестява реално време и къде решения като преценка за точност и защита на източника са оставени на журналиста, в зависимост от нивото на риска на задачата
  • Възможност за прилагане на дисциплина, която проверява всеки изход на AI, като го свързва с първичния източник, потвърждава го с вторичния източник и ръчно проверява номера.
  • Способност за разпознаване на границите на халюцинациите и пристрастията и придобиване на рефлекс за анонимизиране и почистване на метаданни, преди да предостави чувствителни документи и ресурси на изкуствения интелект

Новият партньор на журналистиката: роли, граници и рефлекс на проверка на изкуствения интелект

В една редакция времето е най-дефицитният ресурс. Репортерът се завръща от полето, носейки два часа аудиозапис, равносметка от четиридесет страници и история на браузъра от петнадесет раздела; Редакторът казва: „Имам нужда от място след половин час“. Този натиск е основната причина, поради която изкуственият интелект (AI) - компютърни програми, които могат да разбират човешкия език и да произвеждат резултати като текст, резюмета, преводи и класификации - бързо набира място в журналистиката. AI намалява повтарящите се и отнемащи време задачи (транскрипция, първа чернова, сканиране на дълъг документ, превод) до минути. Но журналистиката е професия, в която границата на грешка е много малка: фалшиво име, измислен цитат, необосновано твърдение, когато са публикувани, могат да навредят както на живота на човек, така и на репутацията на изданието. Ето защо първото изречение на модула е: AI ​​не решава вместо репортера; чернови, скорости, сканирания – но винаги работата на журналиста е да проверява истината, да защитава източника и да решава какво да се излъчва.

Тази първа единица установява три основи: разграничаване къде AI спестява реално време в работния процес на журналистиката и къде трябва да спре; рефлекс за проверка на всеки изход; защита на източник и чувствителни данни. Тези три са основната основа за сигурност за всички следващи единици.

Къде AI ускорява, къде решението принадлежи на журналиста?

Помага да се мисли за задачи за докладване по оста на риска. Рискът е колко щети ще причини на обществеността, източника и публикацията, ако нещо бъде направено погрешно.

Задачи с нисък риск, които AI ускорява много: извличане на необработен препис на аудиозапис, сканиране на основните заглавия на дълъг доклад, писане на първата чернова на новина, генериране на десет алтернативи за заглавие, препакетиране на текст за различни платформи, получаване на груб превод на чужд документ, изброяване на характерни модели в голяма таблица с данни. Тук AI решава проблема с „празната страница“ и „отсяването на стека“; Журналистът коригира, подбира, обогатява.

Задачи с висок риск, при които решението е оставено на журналиста: Обявяване на твърдение за „вярно“, публикуване на цитат, изказване, обвиняващо някого, преценка на автентичността на документ, обработка на информация, съдържаща самоличността на източник, установяване на баланса между обществен интерес и поверителност. Тези решения засягат репутацията и безопасността на хората; Отговорността и последната дума винаги е на журналиста. Тук AI най-много предлага хипотеза или контролен списък, той не може да направи преценка.

Внимание: „ИИ обобщено така“ не е повод за новини. Източникът на твърдение, истинността на цитат или автентичността на документ не могат да бъдат публикувани без потвърждението на компетентен журналист. Непотвърден резултат от AI е като слух от един източник - може да е вярно, но се нуждае от втори източник, преди да може да бъде пуснат на живо.

Защо е необходима проверка? Халюцинации и пристрастия

AI произвежда текст не чрез „познаване“, а чрез „предсказване на възможната дума“. Ето защо понякога дава изключително плавна, но всъщност невярна информация. Това се нарича халюцинация: съдебно решение, което не съществува, неизречен цитат, фалшива дата, академична работа, която не съществува, номер на дело, който изглежда реален, но е измислен. Това е фатално за журналистиката, защото изфабрикуван „източник“ срива новината и води до опровержение.

Вторият проблем е пристрастието: AI може да повтори социални модели в огромното тяло от текст, върху който е бил обучен; може систематично да очертае група, регион или мнение отрицателно или положително. Ако репортер несъзнателно внесе тази рамка в новините, обективността е нарушена.

Поради тези две ограничения предлагаме дисциплина за проверка в четири стъпки, която да се прилага към всеки изход:

  1. Слезте до източника. Върнете се към оригиналния документ, запис или първичен източник за всеки факт, име, дата, номер и цитат, които AI предоставя. AI е въплъщението; Не е доказателство.
  2. Потърсете втори източник. Правилото за докладване не се променя с AI: критичното твърдение се потвърждава от поне два независими източника.
  3. Проверете номера ръчно. Преизчислете всеки цифров изход като процент, общо, съотношение и т.н. от необработени данни.
  4. Поеми отговорност. В момента, в който одобрите публикацията, това изречение е ваше; Грешката е и в подписа ти.

Защита на ресурсите: поверителност от самото начало

В журналистиката защитата на източника е принципът за запазване на самоличността на информатора в тайна и законово право в повечето страни; За един репортер това е въпрос на чест в професията. Написването на име на информатор, местоположение, следи за самоличност на документа, който е изпратил, или подробности, които ще му позволят да бъде достигнат в публичен AI инструмент, незабавно нарушава тази защита. Много безплатни AI инструменти могат да съхраняват текста, който въвеждате, или да го използвате в обучението на модели; Така че оставяте данните извън контрола си.

Правилото е просто: първо анонимизирайте и извличайте чувствителни данни. Името на източника, телефонният номер, местоработата и метаданните в документа (автор, дата, информация за местоположението, вградена във файл) се изчистват, без да се преминава към AI. Премахнете идентифициращите редове преди хеширане на документ; обобщете хора като „Източник A“, „държавен служител“ и т.н. За чувствителни файлове, ако е възможно, изберете офлайн или корпоративни инструменти с гаранция за обработка на данни. Ще задълбочим този принцип в раздел 10; Направете го рефлекс засега.

Съвет: Преди да качите документ в AI, изчистете метаданните и потърсете в текста име, телефон, адрес, институция. Дори и най-малкият детайл, който би издал източника (дата, описание на стая), трябва да бъде пропуснат.

три мини калъфа

Случай 1 — Фабричен запис на случай. Репортер от съда поиска от YZ резюме на прецедент. YZ го даде на убедителен език заедно с три номера на „решения на Върховния съд“. Репортерът прокара числата през официалната система за търсене на решения: две от трите изобщо не бяха налични. Ако го беше използвал без проверка, щеше да излезе новина по измислен прецедент. Стъпката на проверка гарантира, че използва само единственото съществуващо решение; Новината излезе с 20 минути закъснение, но солидно.

Случай 2 — Спестяване на време при транскрипция. Екип за разследване обикновено прекарва ~40 часа ръчно в декодиране на 14 часа запис на среща. Използвайки базирана на AI транскрипция, необработеният текст беше изведен за 2 часа; Екипът прекара оставащото време в коригиране на 6-те критични пасажа спрямо записа и установяване на контекст. Общото време намаля от 40 часа на ~9 часа; Точността не намаля, защото журналистът ръчно коригира грешките в името и номера в необработения препис.

Случай 3 — Рефлекс за защита на ресурсите. Репортер, докато се опитваше да се консултира с AI относно ситуацията на държавен служител, който му е издал документ, се канеше да постави документа такъв, какъвто беше. Той забеляза, без да изпрати; изчисти метаданните на документа, премахна подписа и името на единицата, обобщи лицето като „служител на институция“. Идеите му за издателска стратегия отново проработиха; но не се появи следа, която да издаде източника.

Копируеми шаблони

1) Разделяне на задачата по ниво на риск:

Вашата роля: заместник-редактор на журналист. Разделете следните задачи за докладване на два списъка: (A) работни места с нисък риск, при които изкуственият интелект може уверено да създаде схема/резюме, (B) работни места с висок риск, при които окончателното решение трябва да бъде на журналиста. Напишете обосновка от едно изречение за всяка задача. Задачи: [поставете вашите собствени седмични задачи]

2) Подкана за лов на халюцинации:

Избройте всеки факт, име, дата, номер, цитат и източник, споменат в текста по-долу. Обозначете всеки от тях като „трябва да бъде проверен от първичен източник“ и предложете кой документ/запис трябва да се търси. Не казвайте ИСТИНА въз основа на собствените си знания; Той само извежда какво трябва да се провери. Текст: [тук]

3) Предварителна проверка за анонимизиране:

Преди да публикувате текста по-долу, маркирайте всички елементи, които могат да разкрият източника: име, заглавие, институция, местоположение, дата, разпознаваем детайл. Предложете по-безопасно обобщение за всеки флаг (напр. „държавен служител“). Не променяйте текста, само докладвайте рисковете. Текст: [тук]

4) Контролен списък за редакционна проверка:

Ще оцените чернова на новини. Избройте недостатъците под следните заглавия: (1) твърдения от един източник, (2) непроверени числа, (3) цитати с неясно приписване, (4) места, където на страните не е дадено правото да се изкажат, (5) изречения, където изводите и фактите са смесени. Просто изгответе контролен списък, не пренаписвайте новините. Чернова: [тук]

Слаба подкана / Силна подкана

Слаба подкана: „Напишете новина от този документ.“

Резултат: AI инжектира дупки, създава твърдения без приписване, добавя контекст, който не е в документа. Един журналист не може да направи разлика кое е документ и кое е измислица.

Мощна подкана: „Направете скелета на новинарска история, базирана САМО на следния документ. До всяко изречение маркирайте на кой абзац в документа се основава, като [P3]. Не добавяйте информация, която не е в документа; оставете липсващите части празни като „[трябва да се провери]“. Документ: [тук]“

Разликата: Мощната подкана свързва AI с документа, правейки всяко твърдение проследимо и прави халюцинацията видима. Журналистът знае кое изречение да потвърди.

сравнителна диаграма

Мисия

Роля на AI

Решение/отговорност

Задължителна проверка

Транскрипция на гласов запис

Генерира необработен текст

Критичните пасажи са в журналиста

Сравнете име/номер със запис

Дълго сканиране на документи

Създава заглавие и резюме

Кои са новините зависи от журналиста

Върнете се към оригиналния параграф

Първа чернова

Предлага скелет и език

Цитатите и фактите са при журналиста

Свържете всяко твърдение с източника

Избор на цитат

Знаци за номинативни изречения

Публикация на журналист

Дословно потвърждение от протокола

Обработка на източник/документ

(ограничена) помощ

Защита на самоличността на журналистите

Почистване на метаданни и имена

Често срещани грешки

  • Сбъркане на AI изхода за източник. AI е генератор на чернови, а не ресурс; Публикуването на факта без потвърждаването му от първичния документ води до отказ.
  • Поставяне на чувствителния документ такъв, какъвто е. Никой документ не трябва да влиза в публичен инструмент без изчистване на метаданни и имена, които разкриват източника.
  • Заобикаляне на правилото за "два ресурса" с AI. Компендиумът на AI е един източник; Критичното твърдение отново изисква две независими потвърждения.
  • Вярвайки на числата. AI често изчислява погрешно процентите и сумите; тествайте отново всяко число от необработените данни.
  • Неразпознаване на пристрастие. Вземането на рамката на AI без поставяне под въпрос и прехвърлянето й на езика на новините нарушава обективността.

В обобщение

В това звено ние позиционираме AI като помощник в репортажа: той ускорява повтарящите се и масово отсяващи задачи, но зависи от журналиста да реши истината, да публикува цитата и да защити източника. Халюцинациите и пристрастията са двете основни ограничения; Срещу тях дисциплината за проверка в четири стъпки (стигане до източника, втори източник, проверка на номера, поемане на отговорност) и рефлексът за поверителност от самото начало (анонимизиране, почистване на метаданни) се прилагат към всеки изход. На този терен ще бъдат монтирани следващите модули.

Задача за приложение

Запишете 8 отчетни задачи, които сте изпълнили през последната седмица. Етикетирайте всеки като „нисък риск — AI го прави по-бърз“ или „висок риск — зависи от мен“ и добавете обосновка от едно изречение. След това изберете един и приложете подканата „Hallucination hunt“ по-горе към действителен текст; Обърнете внимание колко твърдения трябва да бъдат проверени AI флаговете.

контролен списък

  • [ ] Мога да разделя задачата по ниво на риск; Познавам професии, където решението е оставено на журналиста.
  • [ ] Приписвам всеки AI резултат на първичния източник; Не заобикалям правилото за "два ресурса" с AI.
  • [ ] Знам рисковете от халюцинации и пристрастия и изчислявам числата на ръка.
  • [ ] Почиствам всякакви следи от метаданни и самоличност, преди да дам чувствителния документ/ресурс на AI.
  • [] Разбрах, че обосновката „AI каза“ е невалидна за излъчване.