Добивки:
- Може да разликува каде во работниот тек на новинарството (транскрипција, прв нацрт, скенирање, превод) вештачката интелигенција заштедува реално време и каде одлуките како што се проценката на точноста и заштитата на изворот се препуштени на новинарот, во зависност од нивото на ризик на задачата.
- Способност да се примени дисциплина која го потврдува секој излез на ВИ со поврзување со примарниот извор, потврдување со секундарниот извор и рачно проверување на бројот.
- Способност да се препознаат границите на халуцинација и пристрасност и да се стекне рефлексот за анонимизација и чистење на метаподатоци пред да се дадат чувствителни документи и ресурси на вештачката интелигенција
Новиот партнер на новинарството: улоги, граници и верификационен рефлекс на вештачката интелигенција
Во редакцијата, времето е најскудниот ресурс. Репортерот се враќа од теренот, носејќи два часа аудио снимка, биланс од четириесет страници и историја на прелистувач со петнаесет јазичиња; Уредникот вели: „Ми треба место за половина час“. Овој притисок е главната причина зошто вештачката интелигенција (ВИ) - компјутерски програми кои можат да го разберат човечкиот јазик и да произведуваат резултати како што се текст, резимеа, преводи и класификации - брзо добива на терен во новинарството. Вештачката интелигенција ги намалува повторливите и одземаат многу време задачи (транскрипција, прв нацрт, скенирање долг документ, превод) на минути. Но, новинарството е професија каде што маргината на грешка е многу мала: лажно име, измислен цитат, неосновано тврдење, кога е објавено, може да му наштети и на животот на една личност и на угледот на публикацијата. Затоа првата реченица на модулот е: ВИ не одлучува за известувачот; нацрти, брзини, скенирања - но секогаш задача на новинарот е да ја потврди вистината, да го заштити изворот и да одлучи што ќе се емитува.
Оваа прва единица воспоставува три основи: разликување каде вештачката интелигенција заштедува реално време во работниот тек на новинарството и каде треба да престане; рефлекс за проверка на секој излез; заштита на изворните и чувствителни податоци. Овие три се основната безбедносна основа за сите следни единици.
Каде забрзува вештачката интелигенција, каде одлуката му припаѓа на новинарот?
Помага да се размислува за задачи за известување на оската на ризик. Ризик е колкава штета ќе предизвика на јавноста, изворот и публикацијата доколку нешто се направи погрешно.
Задачи со низок ризик што вештачката интелигенција многу ги забрзува: извлекување необработен транскрипт од аудио снимка, скенирање на главните наслови на долг извештај, пишување на првиот нацрт на вести, генерирање на десет алтернативи за наслов, препакување текст за различни платформи, добивање груб превод на странски документ, наведување на истакнати обрасци во голема табела со податоци. Овде вештачката интелигенција го решава проблемот со „празна страница“ и „просејување на магацинот“; Новинарот корегира, избира, збогатува.
Задачи со висок ризик каде што одлуката е препуштена на новинарот: прогласување на тврдењето за „вистинито“, објавување цитат, давање изјава со која се обвинува некого, судење за автентичноста на документот, обработка на информации што го содржат идентитетот на изворот, воспоставување рамнотежа јавен интерес-приватност. Овие одлуки влијаат на угледот и безбедноста на луѓето; Одговорноста и последниот збор секогаш му припаѓаат на новинарот. Овде, вештачката интелигенција најмногу предлага хипотеза или листа за проверка, не може да донесе пресуда.
Внимание: „Ви резимирано вака“ не е вест. Изворот на тврдењето, вистинитоста на цитатот или автентичноста на документот не може да се објави без потврда од компетентен новинар. Непотврдениот излез на вештачката интелигенција е како гласина од еден извор - можеби е вистина, но му треба втор извор пред да може да се емитува.
Зошто е неопходна проверка? Халуцинација и пристрасност
ВИ произведува текст не со „знаење“ туку со „предвидување на можниот збор“. Затоа понекогаш дава исклучително течни, но всушност неточни информации. Ова се нарекува халуцинација: судска одлука што не постои, неискажан цитат, лажен датум, академски труд што не постои, број на предмет што изгледа вистински, но е измислен. Ова е фатално за новинарството, бидејќи измислен „извор“ ја урива веста и води до демант.
Вториот проблем е пристрасноста: вештачката интелигенција може да повторува општествени обрасци во огромниот текст на кој е обучен; може систематски да врами група, регион или мислење негативно или позитивно. Ако новинарот несвесно ја внесе оваа рамка во вестите, објективноста е нарушена.
Поради овие две ограничувања, предлагаме дисциплина за верификација во четири чекори да се примени на секој излез:
- Одете до изворот. Вратете се на оригиналниот документ, запис или примарен извор за секој факт, име, датум, број и цитат што ги дава вештачката интелигенција. ВИ е олицетворение; Тоа не е доказ.
- Побарајте втор извор. Правилото за известување не се менува со вештачката интелигенција: критичкото тврдење е потврдено од најмалку два независни извори.
- Проверете го бројот рачно. Пресметајте го секој нумерички излез како процент, вкупен, однос итн. од необработени податоци.
- Преземете одговорност. Во моментот кога ќе го одобрите објавувањето, таа реченица е ваша; Грешката е и во вашиот потпис.
Заштита на ресурсите: приватност од самиот почеток
Во новинарството, заштитата на изворот е принципот на задржување на идентитетот на информаторот доверлив и законско право во повеќето земји; За еден репортер тоа е прашање на чест во професијата. Пишувањето на името на информаторот, локацијата, трагите на идентитетот на документот што го испратил или детали што ќе му овозможат да се допре до јавна алатка за вештачка интелигенција веднаш ја нарушува оваа заштита. Многу бесплатни алатки за вештачка интелигенција можат да го складираат текстот што го внесувате или да го користат во обуката за модели; Така ги ставате податоците надвор од ваша контрола.
Правилото е едноставно: прво анонимизирајте и извлечете чувствителни податоци. Името на изворот, телефонскиот број, местото на вработување и метаподатоците во документот (автор, датум, информации за локацијата вградени во датотека) се бришат без да се оди на вештачката интелигенција. Отстранете ги линиите за идентификација пред да го хеширате документот; генерализирајте ги луѓето како „Извор А“, „јавен службеник“ итн. За чувствителни датотеки, доколку е можно, изберете офлајн или корпоративни алатки со гаранција за обработка на податоци. Овој принцип ќе го продлабочиме во единица 10; Направете го тоа како рефлекс засега.
Совет: Пред да поставите документ на вештачка интелигенција, исчистете ги метаподатоците и пребарајте го текстот за име, телефон, адреса, институција. Дури и најмалиот детал што би го дал изворот (датум, опис на соба) мора да се изостави.
три мини футроли
Случај 1 - Фабрикуван запис за случај. Новинар од судската куќа побара од YZ резиме за преседан. YZ го даде на убедлив јазик заедно со три броја „одлуки на Врховниот суд“. Репортерот ги насочи бројките преку официјалниот систем за пребарување одлуки: два од трите воопшто не беа достапни. Да ја користел без проверка, ќе се појавила вест врз основа на измислен преседан. Чекорот за верификација осигури дека ја користи само единствената постоечка одлука; Веста излезе 20 минути доцна, но солидна.
Случај 2 - Заштеда на време при транскрипција. Истражниот тим вообичаено би потрошил околу 40 часа рачно декодирајќи 14 часа од снимките од состанокот. Користејќи транскрипција базирана на вештачка интелигенција, необработениот текст беше излезен за 2 часа; Тимот го потроши преостанатото време на коригирање на 6-те критични пасуси наспроти снимањето и утврдување на контекстот. Вкупното време се намали од 40 часа на ~ 9 часа; Точноста не се намали бидејќи новинарот рачно ги коригираше грешките во името и бројот во необработениот транскрипт.
Случај 3 - Рефлекс за заштита на ресурсите. Еден репортер, додека се обидувал да ја консултира АИ за состојбата на вработен во јавен карактер кој му открил документ, сакал да го залепи документот каков што е. Тој забележа без да испрати; ги исчистил метаподатоците на документот, го отстранил потписот и името на единицата, го генерализирал лицето како „вработен во институција“. Неговите идеи за издавачка стратегија повторно проработија; но не се појави никаква трага да го даде изворот.
Шаблони за копирање
1) Одвојување на задачата по ниво на ризик:
Вашата улога: под-уреднички асистент на новинар. Поделете ги следните задачи за известување на две листи: (А) работни места со низок ризик каде што вештачката интелигенција може самоуверено да изработи преглед/резиме, (Б) работни места со висок ризик каде што конечната одлука мора да ја има новинарот. Напишете оправдување со една реченица за секоја задача. Задачи: [залепете ги сопствените неделни задачи]
2) Навестување за лов на халуцинации:
Наведете го секој факт, име, датум, број, цитат и изворна ставка споменати во текстот подолу. Обележете го секој „мора да биде потврден од примарен извор“ и предложете кој документ/запис треба да се бара. Не кажувајте ВИСТИНА врз основа на сопственото знаење; Тоа само заклучува што треба да се потврди. Текст: [тука]
3) Претходна проверка на анонимизација:
Пред да го објавите текстот подолу, означете ги сите елементи што би можеле да го дадат изворот: име, наслов, институција, локација, датум, препознатлив детал. Предложете побезбедна генерализација за секое знаме (на пр., „јавен службеник“). Не го менувајте текстот, само пријавете ризици. Текст: [тука]
4) Список за проверка на уредувачката проверка:
Ќе оцените нацрт на вести. Наведете ги недостатоците под следните наслови: (1) тврдења од еден извор, (2) непроверени бројки, (3) цитати со нејасно наведување, (4) места каде што странките не добиле право да зборуваат, (5) реченици каде што заклучоците и фактите се мешаат. Само направете листа за проверка, не ја препишувајте веста. Нацрт: [тука]
Слаб промпт / Силен промпт
Слаба порака: „Напиши вест од овој документ“.
Резултат: вештачката интелигенција инјектира дупки, создава неприпишани тврдења, додава контекст што го нема во документот. Новинарот не може да разликува што е документ и што е измислица.
Моќен потсетник: „Направете го скелетот на веста врз основа на САМО на следниот документ. До секоја реченица, означете на кој став во документот се заснова, како на [P3]. Не додавајте никакви информации што ги нема во документот; оставете ги празните делови како „[мора да се проверат]“. Документ: [тука]“.
Разликата: Моќната порака ја поврзува вештачката интелигенција со документот, правејќи го секое тврдење да се следи и халуцинацијата ја прави видлива. Новинарот знае која реченица да ја потврди.
споредбена табела
Потрага
Улогата на вештачката интелигенција
Одлука/одговорност
Задолжителна верификација
Транскрипција за снимање на глас
Генерира необработен текст
Критичните пасуси се во новинарот
Споредете го името/бројот со записот
Скенирање на долг документ
Создава наслов и резиме
Што е вест, зависи од новинарот
Врати се на оригиналниот пасус
Прво пишување нацрт
Предлага скелет и јазик
Цитатите и фактите се кај новинарот
Поврзете го секое тврдење со изворот
Избор на цитати
Знаци за номинативни реченици
Објава од новинар
Дословна потврда од записникот
Обработка на извор/документ
(ограничена) помош
Заштита на идентитетот на новинарите
Чистење на метаподатоци и име
Вообичаени грешки
- Грешка на излезот за вештачка интелигенција за извор. ВИ е генератор на нацрт, а не ресурс; Објавувањето на фактот без да се потврди од примарниот документ води до демант.
- Вметнување на чувствителниот документ како што е. Ниту еден документ не треба да влегува во јавна алатка без да се исчистат метаподатоците и имињата што го даваат изворот.
- Заобиколувајќи го правилото „два ресурси“ со вештачка интелигенција. Компендиумот на вештачката интелигенција е единствен извор; Критичкото тврдење повторно бара две независни потврди.
- Верувајќи им на бројките. ВИ често погрешно ги пресметува процентите и збирот; повторно тестирајте го секој број од необработените податоци.
- Не препознавајќи пристрасност. Преземањето на рамката на вештачката интелигенција без преиспитување и нејзиното пренесување на јазикот на вестите ја нарушува објективноста.
Сумирано
Во оваа единица ја позиционираме вештачката интелигенција како асистент во известувањето: таа ги забрзува задачите кои се повторуваат и масовно се провлекуваат, но на новинарот е да одлучи за вистината, да го објави цитатот и да го заштити изворот. Халуцинацијата и пристрасноста се двете главни граници; Наспроти нив, дисциплината за верификација во четири чекори (дојдете до изворот, вториот извор, проверете го бројот, преземете одговорност) и рефлексот на приватност од почеток (анонимизирање, чисти метаподатоци) се применуваат на секој излез. На оваа земја ќе се инсталираат следните единици.
Задача за апликација
Запишете 8 задачи за известување што сте ги направиле во последната недела. Обележете го секој како „низок ризик - вештачката интелигенција го прави побрзо“ или „висок ризик - зависи од мене“ и додајте оправдување со една реченица. Потоа изберете еден и применете го навестувањето „лов на халуцинации“ погоре на вистински текст; Забележете колку тврдења всушност треба да се потврдат знаменцата со вештачка интелигенција.
листа за проверка
- [ ] Можам да ја одделам задачата по ниво на ризик; Знам работни места каде одлуката е препуштена на новинарот.
- [ ] Го припишувам секој излез на ВИ на примарниот извор; Не го заобиколувам правилото „два ресурси“ со вештачката интелигенција.
- [ ] Ги знам ризиците од халуцинации и пристрасност, и ги крцкам бројките со рака.
- [ ] Ги чистам сите траги од метаподатоци и идентитет пред да го дадам чувствителниот документ/ресурс на вештачката интелигенција.
- [ ] Интернализирав дека оправдувањето „Ви рече“ е невалидно за емитување.