Единици
1. Вовед во вештачката интелигенција во форензиката: улоги, граници, верификација, интегритет на докази и етика 2. Поддршка за собирање и испитување докази: забрзување на сликање, сортирање и анализа 3. Анализа на дневник и временска рамка: Ставање настани по правилен редослед 4. Тријажа на големи податоци: Приоритизирање на терабајти податоци 5. E-Discovery: Наоѓање релевантни докази во корпоративните податоци 6. Малициозен софтвер и мрежна форензичка анализа: обратно инженерство за одбрана 7. Форензичка анализа за мобилни, облак и апликации: податоци за разговор, локација и апликации 8. Откривање на длабоки и синтетички медиуми: верификација на лажни слики, аудио и видео 9. Интегритет на докази, синџир на притвор и законска допуштеност 10. Извештај за нацрт и презентација на експерт: Пишување наоди разбирливо и дефанзивно 11. Работен тек од крај до крај, управување со лабораторија, валидација и одговорна употреба
Единица 8 / 11

Откривање на длабоки и синтетички медиуми: верификација на лажни слики, аудио и видео

Добивки:

  • Способност да се разберат и лажните докази и заканата од „лажговска добивка“ од синтетичките медиуми и повеќеслојна проверка на автентичноста на медиумите
  • Способност да се проценат потеклото, метаподатоците, техничката аномалија, потеклото (C2PA) и слоевите на контекстуална конзистентност заедно и да не се потпираат на единствен резултат на возилото
  • Способност да се изрази резултатот на јазикот на ниво на доверба, а не на сигурност и да се усвои употребата на знаење за техника на производство само за откривање и одбрана.

Видеото доаѓа како „доказ“ во истрагата: аудио снимка од менаџер кој дава несоодветни инструкции, фотографија на која се гледа лице некаде, видео од исповед. Но, сега прашањето останува во првите редови на секој доказ: Дали е ова реално или е произведено од вештачка интелигенција? Дипфејк (лажни медиуми произведени со длабоко учење што го имитира лицето/гласот/движењето на вистинска личност) и пошироко, синтетичките медиуми (синтетички медиуми - слики, аудио, видео произведени целосно или делумно од вештачка интелигенција) се најновите и најпредизвикувачките граници на дигиталната форензика. Во оваа единица, ќе ја покриеме оваа двојна улога на вештачката интелигенција и како алатка за закана и за откривање, и зошто проверката мора да биде повеќеслојна.

Зошто е толку критично?

Синтетичките медиуми се закана од две страни. Прво, лажни докази: некој може да направи длабок фејк за да „докаже“ настан што не се случил. Второ, поподмолно, е „дивидендата на лажго“ (дивидендата на лажго - благодарение на пролиферацијата на лажни медиуми, дури и вистинските докази можат да се отфрлат како „тоа е длабоко лажно“). Значи, синтетичките медиуми не само што произведуваат лажни докази; Тоа, исто така, го поткопува кредибилитетот на вистинските докази. Затоа, форензичкиот аналитичар мора да ја потврди автентичноста на секој медиумски доказ - дека тој навистина доаѓа од тврдениот извор, непроменет.

Внимание: „Алатката за откривање вештачка интелигенција рече дека 98% длабоко лажни“ сама по себе не е доволна на суд. Моделите за откривање се погрешни, техниките на новата генерација ги избегнуваат, а резултатот на веројатност не е дефинитивен доказ. Откривањето на Deepfake секогаш треба да биде поддржано со повеќеслојна верификација (техничка + контекстуална + извор).

Слоеви на откривање

Откривањето на синтетички медиуми не може да се потпре на една магична алатка; треба да биде слоевит:

  1. Техничка/форензичка анализа: недоследности на компресија, аномалии на пиксели/фреквенција, нарушувања на границите на лицето, отсуство на биолошки сигнали како трепкање на очите и пулс, неприродни обрасци на фреквенција за аудио.
  2. Метаподатоци и анализа на изворот: EXIF/метаподатоци од контејнер на датотеката, производствени траги, отпечаток од прст на уредот, патеки низ кои поминала датотеката (синџир на чување). Избришаните/неконзистентни метаподатоци се предупредување.
  3. Потекло на содржината: Потврдено со стандарди како што е C2PA (отворен стандард кој додава криптографски потпишани информации за потеклото на медиумите, означувајќи од каде доаѓа и како е уредена); Има ли потпис, дали е доследен?
  4. Контекстуална проверка: Дали светлата, сенките, рефлексиите во видеото се физички конзистентни? Дали синхронизацијата на гласот и усните се совпаѓаат? Дали содржината е во спротивност со познатите факти (време, локација, време)?

Вештачката интелигенција е забрзувач на многу од овие слоеви: означува аномалии, открива недоследности, генерира списоци за проверка. Но, конечниот суд за автентичноста се прави преку повеќе слоеви на вкрстена валидација и експертска евалуација.

АИ: и закана и алатка

Клучната напнатост на оваа единица: истата технологија произведува и открива длабоки фалсификати. Форензичкиот аналитичар мора да ги разбере техниките на производство (како да открие фалсификат без да знае како е направен?), но го користи ова само за откривање и одбранбени цели. Користењето вештачка интелигенција за производство на лажни медиуми за да измами некој друг е измама и злоупотреба на идентитетот; Опсегот на овој модул е ​​строго откривање и верификација.

Совет: Кога оценувате медиумски докази, прво направете го тестот „наједноставно објаснување“: Дали оваа датотека навистина потекнува од местото каде што тврди дека е? Дали е безбеден синџирот на притвор? Најчесто проблемот не е во длабок фејк, туку во деконтекстуализацијата (видео од вистински, но стар/друг настан, претставен во погрешен контекст). Проверете го потеклото и контекстот пред сложената длабока фејк анализа.

Веројатност, а не сигурност

Алатките за откривање на Deepfake произведуваат резултат на веројатност; Не „дефинитивно лажен“ или „дефинитивно вистински“. Овој резултат има маргина на грешка, интервал на доверба, а неговите перформанси се намалуваат кај новите методи на производство што моделот не ги видел. Во форензичкиот извештај, наместо да се каже „лажен е“ за медиум, треба да се каже „овие показатели упатуваат на манипулација, овие слоеви на проверка го покажаа тоа, степенот на сигурност е ова“. Премногу прецизен јазик создава приговори на суд и губење на угледот.

три мини футроли

Случај 1 - Анализата на потекло е решена пред длабока фејк. Беше разгледана снимка поднесена како „доказ“ до табла. Пред да се премине на анализата на длабоко лажни, метаподатоците беа проверени: видеото беше создадено 8 месеци пред датумот на кој беше поднесен приговор, а метаподатоците за контејнерот посочија на друга апликација. Видеото не беше лажно, но беше претставено во погрешен контекст; Наједноставниот слој го реши проблемот.

Случај 2 - Повеќеслојното откривање го фати лажниот. Во гласовното снимање, алатката за откривање вештачка интелигенција рече дека е 71% синтетичка (не е сигурно). Експертот ги разгледа дополнителните слоеви: неприродно редовни обрасци во анализата на фреквенцијата, отсуството на звуци на здивот и отсуството на потписот C2PA. Комбинацијата од три независни показатели даде многу посилен резултат од една оценка.

Случај 3 - Враќање од прекумерна сигурност. „Видеото е дефинитивно длабоко лажно“, се вели во нацрт-извештајот, наведувајќи го единствениот резултат на возилото. Вишиот експерт коригираше: една алатка не е доволна, јазикот не може да биде „апсолутно“. Извештајот е преведен на јазик кој изразува повеќе слоеви и нивоа на прецизност; со што станува одбранлив пред суд.

Четири шаблони за копирање

1) Список за проверка на медиумите:

Вашата улога: експерт за верификација на синтетички медиуми. Направете ми повеќеслојна листа за проверка за потврдување на доказ за слика/аудио/видео: (1) потекло/синџир на притвор, (2) метаподатоци, (3) техничка аномалија, (4) потекло/C2PA, (5) контекстуална конзистентност. Напишете конкретни чекори за проверка за секој слој.

2) Анализа на конзистентност на метаподатоци:

Ќе ви ги дадам метаподатоците (EXIF/контејнер) на медиумска датотека. Недоследности на знамето: креирај-измени метаконфликт, трага на уред/софтвер, исчезнати/избришани полиња, гео-временска несовпаѓање. Посочете дека тоа може да се ЗНАЦИ за манипулација, но сами по себе не се доказ.

3) Проверка на контекстуална конзистентност:

Оценете ја физичката конзистентност на оваа слика/видео: дали насоката на осветлувањето и сенките се конзистентни, дали рефлексиите се точни, дали аудио-липсинкот се совпаѓа, дали позадината се совпаѓа со локацијата/времето на кое се тврди? Поврзете го секое набљудување со конкретна локација. Не донесувајте конечна пресуда; наведете ги точките што предизвикуваат сомнеж.

4) Јазик на прецизно ниво:

Преведете ги следните наоди за валидација (оценки + резултати од стратификација) во став за извештај. Не кажувајте „дефинитивно лажна/вистинска“; дајте му на секој наод неговиот извор и изразете општо ниво на сигурност (ниска/средна/висока доверба). Избегнувајте прекумерни непристојни тврдења.

Слаб промпт / Силен промпт

Слаба навестување:

Кажи ми, дали ова видео е длабоко фејк?

Еден слој, еден суд чека; ВИ генерира „да/не“ без контекст, тоа ќе биде побиено на суд.

Моќен потсетник:

Вашата улога: експерт за верификација на синтетички медиуми. Ќе ви ги опишам метаподатоците на видеото, резултатот од алатката за откривање и неколку фрејмови. Задача: ОДДЕЛНО проценете ги слоевите на потеклото, метаподатоците, техничката аномалија и контекстуалната конзистентност; Поврзете го она што го гледате во секој слој со изворот. Изразете го резултатот како комбинирано ниво на доверба на слоевите, а не како „точно“. Не се потпирајте на еден резултат; укажуваат на слоеви што недостасуваат.

Слоевната евалуација, поврзувањето со изворот и ограничувањето „без повик“ го прават излезот одбранлив.

Табела со слоеви за автентикација

слој

На што гледа?

силна точка

ограничување

Потекло/CoC

Од каде потекнува датотеката

Едноставно, прецизно

Измамата може да се скрие

метаподатоци

EXIF/контејнер

брз совет

Може да се брише/лажни

техничка аномалија

Пиксел/фреквенција

трага на манипулација

Нова техника заобиколува

Потекло/C2PA

потпишана потекло

криптографска доверба

Не секаде

контекстуални

Физика/хармонија на реалноста

тешко да се измами

Бара коментар

Вообичаени грешки

  • Потпирајќи се на еден резултат на возилото. Откривањето на Deepfake треба да биде повеќеслојно; единствен резултат не е доказ.
  • Тоа значи „апсолутно лажна/вистинска“. Користете го јазикот на веројатноста; Премногу прецизност предизвикува приговори.
  • Испуштање на потеклото и контекстот. Повеќето проблеми не се длабоки фејкови, туку погрешен контекст/стари медиуми.
  • Апсолутна доверба во метаподатоците. Метаподатоците може и да се избришат и да се фалсификуваат.
  • Злоупотреба на техниката на производство. Информациите се само за откривање и одбрана.

Сумирано

Дипфејк и синтетичките медиуми се најновата граница во дигиталната форензика; Тоа и произведува лажни докази и прави вистински докази сомнителни. ВИ е и алатка за закана и откривање. Верификацијата не треба да се заснова на една алатка, туку на вкрстена верификација на слоеви на потекло, метаподатоци, техничка аномалија, потекло и контекстуална конзистентност. Резултатот не се изразува со сигурност, туку со ниво на сигурност. И оваа информација е само за откривање и одбрана - не за генерирање лажни медиуми.

Задача за апликација

Опишете сценарио за медиумски докази (на пр. аудио снимка). Направете слоевит план со шаблонот „список за проверка на медиумите“. Потоа применете ги шаблоните „Анализа на конзистентност на метаподатоци“ и „Јазик на прецизно ниво“ со лажни метаподатоци и резултат за откривање; Обидете се да го изразите резултатот со повеќеслојно ниво на доверба наместо „дефинитивно лажен“.

листа за проверка

  • [ ] Верификацијата ја засновав на повеќе слоеви, а не на една алатка.
  • [ ] Прво ги проверив потеклото и контекстот.
  • [ ] Имав предвид дека метаподатоците може да се избришат/фалсификуваат.
  • [ ] Резултатот го изразив на јазикот на ниво на доверба, а не на сигурност.
  • [ ] Ги користев информациите за производство само за откривање/одбрана.