ইউনিট
1. ফরেনসিক্সে কৃত্রিম বুদ্ধিমত্তার ভূমিকা: ভূমিকা, সীমানা, যাচাইকরণ, প্রমাণ সততা এবং নীতিশাস্ত্র 2. প্রমাণ সংগ্রহ এবং পরীক্ষা সমর্থন: ইমেজিং, বাছাই এবং বিশ্লেষণ ত্বরণ 3. লগ এবং টাইমলাইন বিশ্লেষণ: ইভেন্টগুলিকে সঠিক ক্রমে রাখা 4. বিগ ডেটা ট্রাইজ: ডেটার টেরাবাইটকে অগ্রাধিকার দেওয়া 5. ই-ডিসকভারি: কর্পোরেট ডেটাতে প্রাসঙ্গিক প্রমাণ খোঁজা 6. ম্যালওয়্যার এবং নেটওয়ার্ক ফরেনসিক বিশ্লেষণ: প্রতিরক্ষার জন্য বিপরীত প্রকৌশল 7. মোবাইল, ক্লাউড এবং অ্যাপ ফরেনসিক বিশ্লেষণ: চ্যাট, অবস্থান এবং অ্যাপ ডেটা 8. ডিপফেক এবং সিন্থেটিক মিডিয়া সনাক্তকরণ: জাল ছবি, অডিও এবং ভিডিও যাচাইকরণ 9. এভিডেন্স ইন্টিগ্রিটি, চেইন অফ কাস্টডি এবং লিগ্যাল অ্যাডমিসিবিলিটি 10. প্রতিবেদনের খসড়া এবং বিশেষজ্ঞের উপস্থাপনা: বোধগম্য এবং প্রতিরক্ষামূলকভাবে ফলাফলগুলি লেখা 11. এন্ড-টু-এন্ড ওয়ার্কফ্লো, ল্যাবরেটরি গভর্নেন্স, বৈধতা এবং দায়িত্বশীল ব্যবহার
ইউনিট 8 / 11

ডিপফেক এবং সিন্থেটিক মিডিয়া সনাক্তকরণ: জাল ছবি, অডিও এবং ভিডিও যাচাইকরণ

লাভ:

  • সিন্থেটিক মিডিয়ার মিথ্যা প্রমাণ এবং 'মিথ্যাবাদীর লাভ' হুমকি এবং মিডিয়া সত্যতার বহু-স্তরীয় যাচাইকরণ উভয়ই বোঝার ক্ষমতা
  • প্রোভেন্যান্স, মেটাডেটা, টেকনিক্যাল অ্যানোমালি, প্রোভেন্যান্স (C2PA) এবং প্রাসঙ্গিক ধারাবাহিকতা স্তরগুলি একসাথে মূল্যায়ন করার ক্ষমতা এবং একক গাড়ির স্কোরের উপর নির্ভর না করে
  • নিশ্চিততা নয়, আত্মবিশ্বাসের স্তরের ভাষায় ফলাফল প্রকাশ করার ক্ষমতা এবং শুধুমাত্র সনাক্তকরণ এবং প্রতিরক্ষার জন্য উৎপাদন কৌশল জ্ঞানের ব্যবহার গ্রহণ করার ক্ষমতা।

একটি তদন্তে একটি ভিডিও "প্রমাণ" হিসাবে আসে: একজন ম্যানেজারের অনুপযুক্ত নির্দেশনা দেওয়ার একটি অডিও রেকর্ডিং, একটি ফটো যেখানে একজন ব্যক্তিকে কোথাও দেখা যাচ্ছে, একটি স্বীকারোক্তির ভিডিও৷ কিন্তু এখন প্রশ্নটি প্রতিটি প্রমাণের অগ্রভাগে রয়েছে: এটি কি বাস্তব, নাকি এটি কৃত্রিম বুদ্ধিমত্তা দ্বারা উত্পাদিত হয়েছিল? ডিপফেক (গভীর শিক্ষার মাধ্যমে তৈরি নকল মিডিয়া যা একজন প্রকৃত ব্যক্তির মুখ/কণ্ঠ/গতির অনুকরণ করে) এবং আরও বিস্তৃতভাবে, সিন্থেটিক মিডিয়া (কৃত্রিম বুদ্ধিমত্তা দ্বারা সম্পূর্ণ বা আংশিকভাবে তৈরি করা ছবি, অডিও, ভিডিও) হল ডিজিটাল ফরেনসিকের নতুন এবং সবচেয়ে চ্যালেঞ্জিং সীমান্ত। এই ইউনিটে, আমরা AI এর এই দ্বৈত ভূমিকাটিকে হুমকি এবং সনাক্তকরণের সরঞ্জাম হিসাবে কভার করব এবং কেন যাচাইকরণ বহু-স্তরীয় হতে হবে।

কেন এটা এত সমালোচনামূলক?

সিন্থেটিক মিডিয়া একটি দ্বিমুখী হুমকি। প্রথমত, জাল প্রমাণ: যে ঘটনা ঘটেনি তা "প্রমাণ" করার জন্য কেউ একটি ডিপফেক তৈরি করতে পারে। দ্বিতীয়ত, আরও প্রতারক, হল "মিথ্যাবাদীর লভ্যাংশ" (মিথ্যাবাদীর লভ্যাংশ - নকল মিডিয়ার বিস্তারের জন্য ধন্যবাদ, এমনকি বাস্তব প্রমাণকে "এটি একটি ডিপফেক" বলে খারিজ করা যেতে পারে)। তাই সিন্থেটিক মিডিয়া শুধু মিথ্যা প্রমাণই তৈরি করে না; এটি প্রকৃত প্রমাণের বিশ্বাসযোগ্যতাকেও ক্ষুন্ন করে। অতএব, ফরেনসিক বিশ্লেষককে অবশ্যই প্রতিটি মিডিয়া প্রমাণের সত্যতা যাচাই করতে হবে- যে এটি সত্যই দাবি করা উৎস থেকে এসেছে, অপরিবর্তিত।

মনোযোগ: "এআই সনাক্তকরণ টুল বলেছে 98% ডিপফেক" একা আদালতে যথেষ্ট নয়। সনাক্তকরণ মডেলগুলি ভুল, নতুন প্রজন্মের কৌশলগুলি সেগুলি এড়ায় এবং একটি সম্ভাব্যতা স্কোর নির্দিষ্ট প্রমাণ নয়। ডিপফেক সনাক্তকরণ সর্বদা মাল্টি-লেয়ার যাচাইকরণ (প্রযুক্তিগত + প্রাসঙ্গিক + উত্স) দ্বারা সমর্থিত হওয়া উচিত।

সনাক্তকরণের স্তর

সিন্থেটিক মিডিয়া সনাক্তকরণ একটি জাদু টুলের উপর নির্ভর করতে পারে না; স্তরযুক্ত করা উচিত:

  1. প্রযুক্তিগত/ফরেনসিক বিশ্লেষণ: কম্প্রেশন অসঙ্গতি, পিক্সেল/ফ্রিকোয়েন্সি অসঙ্গতি, মুখের সীমানা বিকৃতি, জৈবিক সংকেতের অনুপস্থিতি যেমন চোখের পলক এবং নাড়ি, অডিওর জন্য অস্বাভাবিক ফ্রিকোয়েন্সি প্যাটার্ন।
  2. মেটাডেটা এবং উৎস বিশ্লেষণ: ফাইলের EXIF/কন্টেইনার মেটাডেটা, প্রোডাকশন ট্রেস, ডিভাইস ফিঙ্গারপ্রিন্ট, ফাইলটি পাস করা পথ (হেফাজতের চেইন)। মুছে ফেলা/অসংলগ্ন মেটাডেটা একটি সতর্কতা।
  3. বিষয়বস্তুর উদ্ভব: C2PA (একটি উন্মুক্ত মান যা মিডিয়াতে ক্রিপ্টোগ্রাফিকভাবে স্বাক্ষরিত মূল তথ্য যোগ করে, এটি কোথা থেকে এসেছে এবং কীভাবে এটি সম্পাদনা করা হয়েছে তা নির্দেশ করে) এর মতো মান দ্বারা যাচাই করা হয়েছে; একটি স্বাক্ষর আছে, এটা সামঞ্জস্যপূর্ণ?
  4. প্রাসঙ্গিক যাচাইকরণ: ভিডিওতে আলো, ছায়া, প্রতিফলন কি শারীরিকভাবে সামঞ্জস্যপূর্ণ? ভয়েস এবং ঠোঁট সিঙ্ক মেলে? বিষয়বস্তু কি পরিচিত তথ্যের (আবহাওয়া, অবস্থান, সময়) বিরোধিতা করে?

AI এই স্তরগুলির অনেকগুলিতে ত্বরণক: ফ্ল্যাগ অসঙ্গতিগুলি, অসঙ্গতিগুলি সনাক্ত করে, চেকলিস্ট তৈরি করে৷ কিন্তু প্রামাণিকতার চূড়ান্ত বিচার করা হয় একাধিক স্তরের ক্রস-ভ্যালিডেশন এবং বিশেষজ্ঞ মূল্যায়নের মাধ্যমে।

এআই: হুমকি এবং হাতিয়ার উভয়ই

এই ইউনিটের মূল টান: একই প্রযুক্তি উভয়ই ডিপফেক তৈরি করে এবং সনাক্ত করে। ফরেনসিক বিশ্লেষককে অবশ্যই উত্পাদন কৌশলগুলি বুঝতে হবে (কীভাবে এটি তৈরি করা হয়েছে তা না জেনে কীভাবে জালিয়াতি সনাক্ত করা যায়?) তবে এটি কেবল সনাক্তকরণ এবং প্রতিরক্ষা উদ্দেশ্যে ব্যবহার করে। অন্য কাউকে বোকা বানানোর জন্য AI ব্যবহার করে জাল মিডিয়া তৈরি করা হল প্রতারণা এবং পরিচয়ের অপব্যবহার; এই মডিউলের সুযোগ হল কঠোরভাবে সনাক্তকরণ এবং যাচাইকরণ।

টিপ: মিডিয়া প্রমাণের মূল্যায়ন করার সময়, প্রথমে "সরলতম ব্যাখ্যা" পরীক্ষা করুন: এই ফাইলটি কি সত্যিই সেখান থেকে এসেছে যেখানে এটি দাবি করা হয়েছে? হেফাজতের চেইন কি নিরাপদ? বেশিরভাগ সময়, সমস্যাটি ডিপফেক নয়, তবে ডিপ্রেক্সচুয়ালাইজেশন (একটি বাস্তব কিন্তু পুরানো/অন্য ঘটনা থেকে একটি ভিডিও, ভুল প্রসঙ্গে উপস্থাপিত)। জটিল ডিপফেক বিশ্লেষণের আগে মূল এবং প্রসঙ্গ যাচাই করুন।

সম্ভাবনা, নিশ্চিততা নয়

ডিপফেক সনাক্তকরণ সরঞ্জামগুলি একটি সম্ভাব্যতা স্কোর তৈরি করে; "অবশ্যই জাল" বা "অবশ্যই বাস্তব" নয়। এই স্কোরের ত্রুটির মার্জিন, একটি আত্মবিশ্বাসের ব্যবধান রয়েছে এবং মডেলটি দেখেনি এমন নতুন উত্পাদন পদ্ধতিতে এর কার্যকারিতা হ্রাস পায়। ফরেনসিক রিপোর্টে, একটি মিডিয়ার জন্য "এটি জাল" বলার পরিবর্তে বলা উচিত "এই সূচকগুলি হেরফের নির্দেশ করে, যাচাইয়ের এই স্তরগুলি এটি দেখিয়েছে, নিশ্চিততার স্তর এটি"। অত্যধিক সুনির্দিষ্ট ভাষা আদালতে আপত্তি সৃষ্টি করে এবং সুনাম নষ্ট করে।

তিনটি মিনি কেস

কেস 1 — ডিপফেক করার আগে মূল বিশ্লেষণ সমাধান করা হয়েছে। একটি বোর্ডের কাছে "প্রমাণ" হিসাবে জমা দেওয়া একটি ভিডিও পর্যালোচনা করা হয়েছিল। ডিপফেক বিশ্লেষণে যাওয়ার আগে, মেটাডেটা পরীক্ষা করা হয়েছিল: ভিডিওটি দাবি করা তারিখের 8 মাস আগে তৈরি করা হয়েছিল, এবং কন্টেইনার মেটাডেটা অন্য অ্যাপ্লিকেশনের দিকে নির্দেশ করে। ভিডিওটি জাল ছিল না, তবে এটি ভুল প্রেক্ষাপটে উপস্থাপন করা হয়েছিল; সবচেয়ে সহজ স্তর সমস্যার সমাধান করেছে।

কেস 2 — মাল্টি-লেয়ার ডিটেকশনে জাল ধরা পড়েছে। একটি ভয়েস রেকর্ডিংয়ে AI সনাক্তকরণ টুল বলেছে 71% সিন্থেটিক (নিশ্চিত নয়)। বিশেষজ্ঞ অতিরিক্ত স্তরগুলি দেখেছেন: ফ্রিকোয়েন্সি বিশ্লেষণে অস্বাভাবিকভাবে নিয়মিত প্যাটার্ন, শ্বাসের শব্দের অনুপস্থিতি এবং C2PA স্বাক্ষরের অনুপস্থিতি। তিনটি স্বাধীন সূচকের সংমিশ্রণ একটি একক স্কোরের চেয়ে অনেক শক্তিশালী ফলাফল দিয়েছে৷

কেস 3 - অতিরিক্ত নিশ্চিততা থেকে ফিরে আসা। "ভিডিওটি অবশ্যই একটি ডিপফেক," একটি খসড়া প্রতিবেদনে বলা হয়েছে, একটি একক গাড়ির স্কোর উদ্ধৃত করে৷ সিনিয়র বিশেষজ্ঞ সংশোধন করেছেন: একটি টুল যথেষ্ট নয়, ভাষা "একেবারে" হতে পারে না। প্রতিবেদনটি এমন ভাষায় অনুবাদ করা হয়েছে যা একাধিক স্তর এবং নির্ভুলতার মাত্রা প্রকাশ করে; এইভাবে আদালতে আত্মরক্ষাযোগ্য হয়ে উঠছে।

চারটি অনুলিপিযোগ্য টেমপ্লেট

1) মিডিয়া যাচাইকরণ চেকলিস্ট:

আপনার ভূমিকা: সিন্থেটিক মিডিয়া যাচাইকরণ বিশেষজ্ঞ। একটি ছবি/অডিও/ভিডিও প্রমাণ যাচাই করার জন্য আমাকে একটি স্তরযুক্ত চেকলিস্ট তৈরি করুন: (1) হেফাজতের সূত্র/চেইন, (2) মেটাডেটা, (3) প্রযুক্তিগত অসঙ্গতি, (4) উদ্ভব/C2PA, (5) প্রাসঙ্গিক ধারাবাহিকতা। প্রতিটি স্তরের জন্য কংক্রিট চেক ধাপ লিখুন।

2) মেটাডেটা ধারাবাহিকতা বিশ্লেষণ:

আমি আপনাকে একটি মিডিয়া ফাইলের মেটাডেটা (EXIF/কন্টেইনার) দেব। ফ্ল্যাগ অসঙ্গতি: তৈরি-সংশোধন মেটা দ্বন্দ্ব, ডিভাইস/সফ্টওয়্যার ট্রেস, অনুপস্থিত/মুছে ফেলা ক্ষেত্র, ভূ-অস্থায়ী অসঙ্গতি। উল্লেখ করুন যে এগুলি ম্যানিপুলেশনের লক্ষণ হতে পারে, কিন্তু নিজেরাই প্রমাণ নয়।

3) প্রাসঙ্গিক ধারাবাহিকতা পরীক্ষা:

এই চিত্র/ভিডিওতে শারীরিক সামঞ্জস্যের মূল্যায়ন করুন: আলোর দিক এবং ছায়াগুলি কি সামঞ্জস্যপূর্ণ, প্রতিফলনগুলি কি সঠিক, অডিও-লিপসিঙ্ক কি মেলে, ব্যাকগ্রাউন্ড কি দাবিকৃত অবস্থান/সময়ের সাথে মেলে? প্রতিটি পর্যবেক্ষণকে একটি কংক্রিট অবস্থানের সাথে লিঙ্ক করুন। চূড়ান্ত বিচার করবেন না; সন্দেহ উত্থাপন পয়েন্ট তালিকা.

4) স্পষ্টতা স্তরের ভাষা:

একটি রিপোর্ট অনুচ্ছেদে নিম্নলিখিত বৈধতা ফলাফল (স্কোর + স্তরবিন্যাস ফলাফল) অনুবাদ করুন। "অবশ্যই জাল/বাস্তব" বলবেন না; প্রতিটিকে তার উৎস খুঁজে বের করুন এবং একটি সাধারণ স্তরের নিশ্চিততা প্রকাশ করুন (নিম্ন/মাঝারি/উচ্চ আত্মবিশ্বাস)। অতিরিক্ত আপত্তিকর দাবি এড়িয়ে চলুন।

দুর্বল প্রম্পট / শক্তিশালী প্রম্পট

দুর্বল প্রম্পট:

আমাকে বলুন, এই ভিডিওটি কি ডিপফেক?

এক স্তর, এক রায় অপেক্ষা করছে; এআই প্রসঙ্গ ছাড়াই একটি "হ্যাঁ/না" তৈরি করে, এটি আদালতে খণ্ডন করা হবে।

শক্তিশালী প্রম্পট:

আপনার ভূমিকা: সিন্থেটিক মিডিয়া যাচাইকরণ বিশেষজ্ঞ। আমি আপনাকে একটি ভিডিওর মেটাডেটা, একটি সনাক্তকরণ টুলের স্কোর এবং কয়েকটি ফ্রেম বর্ণনা করব৷ টাস্ক: প্রোভেন্যান্স, মেটাডেটা, প্রযুক্তিগত অসঙ্গতি এবং প্রাসঙ্গিক ধারাবাহিকতা স্তরগুলি আলাদাভাবে মূল্যায়ন করুন; প্রতিটি স্তরে আপনি যা দেখছেন তা উৎসের সাথে সংযুক্ত করুন। ফলাফলটিকে স্তরগুলির সম্মিলিত আত্মবিশ্বাসের স্তর হিসাবে প্রকাশ করুন, "সঠিক" হিসাবে নয়। একটি একক স্কোরের উপর নির্ভর করবেন না; অনুপস্থিত স্তর নির্দেশ করুন।

স্তরযুক্ত মূল্যায়ন, উত্সের সাথে লিঙ্ক করা এবং "কোন কল নেই" সীমাবদ্ধতা আউটপুটকে রক্ষাযোগ্য করে তোলে।

প্রমাণীকরণ স্তর টেবিল

স্তর

সে কি দেখছে?

শক্তিশালী পয়েন্ট

সীমা

উৎপত্তি/CoC

ফাইল কোথা থেকে এলো

সহজ, সুনির্দিষ্ট

জালিয়াতি লুকিয়ে রাখা যায়

মেটাডেটা

EXIF/ধারক

দ্রুত টিপ

মুছে ফেলা যায়/জাল

প্রযুক্তিগত অসঙ্গতি

পিক্সেল/ফ্রিকোয়েন্সি

ম্যানিপুলেশন ট্রেস

নতুন কৌশল বাইপাস

প্রোভেনেন্স/C2PA

স্বাক্ষরিত উৎস

ক্রিপ্টোগ্রাফিক বিশ্বাস

সর্বত্র নয়

প্রাসঙ্গিক

পদার্থবিদ্যা/বাস্তবতার সামঞ্জস্য

প্রতারণা করা কঠিন

মন্তব্য প্রয়োজন

সাধারণ ভুল

  • একটি গাড়ির স্কোরের উপর নির্ভর করা। ডিপফেক সনাক্তকরণ বহু-স্তরযুক্ত হওয়া উচিত; একক স্কোর প্রমাণ নয়।
  • এর অর্থ "একদম নকল/বাস্তব"। সম্ভাব্যতার ভাষা ব্যবহার করুন; অত্যধিক নির্ভুলতা আপত্তি উত্থাপন.
  • মূল এবং প্রসঙ্গ বাদ দেওয়া। বেশিরভাগ সমস্যা ডিপফেক নয় কিন্তু ভুল প্রসঙ্গ/পুরানো মিডিয়া।
  • মেটাডেটা সম্পূর্ণ বিশ্বাস. মেটাডেটা মুছে ফেলা এবং জাল উভয় হতে পারে।
  • উৎপাদন কৌশলের অপব্যবহার। তথ্য শুধুমাত্র সনাক্তকরণ এবং প্রতিরক্ষা জন্য.

সংক্ষেপে

ডিপফেক এবং সিন্থেটিক মিডিয়া হল ডিজিটাল ফরেনসিকের নতুন সীমান্ত; এটি উভয়ই মিথ্যা প্রমাণ তৈরি করে এবং প্রকৃত প্রমাণকে সন্দেহজনক করে তোলে। এআই একটি হুমকি এবং সনাক্তকরণ সরঞ্জাম উভয়ই। যাচাইকরণ একটি একক টুলের উপর ভিত্তি করে করা উচিত নয়, বরং প্রোভেন্যান্স, মেটাডেটা, টেকনিক্যাল অ্যানোমালি, প্রোভেন্যান্স এবং প্রাসঙ্গিক ধারাবাহিকতার স্তরগুলির ক্রস-ভেরিফিকেশনের উপর ভিত্তি করে হওয়া উচিত। ফলাফল নিশ্চিততার সাথে নয় বরং নিশ্চিততার স্তরে প্রকাশ করা হয়। এবং এই তথ্য শুধুমাত্র সনাক্তকরণ এবং প্রতিরক্ষার জন্য - জাল মিডিয়া তৈরির জন্য নয়।

আবেদন টাস্ক

একটি মিডিয়া প্রমাণ দৃশ্যকল্প বর্ণনা করুন (যেমন একটি অডিও রেকর্ডিং)। "মিডিয়া যাচাইকরণ চেকলিস্ট" টেমপ্লেট সহ একটি স্তরযুক্ত পরিকল্পনা তৈরি করুন৷ তারপর ডামি মেটাডেটা এবং একটি সনাক্তকরণ স্কোর সহ "মেটাডেটা ধারাবাহিকতা বিশ্লেষণ" এবং "নির্ভুল স্তরের ভাষা" টেমপ্লেটগুলি প্রয়োগ করুন; "অবশ্যই জাল" এর পরিবর্তে একটি স্তরযুক্ত আত্মবিশ্বাসের সাথে ফলাফল প্রকাশ করার চেষ্টা করুন।

চেকলিস্ট

  • [ ] আমি একাধিক স্তরের উপর ভিত্তি করে যাচাই করেছি, একটি একক টুল নয়।
  • আমি প্রথমে মূল এবং প্রসঙ্গ পরীক্ষা করেছিলাম।
  • [ ] আমি মনে রেখেছিলাম যে মেটাডেটা মুছে ফেলা/জাল করা যেতে পারে।
  • [ ] আমি ফলাফলটি আত্মবিশ্বাসের স্তরের ভাষায় প্রকাশ করেছি, নিশ্চিততা নয়।
  • [] আমি শুধুমাত্র সনাক্তকরণ/প্রতিরক্ষার জন্য উৎপাদন তথ্য ব্যবহার করেছি।