লাভ:
- বোঝার ক্ষমতা যে হ্যালুসিনেশন ভাষা মডেলের অন্তর্নিহিত এবং প্রতিটি ধরণের আউটপুটের জন্য উপযুক্ত যাচাইকরণ পদ্ধতি বেছে নিন।
- ত্রিভুজকরণের সাথে দুটি স্বাধীন উপায়ে সমালোচনামূলক মান যাচাই করুন এবং নির্ভুলতার সাথে সাবলীলতাকে বিভ্রান্ত করবেন না
- বৈজ্ঞানিক সততার ভিত্তি হিসাবে স্বচ্ছতা, সন্ধানযোগ্যতা, ডেটা অখণ্ডতা এবং মানুষের দায়িত্ব প্রয়োগ করার ক্ষমতা
এই মডিউল জুড়ে একটি একক বাক্যাংশ বারবার ফিরে এসেছে: "এআই তৈরি করে, মানুষ যাচাই করে।" এই ইউনিটে, আমরা সেই বাক্যটিকে একটি সিস্টেমে পরিণত করি। উদ্দেশ্য হল হ্যালুসিনেশন (একটি আত্মবিশ্বাসী ভাষার সাথে মিথ্যা/বানোয়াট তথ্য তৈরি করা), যা AI এর সবচেয়ে বিপজ্জনক আচরণ, প্রতিটি ধরণের আউটপুটের জন্য একটি কংক্রিট যাচাইকরণ পদ্ধতি প্রতিষ্ঠা করা এবং এই সমস্তকে বৈজ্ঞানিক অখণ্ডতার কাঠামোর মধ্যে স্থাপন করা (সততা, স্বচ্ছতা, সন্ধানযোগ্যতা)। রসায়নে একটি অযাচাইকৃত AI আউটপুট শুধুমাত্র একটি ভুল নয়; এটি একটি পরীক্ষা বিস্ফোরিত হতে পারে, একজন ব্যক্তিকে বিষ দেওয়া হচ্ছে, বা একটি কাগজ প্রত্যাহার করা হচ্ছে।
হ্যালুসিনেশন কেন অনিবার্য?
বড় ভাষা মডেল "পরবর্তী সবচেয়ে সম্ভাব্য শব্দ" উত্পাদন করে; এটি কি সম্ভব তা লক্ষ্য করে, কি সত্য নয়। তাই তিনি একটি আণবিক ওজন, একটি DOI, বা একটি স্ফুটনাঙ্ক পূরণ করতে পারেন যা "যুক্তিসঙ্গত বলে মনে হয়" - এটি বাস্তব কিনা তা পরীক্ষা না করেই। হ্যালুসিনেশন কোনও ত্রুটি নয়, তবে এই প্রযুক্তির প্রকৃতির পরিণতি। সমাধানটি মডেলটিকে "ঠিক করার চেষ্টা" করা নয়, তবে প্রতিটি আউটপুটের চারপাশে একটি বৈধতা শেল তৈরি করা।
হ্যালুসিনেশনের সবচেয়ে কপট দিক হল এর আত্মবিশ্বাসী ভাষা। একটি ভুল আণবিক ওজন সঠিক এক হিসাবে ঠিক একই আত্মবিশ্বাসের সাথে উপস্থাপন করা হয়। সুতরাং "আত্মবিশ্বাসী দেখায়" এর অর্থ কখনই "সঠিক" নয়।
মনোযোগ: একটি বিষয়ে এআই কতটা সাবলীল এবং আত্মবিশ্বাসী কথা বলে তা সেই তথ্যের নির্ভুলতার সাথে সম্পর্কিত নয়। সাবলীলতা বিশ্বাস করে; শুধুমাত্র স্বাধীন উৎস নির্ভুলতা নির্ধারণ করে।
রসায়নে আউটপুট টাইপ দ্বারা বৈধতা
প্রতিটি আউটপুট প্রকারের নিজস্ব যাচাইকরণ পদ্ধতি রয়েছে। একটি একক নিয়ম মুখস্থ করার পরিবর্তে, আউটপুটের জন্য উপযুক্ত টুল ব্যবহার করুন:
আউটপুট প্রকার
যাচাই পদ্ধতি
যানবাহন
আণবিক ওজন, সূত্র
সূত্র থেকে পুনরায় গণনা করুন
RDKit/ম্যানুয়ালি
স্মাইলস/কাঠামো
পার্স + ক্যানোনিকালাইজ করুন
আরডিকিট
উদ্ধৃতি/ডিওআই
ডাটাবেসে সমাধান করুন
doi.org, ক্রসরেফ
শারীরিক ধ্রুবক (kn, pKa)
রেফারেন্স ডাটাবেস
পাবকেম, হ্যান্ডবুক
সংখ্যাগত গণনা
কোড লিখুন + চালান
পাইথন
প্রতিক্রিয়া/পরিস্থিতি
সাহিত্য নিশ্চিতকরণ
Reaxys, নিবন্ধ
নিরাপত্তা দাবি
এসডিএস/জিএইচএস
অফিসিয়াল এসডিএস
স্পেকট্রাম অ্যাসাইনমেন্ট
মাল্টি-টেকনিক্যাল + মানব
পরীক্ষামূলক বর্ণালী
এই টেবিলটি আসলে এই মডিউলের একটি সারাংশ: প্রতিটি ইউনিট একটি সারি।
ত্রিভুজ: তিনটি স্বাধীন পথ
সবচেয়ে শক্তিশালী যাচাইকরণ কৌশল হল "ত্রিভুজকরণ": তিনটি স্বাধীন উপায়ে একই উপসংহারে পৌঁছানো। উদাহরণস্বরূপ, একটি আণবিক ওজনের জন্য: (1) YZ যা বলে, (2) RDKit এর গণনা, (3) সূত্র থেকে হাতে গণনা। যদি তিনটি ওভারল্যাপ হয়, বিশ্বাস উচ্চ হয়; কেউ পথভ্রষ্ট হলে থামুন এবং তদন্ত করুন। রসায়নে কখনোই একক উৎসের উপর নির্ভর করবেন না; অন্তত দুটি স্বাধীন পথ সন্ধান করুন।
ধাপে ধাপে: যাচাইকরণ কর্মপ্রবাহ
- আউটপুট শ্রেণীবদ্ধ করুন: এটি একটি সংখ্যা, গঠন, বৈশিষ্ট্য, নিরাপত্তা দাবি?
- উপযুক্ত টুল নির্বাচন করুন: উপরের টেবিল থেকে আউটপুট প্রকারের জন্য উপযুক্ত যাচাইকরণের পথ পান।
- স্বাধীনভাবে গণনা/অনুসন্ধান করুন: এআই থেকে স্বাধীনভাবে যানবাহন চালান; ফলাফল তুলনা করুন।
- যদি একটি বিচ্যুতি হয়, থামুন: যদি মানগুলি মেলে না, তবে কোনটি সঠিক তা তদন্ত না করে এগিয়ে যাবেন না।
- আপনার চিহ্ন রাখুন: আপনি কী যাচাই করেছেন এবং কীভাবে (বৈজ্ঞানিক সততা) তা রেকর্ড করুন।
- অনিশ্চয়তা নির্দিষ্ট করুন: এমন কিছু চিহ্নিত করুন যা "অনিশ্চিত" হিসাবে যাচাই করা যায় না, এটি লুকাবেন না।
চারটি অনুলিপিযোগ্য টেমপ্লেট
1) স্ব-যাচাই:
আপনি এইমাত্র নিম্নলিখিত আউটপুট দিয়েছেন: [আউটপুট]। টাস্ক: এই আউটপুটের প্রতিটি সংখ্যাসূচক/বাস্তব দাবি একটি পৃথক লাইনে তালিকাভুক্ত করুন। প্রতিটি দাবির জন্য: "কিভাবে স্বাধীনভাবে এটি যাচাই করবেন?" লেখার পদ্ধতি (কোন টুল/ডাটাবেস)। দাবি সত্য যে দাবি করবেন না; শুধু এটি যাচাই করার একটি উপায় দিন।
2) ত্রিভুজ নিয়ন্ত্রণ:
আমি তিনটি উপায়ে নিম্নলিখিত অণুর ওজন পরীক্ষা করতে চাই: [স্মাইলস]। টাস্ক: 1) আণবিক সূত্রটি বের করুন। 2) পরমাণু দ্বারা আণবিক ওজন গণনা পরমাণু দেখান (প্রতিটি উপাদানের অবদান)। দ্রষ্টব্য: আমি এটি RDKit-এও গণনা করব এবং তৃতীয়ত এটি আপনার দেওয়া একটির সাথে তুলনা করব। যদি তিনটি ওভারল্যাপ না হয়, সতর্ক করুন।
3) অস্পষ্টতা চিহ্নিতকরণ:
নিম্নলিখিত পাঠ্যটিতে একাধিক বাস্তবিক দাবি রয়েছে:[TEXT]টাস্ক: প্রতিটি দাবির পাশে একটি আত্মবিশ্বাসের স্তরের লেবেল রাখুন: [যাচাই করা] / [যাচাই করা] / [অনিশ্চিত]। আপনি যদি নিশ্চিত না হন তবে কিছু [যাচাই করা] চিহ্নিত করবেন না।
4) ধারাবাহিকতা ক্রস কোয়েরি:
আমি একই প্রশ্ন দুটি ভিন্ন উপায়ে জিজ্ঞাসা করব; আপনার উত্তর সামঞ্জস্যপূর্ণ কিনা দেখুন. প্রশ্ন A: যৌগের আণবিক সূত্র কি?
দুর্বল প্রম্পট / শক্তিশালী প্রম্পট
দুর্বল:
এই যৌগ সম্পর্কে আপনি যা জানেন তা লিখুন।
AI নির্বিচারে যাচাইযোগ্য এবং বানোয়াট তথ্য মিশ্রিত করে; কোনটি আসল তা স্পষ্ট নয়।
শক্তিশালী:
এই যৌগ সম্পর্কে তথ্য প্রদান করুন, তবে প্রতিটি দাবিকে এইভাবে লেবেল করুন:[নির্ধারণ - যন্ত্র দ্বারা যাচাইকৃত] যেমন আণবিক সূত্র, [পরীক্ষামূলক - উদ্ধৃতি প্রয়োজন] যেমন গলনাঙ্ক, [অনিশ্চিত - নিশ্চিত নয়]। কোনো লেবেলবিহীন দাবি লিখবেন না।
পার্থক্য: আমরা এআইকে তার নিজস্ব অনিশ্চয়তা চিহ্নিত করতে বাধ্য করেছি; আমরা যাচাইকরণের কাজটি পরিকল্পিত করেছি।
বৈজ্ঞানিক সততা: সততা এবং সন্ধানযোগ্যতা
যাচাইকরণ শুধুমাত্র একটি প্রযুক্তিগত পদক্ষেপ নয়, এটি একটি নৈতিক সমস্যা। বৈজ্ঞানিক সততার প্রয়োজন:
- স্বচ্ছতা: লুকাবেন না যে আপনি AI ব্যবহার করছেন; আপনার প্রকাশনা/প্রতিবেদনের নীতি অনুযায়ী নির্দিষ্ট করুন।
- ট্রেসেবিলিটি: এআই থেকে কী আউটপুট এসেছে এবং কীভাবে তা যাচাই করা হয়েছে তা রেকর্ড করুন।
- ডেটা ইন্টিগ্রিটি: এআই-এর সাহায্যে ফলাফলকে "সুন্দর করা", ন্যায্যতা ছাড়াই বহিষ্কার করা প্রতারণা।
- দায়িত্ব: চূড়ান্ত ফলাফলের জন্য আপনি দায়ী; "এআই তাই বলেছে" একটি অজুহাত নয়।
টিপ: শুরু থেকেই স্বীকার করুন যে আপনি রিপোর্ট বা প্রতিরক্ষায় "The AI বলেছেন তাই" বাক্যাংশটি ব্যবহার করতে পারবেন না। এই স্বীকৃতি স্বয়ংক্রিয়ভাবে প্রতিটি আউটপুট যাচাই করার অভ্যাস নিয়ে আসে।
মিনি কেস
কেস 1 — ত্রিভুজকরণে একটি ত্রুটি ধরা পড়েছে। একজন ছাত্র একটি আণবিক ওজন তিনটি উপায়ে পরীক্ষা করেছে: YZ বলেছে 178.2, ম্যানুয়াল গণনা দিয়েছে 180.16, RDKit দিয়েছে 180.16। দুটি স্বাধীন পাথ ওভারল্যাপ করা হয়েছে এবং AI কে নির্মূল করেছে৷ পাঠ: দুটি স্বাধীন যাচাইকরণ নীরবে একটি মিথ্যা আউটপুটকে পরাজিত করে।
কেস 2 - নিরাপদ ভাষা, ভুল তথ্য। এআই খুব আত্মবিশ্বাসের সাথে লিখেছিল যে একটি প্রতিক্রিয়া "কক্ষের তাপমাত্রায় স্বতঃস্ফূর্তভাবে চলে।" সাহিত্য দেখায় যে এই গরম এবং অনুঘটক প্রয়োজন. ছাত্রটি উত্সকে বিশ্বাস করেছিল, নিরাপদ ভাষা নয়। পাঠ: সাবলীলতা সঠিকতা নয়।
কেস 3 — স্বচ্ছতা অর্জন করেছে। তার গবেষণাপত্রের পদ্ধতি বিভাগে, একজন গবেষক স্পষ্টভাবে বলেছেন যে কোন ধাপে তিনি AI (টেক্সট এডিটিং, কোড ড্রাফটিং) ব্যবহার করেছেন এবং লিখেছেন যে তিনি স্বাধীনভাবে সমস্ত সংখ্যাসূচক ফলাফল যাচাই করেছেন। রেফারি প্রক্রিয়া মসৃণভাবে চলল। পাঠ: স্বচ্ছতা বিশ্বাস তৈরি করে, লুকানো ঝুঁকি তৈরি করে।
সাধারণ ভুল
- নিরাপদ ভাষা বিশ্বাস. AI এর আত্মবিশ্বাসী টোন সঠিকতার ইঙ্গিত নয়।
- একক উৎসের উপর নির্ভর করা। ত্রিভুজ ছাড়াই একটি একক আউটপুট গ্রহণ করা।
- আউটপুট টাইপ আলাদা করা হচ্ছে না। এই ভেবে যে আমি একই পদ্ধতিতে নম্বর, অ্যাট্রিবিউশন এবং নিরাপত্তা দাবি "চেক" করেছি।
- অনিশ্চয়তা লুকিয়ে রাখা। এমন কিছু রিপোর্ট করা যা নিশ্চিত হওয়া যায় না।
- AI এর ব্যবহার লুকিয়ে রাখা। স্বচ্ছতার অভাব বৈজ্ঞানিক সততাকে ক্ষুণ্ন করে।
- দায়িত্ব অর্পণ। "এআই তাই বলেছে" অজুহাত অবৈধ; দায়িত্ব ব্যক্তির উপরই বর্তায়।
সংক্ষেপে
- হ্যালুসিনেশন ভাষা মডেলের অন্তর্নিহিত; সমাধান হল প্রতিটি আউটপুটের চারপাশে একটি বৈধতা শেল তৈরি করা।
- প্রতিটি আউটপুট প্রকারের নিজস্ব যাচাইকরণ পদ্ধতি রয়েছে; আউটপুট শ্রেণীবদ্ধ করুন এবং উপযুক্ত টুল ব্যবহার করুন।
- ত্রিভুজকরণ (দুটি স্বাধীন পথ) সবচেয়ে শক্তিশালী নিয়ন্ত্রণ; একটি একক উত্স বিশ্বাস করবেন না.
- সাবলীলতা এবং আত্মবিশ্বাসী ভাষা সঠিকতার সাথে সম্পর্কিত নয়।
- বৈজ্ঞানিক অখণ্ডতার জন্য স্বচ্ছতা, সন্ধানযোগ্যতা, ডেটা অখণ্ডতা এবং মানুষের দায়িত্ব প্রয়োজন।
আবেদন টাস্ক
ইচ্ছাকৃতভাবে একটি AI সেশনে বিভিন্ন ধরণের আউটপুট তৈরি করুন: একটি আণবিক ওজন, একটি রেফারেন্স, একটি শারীরিক ধ্রুবক, একটি নিরাপত্তা দাবি, একটি সংখ্যাসূচক গণনা৷ সঠিক পদ্ধতির সাথে প্রতিটি স্বাধীনভাবে যাচাই করুন (টেবিল দেখুন)। অন্তত একটি হ্যালুসিনেশন ধরার চেষ্টা করুন। তারপরে একটি "ভ্যালিডেশন ম্যাট্রিক্স" প্রস্তুত করুন: সারি আউটপুট, কলাম (এআই মান / স্বাধীন মান / এটি ওভারল্যাপ করেছে / আমি কীভাবে এটি যাচাই করেছি)। আপনি কিভাবে বৈজ্ঞানিক সততার পরিপ্রেক্ষিতে এই অধিবেশন রিপোর্ট করবেন?
চেকলিস্ট
- আমি বুঝতে পারি কেন হ্যালুসিনেশন অনিবার্য।
- [ ] আমি প্রতিটি আউটপুটকে তার ধরন অনুযায়ী শ্রেণীবদ্ধ করি এবং উপযুক্ত পদ্ধতিতে যাচাই করি।
- [ ] আমি সমালোচনামূলক মানগুলিতে ত্রিভুজ (দুটি স্বাধীন পথ) করি।
- আমি উৎসকে বিশ্বাস করি, নিরাপদ ভাষা নয়।
- [ ] আমি যাকে "অনিশ্চিত" হিসাবে নিশ্চিত করা যায় না তা চিহ্নিত করি৷
- [ ] আমি আমার AI ব্যবহারে স্বচ্ছ এবং ফলাফলের জন্য নিজেকে দায়বদ্ধ রাখি৷