नफा:
- भाषा मॉडेलमध्ये भ्रमनिरास अंतर्भूत आहे हे समजून घेण्याची क्षमता आणि प्रत्येक प्रकारच्या आउटपुटसाठी योग्य सत्यापन पद्धत निवडा.
- त्रिभुज सह दोन स्वतंत्र मार्गांनी गंभीर मूल्ये सत्यापित करा आणि अचूकतेसह प्रवाह गोंधळात टाकू नका
- वैज्ञानिक अखंडतेचा आधार म्हणून पारदर्शकता, शोधण्यायोग्यता, डेटा अखंडता आणि मानवी जबाबदारी लागू करण्याची क्षमता
या मॉड्युलमध्ये एकच वाक्प्रचार पुन्हा पुन्हा आला: "एआय उत्पादन करते, मानव सत्यापित करते." या युनिटमध्ये, आपण ते वाक्य प्रणालीमध्ये बदलतो. भ्रम ओळखणे (आत्मविश्वासपूर्ण भाषेत खोटी/बनावट माहिती निर्माण करणे), जे AI चे सर्वात धोकादायक वर्तन आहे, प्रत्येक प्रकारच्या आउटपुटसाठी ठोस पडताळणी पद्धत स्थापित करणे आणि या सर्व गोष्टी वैज्ञानिक अखंडतेच्या (प्रामाणिकपणा, पारदर्शकता, शोधण्यायोग्यता) चौकटीत ठेवणे हे आहे. रसायनशास्त्रातील असत्यापित AI आउटपुट ही केवळ चूक नाही; हा प्रयोग स्फोट होऊ शकतो, एखाद्या व्यक्तीला विषबाधा झाली आहे किंवा पेपर मागे घेतला जाऊ शकतो.
भ्रम अपरिहार्य का आहे?
मोठ्या भाषेचे मॉडेल "पुढील बहुधा शब्द" तयार करते; हे जे शक्य आहे ते लक्ष्य करते, सत्य काय नाही. म्हणून तो आण्विक वजन, DOI किंवा उकळत्या बिंदूमध्ये “वाजवी वाटेल” असे मूल्य भरू शकतो — ते खरे आहे की नाही हे तपासल्याशिवाय. भ्रम हा दोष नसून या तंत्रज्ञानाच्या स्वरूपाचा परिणाम आहे. उपाय म्हणजे मॉडेलचे "निश्चित करण्याचा प्रयत्न" करणे नाही तर प्रत्येक आउटपुटभोवती प्रमाणीकरण शेल तयार करणे.
भ्रमाचा सर्वात कपटी पैलू म्हणजे त्याची आत्मविश्वासपूर्ण भाषा. एक चुकीचे आण्विक वजन अचूक सारख्याच आत्मविश्वासाने सादर केले जाते. त्यामुळे "आत्मविश्वास दिसतो" याचा अर्थ "योग्य" असा होत नाही.
लक्ष द्या: एआय एखाद्या विषयावर किती अस्खलित आणि आत्मविश्वासाने बोलतो हे त्या माहितीच्या अचूकतेशी संबंधित नाही. ओघ पटवून देतो; केवळ स्वतंत्र स्रोत अचूकता ठरवतो.
रसायनशास्त्रातील आउटपुट प्रकारानुसार प्रमाणीकरण
प्रत्येक आउटपुट प्रकाराची स्वतःची पडताळणी पद्धत असते. एकच नियम लक्षात ठेवण्याऐवजी, आउटपुटसाठी योग्य साधन वापरा:
आउटपुट प्रकार
सत्यापन पद्धत
वाहन
आण्विक वजन, सूत्र
सूत्रावरून पुनर्गणना करा
आरडीकिट / मॅन्युअली
स्माईल/रचना
पार्स + कॅनॉनिकल करा
आरडीकिट
उद्धरण/DOI
डेटाबेसमध्ये सोडवा
doi.org, Crossref
भौतिक स्थिरांक (kn, pKa)
संदर्भ डेटाबेस
पबकेम, हँडबुक
संख्यात्मक गणना
लिहा+रन कोड
अजगर
प्रतिक्रिया/स्थिती
साहित्य पुष्टीकरण
Reaxys, लेख
सुरक्षा दावा
SDS/GHS
अधिकृत SDS
स्पेक्ट्रम असाइनमेंट
बहु-तांत्रिक + मानवी
प्रायोगिक स्पेक्ट्रम
ही सारणी प्रत्यक्षात या मॉड्यूलचा सारांश आहे: प्रत्येक युनिट एक पंक्ती आहे.
त्रिकोणी: तीन स्वतंत्र मार्ग
सर्वात शक्तिशाली सत्यापन तंत्र "त्रिकोण" आहे: तीन स्वतंत्र मार्गांनी समान निष्कर्षावर पोहोचणे. उदाहरणार्थ, आण्विक वजनासाठी: (1) YZ काय म्हणतो, (2) RDKit ची गणना, (3) सूत्रावरून हाताने गणना. तीन ओव्हरलॅप असल्यास, विश्वास जास्त आहे; कोणी भरकटत असेल तर थांबा आणि तपास करा. रसायनशास्त्रातील एकाच स्रोतावर कधीही अवलंबून राहू नका; किमान दोन स्वतंत्र मार्ग पहा.
चरण-दर-चरण: सत्यापन कार्यप्रवाह
- आउटपुटचे वर्गीकरण करा: ही संख्या, रचना, विशेषता, सुरक्षा प्रतिपादन आहे का?
- योग्य साधन निवडा: वरील सारणीवरून आउटपुट प्रकारासाठी योग्य सत्यापन पथ मिळवा.
- स्वतंत्रपणे गणना करा/शोधा: वाहन AI पासून स्वतंत्रपणे चालवा; परिणामाची तुलना करा.
- विचलन असल्यास, थांबवा: मूल्ये जुळत नसल्यास, कोणते बरोबर आहे ते तपासल्याशिवाय पुढे जाऊ नका.
- तुमची खूण ठेवा: तुम्ही काय सत्यापित केले आणि कसे (वैज्ञानिक अखंडता) रेकॉर्ड करा.
- अनिश्चितता निर्दिष्ट करा: "अपुष्टीकृत" म्हणून सत्यापित केले जाऊ शकत नाही असे काहीतरी चिन्हांकित करा, ते लपवू नका.
चार कॉपी करण्यायोग्य टेम्पलेट्स
1) स्वत: ची पडताळणी:
तुम्ही आत्ताच खालील आउटपुट दिले: [आउटपुट]. कार्य: या आउटपुटच्या प्रत्येक संख्यात्मक/वास्तविक प्रतिपादनाची स्वतंत्र ओळीवर यादी करा. प्रत्येक प्रतिपादनासाठी: "स्वतंत्रपणे ते कसे सत्यापित करावे?" लेखन पद्धत (कोणते साधन/डेटाबेस). दावा खरा आहे असा दावा करू नका; फक्त ते सत्यापित करण्यासाठी एक मार्ग द्या.
२) त्रिकोणी नियंत्रण:
मला खालील रेणूचे वजन तीन प्रकारे तपासायचे आहे: [स्माइल]. कार्य: 1) आण्विक सूत्र काढा. 2) आण्विक वजन गणना अणूद्वारे अणू (प्रत्येक घटकाचे योगदान) दर्शवा. टीप: मी RDKit मध्ये देखील त्याची गणना करेन आणि तिसरे म्हणजे तुम्ही दिलेल्या एकाशी त्याची तुलना करा. जर तिघे ओव्हरलॅप झाले नाहीत तर चेतावणी द्या.
3) अस्पष्टता चिन्हांकन:
खालील मजकुरात अनेक तथ्यात्मक दावे आहेत:[TEXT]कार्य: प्रत्येक दाव्याच्या पुढे आत्मविश्वास पातळी लेबल लावा:[सत्यापित] / [सत्यापित] / [अनिश्चित]. तुम्हाला खात्री नसल्यास काहीही चिन्हांकित करू नका [सत्यापित].
4) सुसंगतता क्रॉस क्वेरी:
मी एकच प्रश्न दोन वेगवेगळ्या प्रकारे विचारेन; तुमची उत्तरे सुसंगत आहेत का ते पहा. प्रश्न A: संयुगाचे आण्विक सूत्र काय आहे
कमकुवत प्रॉम्प्ट / मजबूत प्रॉम्प्ट
कमकुवत:
या कंपाऊंडबद्दल तुम्हाला माहिती असलेली प्रत्येक गोष्ट लिहा.
AI बिनदिक्कतपणे सत्यापित आणि बनावट माहिती मिसळते; कोणता खरा आहे हे स्पष्ट नाही.
मजबूत:
या कंपाऊंडबद्दल माहिती द्या, परंतु प्रत्येक दाव्याला असे लेबल करा: [निर्धारित - इन्स्ट्रुमेंटद्वारे सत्यापित] उदा. आण्विक सूत्र, [प्रायोगिक - संदर्भ आवश्यक] उदा. वितळण्याचा बिंदू, [अनिश्चित - निश्चित नाही]. कोणतेही लेबल नसलेले दावे लिहू नका.
फरक: आम्ही एआयला स्वतःची अनिश्चितता चिन्हांकित करण्यास भाग पाडले; आम्ही पडताळणीचे काम नियोजित केले.
वैज्ञानिक अखंडता: प्रामाणिकपणा आणि शोधण्यायोग्यता
पडताळणी ही केवळ तांत्रिक पायरी नसून ती एक नैतिक समस्या आहे. वैज्ञानिक अखंडतेची आवश्यकता आहे:
- पारदर्शकता: तुम्ही AI वापरत आहात हे लपवू नका; तुमच्या प्रकाशन/अहवाला धोरणानुसार निर्दिष्ट करा.
- ट्रेसेबिलिटी: एआय मधून कोणते आउटपुट आले आणि ते कसे सत्यापित केले गेले याची नोंद करा.
- डेटा इंटिग्रिटी: AI सह परिणाम "सुशोभित करणे", औचित्य न देता आउटलायर्स टाकून देणे ही फसवणूक आहे.
- जबाबदारी: अंतिम परिणामासाठी तुम्ही जबाबदार आहात; “एआयने असे सांगितले” हे निमित्त नाही.
टीप: सुरुवातीपासूनच स्वीकार करा की तुम्ही अहवालात किंवा बचावात "एआयने असे म्हटले" हा वाक्यांश कधीही वापरू शकत नाही. ही स्वीकृती आपोआप प्रत्येक आउटपुटची पडताळणी करण्याची सवय आणते.
लहान प्रकरणे
केस 1 - त्रिकोणामध्ये त्रुटी आढळली. एका विद्यार्थ्याने आण्विक वजन तीन प्रकारे तपासले: YZ ने सांगितले 178.2, मॅन्युअल गणनाने 180.16 दिले, RDKit ने 180.16 दिले. दोन स्वतंत्र मार्गांनी ओव्हरलॅप केले आणि AI काढून टाकले. धडा: दोन स्वतंत्र पडताळणी एका खोट्या आउटपुटला शांतपणे पराभूत करतात.
केस 2 - सुरक्षित भाषा, चुकीची माहिती. एआयने अतिशय आत्मविश्वासाने लिहिले की प्रतिक्रिया "खोलीच्या तापमानावर उत्स्फूर्तपणे चालते." साहित्याने दर्शविले की यासाठी गरम आणि उत्प्रेरक आवश्यक आहे. विद्यार्थ्याने स्त्रोतावर विश्वास ठेवला, सुरक्षित भाषेवर नाही. धडा: ओघ म्हणजे अचूकता नाही.
केस 3 - पारदर्शकता प्राप्त झाली. त्याच्या पेपरच्या पद्धती विभागात, एका संशोधकाने स्पष्टपणे सांगितले की त्याने कोणत्या चरणांमध्ये एआय (टेक्स्ट एडिटिंग, कोड ड्राफ्टिंग) वापरला आणि लिहिले की त्याने सर्व संख्यात्मक परिणामांची स्वतंत्रपणे पडताळणी केली. पंच प्रक्रिया सुरळीत पार पडली. धडा: पारदर्शकता विश्वास निर्माण करते, लपविल्याने धोका निर्माण होतो.
सामान्य चुका
- सुरक्षित भाषेवर विश्वास ठेवा. AI चा आत्मविश्वासपूर्ण टोन अचूकतेचे सूचक नाही.
- एकाच स्रोतावर विसंबून. त्रिकोणाशिवाय एकल आउटपुट स्वीकारणे.
- आउटपुट प्रकार वेगळे करत नाही. असा विचार करून मी त्याच पद्धतीने क्रमांक, विशेषता आणि सुरक्षा प्रतिपादन "तपासले" आहे.
- अनिश्चितता लपवत आहे. एखाद्या गोष्टीचा अहवाल देणे ज्याची पडताळणी केली जाऊ शकत नाही की ती निश्चित आहे.
- AI चा वापर लपवत आहे. पारदर्शकतेचा अभाव वैज्ञानिक अखंडतेला कमी करते.
- जबाबदारी सोपवणे. "एआयने असे म्हटले" सबब अवैध आहे; जबाबदारी व्यक्तीची असते.
सारांशात
- भाषेच्या मॉडेलमध्ये मतिभ्रम अंतर्भूत आहे; उपाय म्हणजे प्रत्येक आउटपुटभोवती प्रमाणीकरण शेल तयार करणे.
- प्रत्येक आउटपुट प्रकाराची स्वतःची पडताळणी पद्धत असते; आउटपुटचे वर्गीकरण करा आणि योग्य साधन वापरा.
- त्रिकोणी (दोन स्वतंत्र मार्ग) हे सर्वात मजबूत नियंत्रण आहे; एका स्रोतावर विश्वास ठेवू नका.
- प्रवाहीपणा आणि आत्मविश्वासपूर्ण भाषा अचूकतेशी संबंधित नाही.
- वैज्ञानिक अखंडतेसाठी पारदर्शकता, शोधण्यायोग्यता, डेटा अखंडता आणि मानवी जबाबदारी आवश्यक आहे.
अर्ज कार्य
एआय सत्रामध्ये हेतुपुरस्सर विविध आउटपुट तयार करा: एक आण्विक वजन, एक संदर्भ, एक भौतिक स्थिरांक, सुरक्षा दावा, संख्यात्मक गणना. योग्य पद्धतीसह प्रत्येक स्वतंत्रपणे सत्यापित करा (टेबल पहा). किमान एक भ्रम पकडण्याचा प्रयत्न करा. नंतर "व्हॅलिडेशन मॅट्रिक्स" तयार करा: पंक्ती आउटपुट, स्तंभ (एआय मूल्य / स्वतंत्र मूल्य / ते ओव्हरलॅप केले / मी ते कसे सत्यापित केले). वैज्ञानिक अखंडतेच्या दृष्टीने तुम्ही या सत्राचा अहवाल कसा द्याल?
चेकलिस्ट
- [ ] मला समजले आहे की भ्रम का अपरिहार्य आहे.
- [ ] मी प्रत्येक आउटपुटचे त्याच्या प्रकारानुसार वर्गीकरण करतो आणि योग्य पद्धतीने सत्यापित करतो.
- [ ] मी गंभीर मूल्यांवर त्रिकोणी (दोन स्वतंत्र मार्ग) करतो.
- [ ] माझा स्रोतावर विश्वास आहे, सुरक्षित भाषेवर नाही.
- [ ] मी "अनिश्चित" म्हणून पुष्टी करू शकत नाही असे चिन्हांकित करतो.
- [ ] मी माझ्या AI च्या वापरात पारदर्शक आहे आणि परिणामासाठी मी स्वतःला जबाबदार धरतो.