युनिट्स
1. अर्थशास्त्रातील कृत्रिम बुद्धिमत्तेचा परिचय: भूमिका, सीमा, प्रमाणीकरण आणि डेटा नीतिशास्त्र 2. आर्थिक डेटा संकलन आणि स्त्रोत सत्यापन: TURKSTAT, EVDS, IMF, World Bank, FRED 3. डेटा क्लीनिंग, ट्रान्सफॉर्मेशन आणि एक्सप्लोरेटरी ॲनालिसिस (पायथन/पांडा सपोर्टसह) 4. वेळ मालिका विश्लेषण आणि अंदाज समर्थन 5. स्थूल आर्थिक निर्देशकांचा अर्थ लावणे: महागाई, वाढ, बेरोजगारी, चालू खात्यातील शिल्लक 6. परिस्थिती मॉडेलिंग आणि संवेदनशीलता विश्लेषण 7. अर्थमितीय मॉडेल समर्थन: प्रतिगमन, कार्यकारण आणि व्याख्या 8. साहित्य पुनरावलोकन आणि आर्थिक संशोधन संश्लेषण 9. पॉलिसी नोट, अहवाल आणि संक्षिप्त लेखन 10. आर्थिक डेटा व्हिज्युअलायझेशन आणि डॅशबोर्ड 11. सीमा, मॉडेल जोखीम, नैतिकता, गोपनीयता आणि शासन
युनिट 2 / 11

आर्थिक डेटा संकलन आणि स्त्रोत सत्यापन: TURKSTAT, EVDS, IMF, World Bank, FRED

नफा:

  • उद्देश, व्याप्ती, अपडेट वारंवारता आणि विश्वासार्हतेनुसार प्रमुख आर्थिक डेटा स्रोतांची तुलना करण्याची क्षमता (TURKSTAT, CBRT EVDS, IMF WEO, World Bank, Eurostat, FRED) आणि योग्य स्रोत निवडा
  • डेटा स्रोत शोधणे, सिरीयल कोड/वर्णन जुळणे आणि कोड जनरेशन डाउनलोड करण्यासाठी कृत्रिम बुद्धिमत्ता वापरण्याची क्षमता आणि अधिकृत स्त्रोतासह प्रत्येक निकालाची पुष्टी करणे
  • आवृत्ती (पुनरावृत्ती), आधार वर्ष, एकक आणि व्याख्या फरक विश्लेषणात कसे व्यत्यय आणतात आणि मेटाडेटा सत्यापित करण्याची सवय कशी मिळवतात हे पाहण्याची क्षमता

प्रत्येक आर्थिक विश्लेषण डेटापासून सुरू होते आणि विश्लेषणाची गुणवत्ता डेटाच्या गुणवत्तेपेक्षा कधीही जास्त असू शकत नाही. "गार्बेज इन, गार्बेज आऊट" हे तत्त्व अर्थशास्त्रात बिनदिक्कतपणे चालते: चुकीच्या पायावर, चुकीच्या व्याख्या किंवा चुकीच्या कालावधीवर आधारित सर्वात मोहक मॉडेल देखील चुकीचे आहे. या युनिटमध्ये, आम्ही योग्य डेटा शोधण्यासाठी, अनुक्रमांक जुळवण्यासाठी आणि डाउनलोड कोड लिहिण्यासाठी कृत्रिम बुद्धिमत्तेचा वापर करू; परंतु एक सुवर्ण नियम बदलणार नाही: आकृती अधिकृत प्राथमिक स्त्रोताकडून आली आहे, कृत्रिम बुद्धिमत्तेवरून नाही. एआय तुम्हाला स्त्रोताचा मार्ग दाखवू शकते; तुम्हाला त्या स्त्रोताकडूनच डेटा मिळेल.

चला मुख्य स्त्रोत जाणून घेऊया

अर्थशास्त्रज्ञाच्या कंपासमध्ये खालील संसाधने समाविष्ट आहेत. प्रत्येकाचा उद्देश, व्याप्ती आणि अपडेट लय वेगवेगळी आहे.

तुर्कस्ताट (तुर्की सांख्यिकी संस्था). तुर्कियेचे अधिकृत सांख्यिकी प्राधिकरण. महागाई (CPI/PPI), GDP, श्रमशक्ती, परकीय व्यापार, औद्योगिक उत्पादन, लोकसंख्या. तुर्कीयेच्या विशिष्ट आकृत्यांसाठी हा प्राथमिक स्त्रोत आहे.

CBRT EVDS (इलेक्ट्रॉनिक डेटा वितरण प्रणाली). सेंट्रल बँकेचे डेटा पोर्टल. विनिमय दर, व्याज, पैशांचा पुरवठा, पेमेंट शिल्लक, चालू शिल्लक, राखीव, अपेक्षा सर्वेक्षण. आर्थिक आणि आर्थिक डेटासाठी पहिला थांबा.

IMF (आंतरराष्ट्रीय नाणेनिधी). विशेषत: WEO (वर्ल्ड इकॉनॉमिक आउटलुक) डेटाबेस: क्रॉस-कंट्री तुलनात्मक GDP, चलनवाढ, कर्ज, चालू खात्यातील शिल्लक आणि अंदाज. आंतरराष्ट्रीय तुलनासाठी आदर्श; पण अंदाज हे अंदाज आहेत, प्रत्यक्षात नाहीत.

जागतिक बँक (जागतिक बँक — WDI). जागतिक विकास निर्देशक: विकास, गरिबी, शिक्षण, आरोग्य, पायाभूत सुविधा निर्देशक; लांब ऐतिहासिक मालिका आणि देश तुलना.

युरोस्टॅट. युरोपियन युनियनचे सांख्यिकी कार्यालय; EU देशांसाठी सुसंवादित (तुलनायोग्य) डेटा. EU बेंचमार्किंगमध्ये HICP (सुसंगत चलनवाढ) सारखी मालिका वापरली जाते.

FRED (फेडरल रिझर्व्ह इकॉनॉमिक डेटा). सेंट लुईस फेडची भव्य मालिका; यूएस आणि जागतिक मॅक्रो-फायनान्शियल डेटासाठी जलद आणि प्रोग्राम करण्यायोग्य प्रवेश (API) ऑफर करते.

OECD. विकसित अर्थव्यवस्थांसाठी तुलनात्मक निर्देशक, अग्रगण्य निर्देशक, उत्पादकता आणि कल्याण मालिका.

टीप: "योग्य स्त्रोत" प्रश्नाचे उत्तर हेतूवर अवलंबून आहे. Türkiye च्या अधिकृत महागाई साठी TURKSTAT; IMF/जागतिक बँक 30 देशांशी तुर्कियेची तुलना करेल; यूएस व्याजासाठी FRED. चुकीच्या स्त्रोताकडून समान निर्देशक घेणे ही एक मूक चूक आहे.

मूक त्रुटी स्त्रोत: पुनरावृत्ती, आधार वर्ष, एकक, वर्णन

आर्थिक डेटामधील सर्वात धोकादायक त्रुटी नीरव आहेत. चार जाणून घ्या:

  • पुनरावृत्ती (आवृत्ती). अनेक निर्देशक (जीडीपी, पेमेंट्सची शिल्लक) प्रथम जाहीर झाल्यानंतर काही महिन्यांनंतर सुधारित केले जातात. आजचा ‘तात्पुरता’ आकडा, तीन महिन्यांनंतरचा ‘अंतिम’ आकडा वेगळा असेल. तुम्ही कोणती विंटेज (आवृत्ती) वापरत आहात ते जाणून घ्या.
  • पायाभूत वर्ष. आधारभूत वर्षावर (=100) निर्देशांक स्थापित केले जातात. वेगवेगळ्या आधारभूत वर्षांशी दोन मालिकांची थेट तुलना करणे चुकीचे आहे.
  • युनिट. दशलक्ष किंवा अब्ज, TL किंवा डॉलर, वर्तमान किंवा निश्चित किंमत? युनिट गोंधळ ही सर्वात सामान्य विश्लेषण त्रुटी आहे.
  • व्याख्या/व्याप्ति. "बेरोजगारी" ची व्याख्या काय आहे? "कोर इन्फ्लेशन" कोणत्या बाबी वगळतात? एकाच नावाच्या दोन मालिका वेगवेगळ्या गोष्टी मोजू शकतात.
खबरदारी: जर दोन स्त्रोतांकडील समान निर्देशकाची आकृती जुळत नसेल, तर तुमची पहिली धारणा "कोणीतरी खोटे बोलत आहे" असे नसावे परंतु "व्याख्या/बेस/स्कोप/पुनरावृत्तीमध्ये फरक आहे" असे असू नये. प्रथम मेटाडेटा (डेटा उद्धरण) संरेखित करा.

स्टेप बाय स्टेप: एआय-चालित डेटा संकलन

  1. गरज स्पष्ट करा. कोणता सूचक, कोणता देश/प्रांत, कोणता कालावधी, कोणती वारंवारता (मासिक/त्रैमासिक/वार्षिक), कोणती व्याख्या?
  2. स्रोत निवडा. AI ला उद्देश स्पष्ट करा आणि योग्य प्राथमिक स्त्रोत आणि संपूर्ण मालिकेचे नाव सुचवा.
  3. मेटाडेटा सत्यापित करा. अधिकृत पृष्ठावर निवडलेल्या मालिकेचे युनिट, आधार वर्ष, वर्णन आणि अद्यतन तारीख निश्चित करा.
  4. डाउनलोड कोड व्युत्पन्न करा. ज्यांच्याकडे एपीआय आहे, जसे की FRED/वर्ल्ड बँक, AI वर पायथन कोड लिहा; TURKSTAT/EVDS साठी डाउनलोड पायऱ्या काढा.
  5. प्रथम तपासा. डेटा आल्यानंतर, पंक्ती/स्तंभांची संख्या, गहाळ मूल्ये, आउटलियर आणि तारीख श्रेणी तपासा.
  6. स्त्रोताची पुष्टी. अधिकृत प्रकाशनासह कमीतकमी काही निरीक्षणांची तुलना करा; ते नक्की जुळते का?

तीन लहान प्रकरणे

केस 1 - बेस इयर ट्रॅप. एका विश्लेषकाने दोन स्वतंत्र अभ्यासातून औद्योगिक उत्पादन निर्देशांक प्राप्त केला; एक 2015=100 वर आधारित होता आणि दुसरा 2021=100 वर आधारित होता. “हे एकत्र करा,” त्याने आर्टिफिशियल इंटेलिजन्सला सांगितले. जर त्याने मेटाडेटा तपासणे वगळले, तर तो निर्देशांक बाजूला ठेवेल आणि एक बनावट उडी पाहील. त्याने कंट्रोल स्टेपमध्ये बेस डिफरन्स पकडला, दोघांना कॉमन बेसमध्ये बदलले आणि नंतर एकत्र केले. बनावट बाऊन्स निघून गेले.

केस 2 - फॅब्रिकेटेड API आउटपुट. एका संशोधकाने कृत्रिम बुद्धिमत्तेला सांगितले, "जागतिक बँकेकडून तुर्कियेचा जीडीपी दरडोई काढा"; AI ने कोड आणि संख्यांचे सारणी दोन्ही "नमुना आउटपुट" म्हणून परत केले. संशोधकाने तक्ता वापरला नाही; फक्त कोड चालवला आणि वास्तविक API वरून डेटा आणला. मग त्याच्या लक्षात आले की आर्टिफिशियल इंटेलिजन्सने "उदाहरणे" म्हणून लिहिलेले आकडे प्रत्यक्षात 10-15 टक्के सूट होते. कोड टूल, नंबर नाही; हे योग्य वर्तन होते.

केस 3 - पुनरावृत्ती फरक. सहा महिन्यांपूर्वी प्रसिद्ध झालेल्या नोटमध्ये एका संस्थेने लिहिले की, तिमाही वाढ 4.0 टक्के होती; सध्याच्या TÜİK डेटामध्ये, त्याच तिमाहीत 3.5 टक्के सुधारित केले गेले. नवीन अहवालात, विश्लेषकाने तळटीपमध्ये सांगितले की त्याने कोणती आवृत्ती वापरली आणि दोन आकृत्यांमधील फरक पुनरावृत्तीसह स्पष्ट केला. पारदर्शकतेने विश्वासार्हता जपली.

स्रोत निवड सारणी

उद्देश

योग्य प्राथमिक स्रोत

लक्ष द्या

तुर्की महागाई (CPI/PPI)

तुर्कस्ताट

आधारभूत वर्ष, कोर/हेडलाइन फरक

विनिमय दर, व्याज, चालू शिल्लक, राखीव

CBRT EVDS

पुनरावृत्ती, मालिका व्याख्या

देशांमधील जीडीपी/ चलनवाढीची तुलना

IMF WEO

प्रक्षेपण ≠ प्राप्ती

विकास/दीर्घ ऐतिहासिक मालिका

जागतिक बँक WDI

कव्हरेज, गहाळ वर्षे

EU सुसंवादित निर्देशक

युरोस्टॅट

HICP व्याख्या

यूएस/ग्लोबल मॅक्रोफायनान्स, API

फ्रेड

हंगामी समायोजन स्थिती

चार कॉपी करण्यायोग्य टेम्पलेट्स

1) स्रोत आणि मालिका जुळणे:

मला खालील निर्देशकाची आवश्यकता आहे: [सूचक, देश/प्रांत, कालावधी, वारंवारता, वर्णन]. यासाठी सर्वात योग्य प्राथमिक अधिकृत स्रोत आणि संपूर्ण मालिका नावाची शिफारस करा. एकक, आधार वर्ष आणि मालिकेचे वर्णन याबद्दल मला पडताळणी करण्यासाठी आवश्यक असलेल्या गुणांची यादी करा. नंबर देऊ नका; फक्त ते कुठे आणि कसे विकत घ्यावे ते सांगा.

2) FRED/वर्ल्ड बँक डाउनलोड कोड:

खालील मालिका डाउनलोड करणाऱ्या [FRED/World Bank] API सह Python मध्ये कोड लिहा: [मालिका कोड/नाव], [तारीख श्रेणी]. कोड डेटा pandasDataFrame मध्ये घेतो, पहिल्या/शेवटच्या 5 पंक्ती आणि गहाळ मूल्यांची संख्या प्रिंट करतो. मला उदाहरण देऊ नका/बनवलेली आकृती; फक्त कार्यरत कोड द्या.

3) मेटाडेटा प्रमाणीकरण सूची:

मी खालील मालिका वापरेन: [मालिका]. वापरण्यापूर्वी तुम्हाला पडताळणी करणे आवश्यक असलेल्या मेटाडेटाची एक चेकलिस्ट तयार करा: व्हॉल्यूम, बेस इयर, हंगामी समायोजन स्थिती, व्याख्या/व्याप्ति, अद्यतन तारीख, पुनरावृत्ती स्थिती. प्रत्येक आयटमसाठी, एका वाक्यात "काय आणि कुठे पुष्टी करायची" लिहा.

4) दोन संसाधने जुळत नसलेले निदान:

मला दोन स्त्रोतांकडून समान सूचक मिळाले आणि संख्या भिन्न आहेत: स्त्रोत A: [मूल्य, छाप]. स्रोत बी: [मूल्य, छाप]. या फरकाची संभाव्य निष्पाप कारणे सूचीबद्ध करा (व्याख्या, आधार, व्याप्ती, हंगामी समायोजन, पुनरावृत्ती, चलन) आणि प्रत्येकासाठी कसे तपासायचे ते मला सांगा. "एक चूक आहे" असे म्हणू नका; प्रथम मला विसंगती स्पष्ट करण्यात मदत करा.

कमकुवत प्रॉम्प्ट / मजबूत प्रॉम्प्ट

कमकुवत प्रॉम्प्ट:

मला Türkiye च्या गेल्या 10 वर्षातील वाढीचा डेटा द्या.

एआय त्याच्या स्मृतीतून एक चित्र बाहेर टाकते, शक्यतो जुने आणि अंशतः बनावट; कोणताही स्रोत किंवा छाप नाही.

शक्तिशाली सूचना:

मी 2014-2023 Türkiye वार्षिक वास्तविक GDP वाढ वापरेन. मला यासाठी प्राथमिक स्रोत (TURKSTAT) आणि संपूर्ण मालिकेचे नाव सांगा; मालिकेची किंमत निश्चित आहे का आणि आधार वर्षाची पडताळणी करण्यासाठी कुठे पहावे ते मला सांगा. हा डेटा डाउनलोड करण्यासाठी पायऱ्या/कोड देखील द्या. स्वतः संख्या तयार करू नका.

सामान्य चुका

  • वास्तविक डेटासाठी कृत्रिम बुद्धिमत्तेचे "नमुना आउटपुट" सारणी चुकणे. ते आकडे बनावट असू शकतात; फक्त कोड/मार्गदर्शक वापरा.
  • मेटाडेटा संरेखित न करता दोन मालिकांची तुलना करणे. बेस/युनिट/व्याख्यातील फरक चुकीचे परिणाम देतो.
  • वास्तविकतेसाठी प्रक्षेपण चुकणे. IMF WEO मधील पुढील वर्षाचा आकडा हा एक अंदाज आहे.
  • पुनरावृत्तीकडे दुर्लक्ष करणे. तुम्ही कोणती आवृत्ती वापरत आहात हे सांगितले नाही.
  • वारंवारता जुळत नाही. दुरुस्तीशिवाय मासिक मालिका त्रैमासिक मालिकेसह एकत्र करणे.
  • तळटीपांमध्ये स्त्रोत उद्धृत करत नाही. शोधण्यायोग्य नसलेली आकृती म्हणजे असमर्थनीय आकृती.

सारांशात

विश्लेषणाची शक्ती ही डेटाची शक्ती आहे. योग्य स्रोत शोधण्यासाठी AI वापरा, मालिका जुळवा आणि डाउनलोड कोड लिहा; परंतु नेहमी प्राथमिक अधिकृत स्रोत (TURKSTAT, EVDS, IMF, World Bank, Eurostat, FRED) कडून आकृती मिळवा. मेटाडेटा संरेखित करून मूक त्रुटी स्त्रोत जसे की पुनरावृत्ती, आधार वर्ष, खंड आणि वर्णन तटस्थ करा. जर दोन स्त्रोत विरोधाभास असतील तर प्रथम विशेषताची तुलना करा.

अर्ज कार्य

तुम्ही तुमच्या व्यवसायात वारंवार वापरता असा सूचक निवडा. वरील टेम्प्लेट 1 आणि 3 सह AI कडे स्त्रोत आणि मेटाडेटा चेकलिस्ट काढा. नंतर दोन भिन्न स्त्रोतांकडून समान सूचक शोधा (उदा. तुर्कस्टॅट आणि जागतिक बँक) आणि आकडेवारीची तुलना करा; फरक असल्यास, टेम्प्लेट 4 सह कारणाचे निदान करा आणि तीन वाक्यांमध्ये तुमचा शोध लक्षात घ्या.

चेकलिस्ट

  • [ ] मी माझ्या उद्देशासाठी योग्य असलेला प्राथमिक स्रोत निवडला (मी तुर्कियेच्या अधिकृत/आंतरराष्ट्रीय तुलनामध्ये फरक केला आहे).
  • [ ] मी अधिकृत पृष्ठावरून मालिकेचे युनिट, आधार वर्ष, वर्णन आणि अद्यतन तारीख सत्यापित केली.
  • [ ] मी वास्तविक स्त्रोताकडून घेतलेला डेटा वापरला आहे, कृत्रिम बुद्धिमत्तेने दिलेले "नमुना आकडे" नाही.
  • [ ] मी अधिकृत प्रकाशनाशी किमान काही निरीक्षणांची शब्दशः तुलना केली.
  • [ ] मी पुनरावृत्ती/आवृत्ती स्थिती तपासली आणि मी वापरत असलेली आवृत्ती लक्षात घेतली.
  • [ ] मी मेटाडेटा संरेखित करून दोन स्त्रोत विरोधाभास स्पष्ट केले.
  • [ ] मी वापरलेल्या प्रत्येक आकृतीचा स्रोत मी तळटीपसह शोधण्यायोग्य बनवला.