Egység 2 / 11

Gazdasági adatgyűjtés és forrásellenőrzés: TURKSTAT, EVDS, IMF, Világbank, FRED

Nyereség:

  • A főbb gazdasági adatforrások (TURKSTAT, CBRT EVDS, IMF WEO, Világbank, Eurostat, FRED) összehasonlítása cél, hatókör, frissítési gyakoriság és megbízhatóság szerint, valamint a megfelelő forrás kiválasztása
  • Lehetőség mesterséges intelligencia használatára adatforrás megtalálásához, sorozatkód/leírás egyeztetéshez és letöltési kód generálásához, valamint minden eredmény megerősítéséhez a hivatalos forrással
  • Képes látni, hogy a verzió (revízió), a bázisév, az egység és a definíció különbségei hogyan zavarják meg az elemzést, és hogyan válnak a metaadatok ellenőrzésének szokásává

Minden gazdasági elemzés az adatokkal kezdődik, és az elemzés minősége soha nem haladhatja meg az adatok minőségét. A "szemét be, szemét ki" elve menthetetlenül működik a közgazdaságtanban: még a legelegánsabb modell is rossz alapon, rossz definíción vagy rossz időszakon alapul. Ebben az egységben mesterséges intelligenciát használunk, hogy megtaláljuk a megfelelő adatokat, párosítsuk a sorozatkódokat és megírjuk a letöltési kódot; Egy aranyszabály azonban nem fog változni: az adat a hivatalos elsődleges forrásból származik, nem pedig a mesterséges intelligenciából. Az AI megmutatja a forráshoz vezető utat; magát az adatot abból a forrásból kapja.

Ismerjük meg a főbb forrásokat

A közgazdász iránytűje a következő forrásokat tartalmazza. Mindegyiknek más a célja, hatóköre és frissítési ritmusa.

TURKSTAT (Török Statisztikai Intézet). Türkiye hivatalos statisztikai hatósága. Infláció (CPI/PPI), GDP, munkaerő, külkereskedelem, ipari termelés, népesség. Ez a Türkiye-ra jellemző adatok elsődleges forrása.

CBRT EVDS (elektronikus adatelosztó rendszer). A jegybank adatportálja. Árfolyam, kamat, pénzkínálat, fizetési mérleg, folyó egyenleg, tartalékok, várakozás felmérések. A pénzügyi és monetáris adatok első állomása.

IMF (Nemzetközi Valutaalap). Különösen a WEO (World Economic Outlook) adatbázis: országok közötti összehasonlító GDP, infláció, adósság, folyó fizetési mérleg és előrejelzések. Ideális nemzetközi összehasonlításhoz; De az előrejelzések előrejelzések, nem realitások.

Világbank (World Bank – WDI). Világfejlesztési mutatók: fejlesztési, szegénységi, oktatási, egészségügyi, infrastrukturális mutatók; hosszú történelmi sorozatok és ország-összehasonlítások.

Eurostat. az Európai Unió Statisztikai Hivatala; Harmonizált (összehasonlítható) adatok az EU országaira vonatkozóan. Az olyan sorozatokat, mint a HICP (harmonizált infláció) használják az EU benchmarking során.

FRED (Federal Reserve Economic Data). St. Louis Fed hatalmas sorozata; Gyors és programozható hozzáférést (API) kínál az egyesült államokbeli és globális makro-pénzügyi adatokhoz.

OECD. Összehasonlító mutatók, vezető mutatók, termelékenységi és jóléti sorozatok a fejlett gazdaságok számára.

Tipp: A „helyes forrás” kérdésre adott válasz a céltól függ. TURKSTAT Türkiye hivatalos inflációjára; IMF/Világbank összehasonlítani Türkiye-t 30 országgal; FRED amerikai érdekből. Ugyanazt a mutatót rossz forrásból venni néma hiba.

Néma hibaforrások: revízió, bázisév, mértékegység, leírás

A gazdasági adatok legveszélyesebb hibái zajtalanok. Ismerj meg négyet:

  • Revízió (verzió). Számos mutatót (GDP, fizetési mérleg) az első bejelentés után hónapokkal felülvizsgálnak. A mai "ideiglenes" adat, három hónap után a "végső" adat más lesz. Tudja, melyik évjáratot (verziót) használja.
  • Bázis év. Az indexek bázisév (=100) alapján kerülnek megállapításra. Helytelen közvetlenül összehasonlítani két különböző bázisévszámú sorozatot.
  • Egység. Millió vagy milliárd, TL vagy dollár, aktuális vagy fix ár? Az egységzavar a leggyakoribb elemzési hiba.
  • Meghatározás/hatókör. Mi a "munkanélküliség" definíciója? Milyen tételeket zár ki az „alapinfláció”? Két azonos nevű sorozat különböző dolgokat mérhet.
Vigyázat: Ha ugyanannak a mutatónak a száma két forrásból nem egyezik, akkor az első feltételezés nem az, hogy „valaki hazudik”, hanem „különbség van a meghatározásban/alapban/hatókörben/felülvizsgálatban”. Először igazítsa el a metaadatokat (adathivatkozást).

Lépésről lépésre: AI-alapú adatgyűjtés

  1. Tisztázza a szükségességet. Melyik mutató, melyik ország/tartomány, melyik időszakban, milyen gyakorisággal (havi/negyedévente/évente), milyen meghatározás?
  2. Válassza ki a forrást. Magyarázza el a célt az AI-nak, és javasolja a megfelelő elsődleges forrást és a sorozat teljes nevét.
  3. Érvényesítse a metaadatokat. Erősítse meg a kiválasztott sorozat egységét, alapévét, leírását és frissítési dátumát a hivatalos oldalon.
  4. Generálja le a letöltési kódot. Azok, akik rendelkeznek API-val, mint például a FRED/World Bank, írjanak Python kódot az AI-ba; Távolítsa el a TURKSTAT/EVDS letöltési lépéseit.
  5. Első ellenőrzés. Az adatok megérkezése után ellenőrizze a sorok/oszlopok számát, a hiányzó értékeket, a kiugró értékeket és a dátumtartományt.
  6. A forrás megerősítése. Hasonlítson össze legalább néhány észrevételt a hivatalos publikációval; Pontosan egyezik?

három mini tok

1. eset – Bázisév csapda. Az egyik elemző két külön tanulmányból kapott ipari termelési indexet; az egyik alapja 2015=100, a másik pedig 2021=100. „Kombinálja ezeket” – mondta a mesterséges intelligenciának. Ha kihagyta a metaadat-ellenőrzést, akkor egymás mellé helyezné az indexeket, és hamis ugrást látna. Az alapkülönbséget az irányítási lépésben elkapta, a kettőt közös alapmá alakította, majd egyesítette. Az álpattanás eltűnt.

2. eset – Összeállított API-kimenet. Egy kutató azt mondta a mesterséges intelligenciának: „Húzza le Türkiye egy főre eső GDP-jét a Világbankból”; Az AI mind a kódot, mind a számtáblázatot "minta kimenetként" adta vissza. A kutató nem használta a táblázatot; csak lefuttatta a kódot, és lekérte az adatokat a valódi API-ból. Aztán rájött, hogy a mesterséges intelligencia által "példaként" írt számok valójában 10-15 százalékos kedvezményt jelentenek. Kódeszköz, nem szám; Ez volt a helyes viselkedés.

3. eset – Revíziós eltérés. Egy hat hónappal ezelőtt közzétett feljegyzésben egy intézmény azt írta, hogy a negyedéves növekedés 4,0 százalék volt; A TÜİK jelenlegi adataiban ugyanezt a negyedévet 3,5 százalékra módosították. Az új jelentésben az elemző lábjegyzetben közölte, hogy melyik verziót használta, és átdolgozással magyarázta a két adat közötti különbséget. Az átláthatóság megőrizte a hitelességet.

Forrás kiválasztási táblázat

Cél

Megfelelő elsődleges forrás

Figyelem

Türkiye infláció (CPI/PPI)

TURKSTAT

Bázisév, alap/főcím megkülönböztetés

Árfolyam, kamat, folyó egyenleg, tartalékok

CBRT EVDS

Revízió, sorozatdefiníció

GDP/infláció összehasonlítása országok között

IMF WEO

Projekció ≠ megvalósítás

Fejlődés/hosszú történelmi sorozat

Világbank WDI

Lefedettség, hiányzó évek

EU harmonizált mutatók

Eurostat

HICP meghatározása

USA/globális makrofinanszírozás, API

FRED

Szezonális kiigazítás állapota

Négy másolható sablon

1) Forrás és sorozat egyezése:

A következő mutatóra van szükségem: [mutató, ország/tartomány, időszak, gyakoriság, leírás]. Ehhez ajánlja a legmegfelelőbb elsődleges hivatalos forrást és a sorozat teljes nevét. Sorolja fel azokat a pontokat, amelyeket ellenőriznem kell a sorozat egységével, alapévével és leírásával kapcsolatban. Ne adj számokat; Csak mondd meg, hol és hogyan lehet megvásárolni.

2) FRED/World Bank letöltési kód:

Írjon egy kódot Pythonban a [FRED/World Bank] API-val, amely letölti a következő sorozatokat: [sorozat kódja/név], [dátumtartomány]. A kód beviszi az adatokat a pandasDataFrame-be, kiírja az első/utolsó 5 sort és a hiányzó értékek számát. Ne mondj példát/kitalált figurát; csak adja meg a működő kódot.

3) A metaadatok érvényesítési listája:

A következő sorozatot fogom használni: [sorozat]. Hozzon létre egy ellenőrzőlistát azokról a metaadatokról, amelyeket a használat előtt ellenőrizni kell: mennyiség, bázisév, szezonális kiigazítás állapota, meghatározás/hatókör, frissítés dátuma, revízió állapota. Minden tételhez írja be egy mondatban, hogy "mit és hol kell megerősíteni".

4) Két erőforrás-eltérés diagnózisa:

Ugyanazt a mutatót két forrásból kaptam, és a számok eltérőek: A forrás: [érték, impresszum]. B forrás: [érték, impresszum]. Sorolja fel ennek a különbségnek a lehetséges ártatlan okait (meghatározás, alap, hatály, szezonális kiigazítás, revízió, pénznem), és mondja el, hogyan ellenőrizhetem mindegyiket. Ne mondd, hogy „az egyik téved”; Először is segíts elmagyarázni az eltérést.

Gyenge felszólítás / Erős felszólítás

Gyenge felszólítás:

Adja meg a Türkiye növekedési adatait az elmúlt 10 évre vonatkozóan.

Az AI kiönt egy képet az emlékezetéből, valószínűleg régi és részben gyártott; Sem forrás, sem lenyomat nincs.

Erőteljes felszólítás:

A 2014-2023-as Türkiye éves reál-GDP növekedését fogom használni. Mondja el ennek az elsődleges forrását (TURKSTAT) és a sorozat teljes nevét; mondja meg, hogy a sorozat fix áras-e, és hol keressem a bázisév ellenőrzését. Adja meg az adatok letöltéséhez szükséges lépéseket/kódokat is. Ne állítsa elő magukat a számokat.

Gyakori hibák

  • A mesterséges intelligencia "mintakimeneti" táblázatának összetévesztése valós adatokkal. Ezek a számok kitalálhatók; csak használja a kódot/útmutatót.
  • Két sorozat összehasonlítása metaadatok összehangolása nélkül. Az alap/egység/definíció különbsége hamis eredményeket eredményez.
  • A kivetítés összetévesztése a valósággal. Az IMF WEO-ban szereplő jövő évi adat becslés.
  • A felülvizsgálat figyelmen kívül hagyása. Nem írja le, hogy melyik verziót használja.
  • Frekvencia eltérés. Havi sorozat kombinálása negyedéves sorozattal korrekció nélkül.
  • A lábjegyzetekben nem hivatkozik a forrásra. A nem követhető alak tarthatatlan.

Összefoglalva

Az elemzés ereje az adatok ereje. Használja az AI-t a megfelelő forrás megtalálásához, a sorozatok párosításához és a letöltési kód megírásához; de mindig az elsődleges hivatalos forrásból szerezze be az adatot (TURKSTAT, EVDS, IMF, Világbank, Eurostat, FRED). Semlegesítse a csendes hibaforrásokat, például a felülvizsgálatot, a bázisévet, a kötetet és a leírást a metaadatok igazításával. Ha két forrás ütközik, először hasonlítsa össze a hozzárendelést.

Pályázati feladat

Válasszon egy mutatót, amelyet gyakran használ a vállalkozásában. Kérje meg az AI-t, hogy a fenti 1. és 3. sablon segítségével bontsa ki a forrás- és metaadatok ellenőrzőlistáját. Ezután keresse meg ugyanazt a mutatót két különböző forrásból (pl. TURKSTAT és Világbank), és hasonlítsa össze az adatokat; Ha eltérés mutatkozik, diagnosztizálja az okot a 4. sablon segítségével, és három mondatban jegyezze fel megállapítását.

ellenőrző lista

  • [ ] A célomnak megfelelő elsődleges forrást választottam (különbséget tettem a Türkiye hivatalos / nemzetközi összehasonlítása között).
  • [ ] A hivatalos oldalról ellenőriztem a sorozat egységét, alapévét, leírását és frissítési dátumát.
  • [ ] A valós forrásból vett adatokat használtam, nem a mesterséges intelligencia által adott "mintaadatokat".
  • [ ] Legalább néhány megfigyelést szó szerint összehasonlítottam a hivatalos publikációval.
  • [ ] Ellenőriztem a változat/verzió állapotát, és feljegyeztem az általam használt verziót.
  • [ ] A két forrásütközést a metaadatok összehangolásával magyaráztam.
  • [ ] Minden általam használt ábra forrását lábjegyzet segítségével követhetővé tettem.