Winst:
- Mogelijkheid om belangrijke economische gegevensbronnen (TURKSTAT, CBRT EVDS, IMF WEO, Wereldbank, Eurostat, FRED) te vergelijken op basis van doel, reikwijdte, updatefrequentie en betrouwbaarheid en de juiste bron te kiezen
- Mogelijkheid om kunstmatige intelligentie te gebruiken voor het vinden van gegevensbronnen, het matchen van seriële codes/beschrijvingen en het genereren van downloadcodes, en het bevestigen van elk resultaat met de officiële bron
- Mogelijkheid om te zien hoe verschillen in versie (revisie), basisjaar, eenheid en definitie de analyse verstoren en de gewoonte krijgen om metadata te verifiëren
Elke economische analyse begint met gegevens, en de kwaliteit van de analyse kan nooit groter zijn dan de kwaliteit van de gegevens. Het principe van ‘garbage in, garbage out’ werkt onverbiddelijk in de economie: zelfs het meest elegante model, gebaseerd op de verkeerde basis, verkeerde definitie of verkeerde periode, is verkeerd. In deze unit zullen we kunstmatige intelligentie gebruiken om de juiste gegevens te vinden, seriële codes te matchen en de downloadcode te schrijven; Maar één gouden regel zal niet veranderen: het cijfer komt van de officiële primaire bron, niet van kunstmatige intelligentie. AI kan je de weg wijzen naar de bron; u krijgt de gegevens zelf uit die bron.
Laten we de belangrijkste bronnen leren kennen
Het kompas van een econoom omvat de volgende bronnen. Het doel, de reikwijdte en het updateritme zijn verschillend.
TURKSTAT (Turks Instituut voor de Statistiek). De officiële statistische autoriteit van Türkiye. Inflatie (CPI/PPI), BBP, beroepsbevolking, buitenlandse handel, industriële productie, bevolking. Dit is de belangrijkste bron voor cijfers die specifiek zijn voor Türkiye.
CBRT EVDS (elektronisch gegevensdistributiesysteem). Dataportaal van de Centrale Bank. Wisselkoers, rente, geldhoeveelheid, betalingsbalans, huidig saldo, reserves, verwachtingsonderzoeken. De eerste stop voor financiële en monetaire gegevens.
IMF (Internationaal Monetair Fonds). Vooral de WEO-database (World Economic Outlook): vergelijkend bbp, inflatie, schulden, saldo op de lopende rekening en projecties tussen de landen. Ideaal voor internationale vergelijking; Maar projecties zijn voorspellingen, geen realisaties.
Wereldbank (Wereldbank – WDI). Wereldontwikkelingsindicatoren: indicatoren voor ontwikkeling, armoede, onderwijs, gezondheidszorg en infrastructuur; lange historische reeksen en landenvergelijkingen.
Eurostat. Statistisch bureau van de Europese Unie; Geharmoniseerde (vergelijkbare) gegevens voor EU-landen. Reeksen zoals HICP (geharmoniseerde inflatie) worden gebruikt in EU-benchmarks.
FRED (economische gegevens van de Federal Reserve). De enorme serie van de St. Louis Fed; Biedt snelle en programmeerbare toegang (API) voor Amerikaanse en mondiale macrofinanciële gegevens.
OESO. Vergelijkende indicatoren, voorlopende indicatoren, productiviteits- en welvaartsreeksen voor ontwikkelde economieën.
Tip: Het antwoord op de vraag ‘juiste bron’ is afhankelijk van het doel. TURKSTAT voor de officiële inflatie van Türkiye; IMF/Wereldbank gaat Turkije vergelijken met 30 landen; FRED voor Amerikaanse interesse. Het nemen van dezelfde indicator uit de verkeerde bron is een stille vergissing.
Stille foutbronnen: revisie, basisjaar, eenheid, beschrijving
De gevaarlijkste fouten in economische gegevens zijn geruisloos. Maak kennis met vier:
- Revisie (versie). Veel indicatoren (bbp, betalingsbalans) worden maanden nadat ze voor het eerst zijn aangekondigd herzien. Het ‘voorlopige’ cijfer van vandaag, het ‘definitieve’ cijfer over drie maanden zal anders zijn. Weet welke vintage(versie) je gebruikt.
- Basisjaar. Indexcijfers worden vastgesteld op basis van een basisjaar (=100). Het is verkeerd om twee series met verschillende basisjaren rechtstreeks te vergelijken.
- Eenheid. Miljoen of miljard, TL of dollar, huidige of vaste prijs? Eenheidsverwarring is de meest voorkomende analysefout.
- Definitie/reikwijdte. Wat is de definitie van "werkloosheid"? Welke items sluit de ‘kerninflatie’ uit? Twee series met dezelfde naam kunnen verschillende dingen meten.
Let op: Als het cijfer voor dezelfde indicator uit twee bronnen niet overeenkomt, moet uw eerste aanname niet zijn "iemand liegt", maar "er is een verschil in definitie/grondslag/reikwijdte/herziening". Lijn eerst de metadata (datacitatie) uit.
Stap voor stap: gegevensverzameling op basis van AI
- Maak de behoefte duidelijk. Welke indicator, welk land/provincie, welke periode, welke frequentie (maandelijks/kwartaal/jaarlijks), welke definitie?
- Selecteer bron. Leg het doel uit aan de AI en stel de juiste primaire bron en volledige serienaam voor.
- Valideer metagegevens. Bevestig de eenheid, het basisjaar, de beschrijving en de updatedatum van de geselecteerde serie op de officiële pagina.
- Genereer de downloadcode. Voor degenen met een API, zoals FRED/Wereldbank, schrijf Python-code naar de AI; Verwijder de downloadstappen voor TURKSTAT/EVDS.
- Eerste controle. Nadat de gegevens zijn binnengekomen, controleert u het aantal rijen/kolommen, ontbrekende waarden, uitschieters en het datumbereik.
- Bevestiging van bron. Vergelijk op zijn minst een paar observaties met de officiële publicatie; Komt het precies overeen?
drie minikoffers
Geval 1 — Basisjaarval. Eén analist verkreeg een industriële productie-index uit twee afzonderlijke onderzoeken; de ene was gebaseerd op 2015=100 en de andere was gebaseerd op 2021=100. “Combineer deze”, zei hij tegen de kunstmatige intelligentie. Als hij de metadatacontrole oversloeg, zou hij de indices naast elkaar zetten en een nepsprong zien. Hij ving het basisverschil op in de controlestap, maakte van de twee een gemeenschappelijke basis en combineerde ze vervolgens. De nep-bounce is verdwenen.
Geval 2 — Gefabriceerde API-uitvoer. Een onderzoeker zei tegen kunstmatige intelligentie: "Trek het BBP per hoofd van de bevolking van Türkiye van de Wereldbank"; De AI retourneerde zowel de code als een tabel met getallen als "voorbeelduitvoer". De onderzoeker heeft de tabel niet gebruikt; voerde gewoon de code uit en haalde de gegevens op van de echte API. Toen realiseerde hij zich dat de cijfers die door de kunstmatige intelligentie als ‘voorbeelden’ waren geschreven in werkelijkheid 10 tot 15 procent afwijken. Codeertool, geen nummer; Dit was het juiste gedrag.
Geval 3 — Verschil in herziening. In een zes maanden geleden gepubliceerde notitie schreef een instelling dat de kwartaalgroei 4,0 procent bedroeg; In de huidige TÜİK-gegevens werd hetzelfde kwartaal herzien naar 3,5 procent. In het nieuwe rapport vermeldde de analist in een voetnoot welke versie hij gebruikte en legde hij met een herziening het verschil uit tussen de twee cijfers. Transparantie behield de geloofwaardigheid.
Bronselectietabel
Doel
Geschikte primaire bron
Aandacht
Turkse inflatie (CPI/PPI)
TURKSTAT
Basisjaar, onderscheid kern/koplijn
Wisselkoers, rente, huidig saldo, reserves
CBRT EVDS
Revisie, seriedefinitie
BBP/inflatievergelijking tussen landen
IMF WEO
Projectie ≠ realisatie
Ontwikkeling/lange historische reeks
WDI van de Wereldbank
Dekking, ontbrekende jaren
Geharmoniseerde EU-indicatoren
Eurostat
HICP-definitie
Amerikaanse/mondiale macrofinanciering, API
FRED
Seizoensaanpassingsstatus
Vier kopieerbare sjablonen
1) Bron- en seriematching:
Ik heb de volgende indicator nodig: [indicator, land/provincie, periode, frequentie, beschrijving]. Beveel hiervoor de meest geschikte primaire officiële bron en volledige serienaam aan. Noem de punten die ik moet verifiëren over de eenheid, het basisjaar en de beschrijving van de serie. Geef geen cijfers; Vertel me gewoon waar en hoe ik het kan kopen.
2) FRED/Wereldbank downloadcode:
Schrijf een code in Python met de [FRED/Wereldbank] API die de volgende series downloadt: [seriecode/naam], [datumbereik]. De code neemt de gegevens over in pandasDataFrame, drukt de eerste/laatste 5 rijen en het aantal ontbrekende waarden af. Geef mij geen voorbeeld/verzonnen figuur; geef gewoon werkende code.
3) Validatielijst metagegevens:
Ik zal de volgende reeks gebruiken: [reeks]. Maak een checklist met metadata die u vóór gebruik moet verifiëren: volume, basisjaar, seizoensaanpassingsstatus, definitie/scope, updatedatum, revisiestatus. Schrijf voor elk item in één zin 'wat en waar te bevestigen'.
4) Twee diagnoses van mismatch-bronnen:
Ik kreeg dezelfde indicator uit twee bronnen en de cijfers zijn verschillend: Bron A: [waarde, afdruk]. Bron B: [waarde, impressum]. Noem mogelijke onschuldige redenen voor dit verschil (definitie, basis, reikwijdte, seizoensaanpassing, herziening, valuta) en vertel me hoe ik elk van deze redenen kan controleren. Zeg niet "er is één fout"; Help me eerst de discrepantie uit te leggen.
Zwakke prompt/sterke prompt
Zwakke prompt:
Geef mij de groeigegevens van Türkiye van de afgelopen tien jaar.
De AI giet een afbeelding uit zijn geheugen, mogelijk oud en gedeeltelijk verzonnen; Er is geen bron of impressum.
Krachtige prompt:
Ik zal de jaarlijkse reële bbp-groei van 2014-2023 in Turkije gebruiken. Vertel mij de primaire bron hiervoor (TURKSTAT) en de volledige naam van de serie; vertel me of de serie een vaste prijs heeft en waar ik moet kijken om het basisjaar te verifiëren. Geef ook de stappen/codes op om deze gegevens te downloaden. Produceer de cijfers niet zelf.
Veel voorkomende fouten
- De tabel met "voorbeelduitvoer" van kunstmatige intelligentie verwarren met echte gegevens. Die cijfers kunnen verzonnen zijn; gebruik gewoon de code/richtlijn.
- Twee series vergelijken zonder metadata op elkaar af te stemmen. Verschil in basis/eenheid/definitie levert valse resultaten op.
- Een projectie voor de werkelijkheid verwarren. Het cijfer voor volgend jaar in de IMF WEO is een schatting.
- Het negeren van de herziening. Er wordt niet vermeld welke versie u gebruikt.
- Frequentie komt niet overeen. Combineren van een maandreeks met een kwartaalreeks zonder correctie.
- Zonder bronvermelding in voetnoten. Een cijfer dat niet traceerbaar is, is een cijfer dat onhoudbaar is.
Samengevat
De kracht van analyse is de kracht van data. Gebruik AI om de juiste bron te vinden, match de series en schrijf een downloadcode; maar haal het cijfer altijd uit de primaire officiële bron (TURKSTAT, EVDS, IMF, Wereldbank, Eurostat, FRED). Neutraliseer bronnen van stille fouten, zoals revisie, basisjaar, volume en beschrijving, door metagegevens op één lijn te brengen. Als twee bronnen conflicteren, vergelijk dan eerst de toeschrijving.
Applicatie taak
Kies een indicator die u vaak gebruikt in uw bedrijf. Laat de AI de bron- en metadatachecklist uitpakken met sjablonen 1 en 3 hierboven. Zoek vervolgens dezelfde indicator uit twee verschillende bronnen (bijvoorbeeld TURKSTAT en Wereldbank) en vergelijk de cijfers; Als er een verschil is, diagnosticeer dan de oorzaak met behulp van sjabloon 4 en noteer uw bevindingen in drie zinnen.
controlelijst
- [ ] Ik heb de primaire bron gekozen die geschikt was voor mijn doel (ik maakte onderscheid tussen de officiële / internationale vergelijking van Türkiye).
- [ ] Ik heb de eenheid, het basisjaar, de beschrijving en de updatedatum van de serie geverifieerd vanaf de officiële pagina.
- [ ] Ik heb de gegevens gebruikt die ik uit de echte bron heb gehaald, niet de "voorbeeldcijfers" van kunstmatige intelligentie.
- [ ] Ik heb op zijn minst een paar observaties woordelijk vergeleken met de officiële publicatie.
- [ ] Ik controleerde de revisie-/versiestatus en noteerde de versie die ik gebruikte.
- [ ] Ik heb de twee bronconflicten uitgelegd door de metadata op één lijn te brengen.
- [ ] Van elk figuur dat ik gebruikte heb ik de bron traceerbaar gemaakt met een voetnoot.