Unità 2 / 11

Raccolta dati economici e verifica delle fonti: TURKSTAT, EVDS, FMI, Banca Mondiale, FRED

Guadagni:

  • Capacità di confrontare le principali fonti di dati economici (TURKSTAT, CBRT EVDS, FMI WEO, Banca Mondiale, Eurostat, FRED) in base allo scopo, all'ambito, alla frequenza di aggiornamento e all'affidabilità e di scegliere la fonte giusta
  • Capacità di utilizzare l'intelligenza artificiale per trovare la fonte dei dati, abbinare codice seriale/descrizione e generare codice di download e confermare ogni risultato con la fonte ufficiale
  • Possibilità di vedere come le differenze tra versione (revisione), anno base, unità e definizione interrompono l'analisi e acquisiscono l'abitudine di verificare i metadati

Ogni analisi economica inizia con i dati e la qualità dell’analisi non può mai superare la qualità dei dati. Il principio “garbage in, garbage out” opera inesorabilmente in economia: anche il modello più elegante, basato sulla base sbagliata, sulla definizione sbagliata o sul periodo sbagliato, è sbagliato. In questa unità utilizzeremo l'intelligenza artificiale per trovare i dati giusti, abbinare i codici seriali e scrivere il codice di download; Ma una regola d’oro non cambierà: i dati provengono dalla fonte primaria ufficiale, non dall’intelligenza artificiale. L’intelligenza artificiale può mostrarti la strada verso la fonte; ottieni i dati stessi da quella fonte.

Conosciamo le principali fonti

La bussola di un economista include le seguenti risorse. Lo scopo, la portata e il ritmo di aggiornamento di ciascuno sono diversi.

TURKSTAT (Istituto turco di statistica). Autorità statistica ufficiale della Turchia. Inflazione (CPI/PPI), PIL, forza lavoro, commercio estero, produzione industriale, popolazione. Questa è la fonte primaria per i dati specifici della Turchia.

CBRT EVDS (Sistema di distribuzione elettronica dei dati). Portale dati della Banca Centrale. Tasso di cambio, interesse, offerta di moneta, bilancia dei pagamenti, saldo corrente, riserve, indagini sulle aspettative. La prima tappa per i dati finanziari e monetari.

FMI (Fondo monetario internazionale). In particolare il database WEO (World Economic Outlook): PIL comparativo tra paesi, inflazione, debito, saldo delle partite correnti e proiezioni. Ideale per il confronto internazionale; Ma le proiezioni sono previsioni, non realizzazioni.

Banca mondiale (Banca mondiale — WDI). Indicatori di sviluppo mondiale: indicatori di sviluppo, povertà, istruzione, salute, infrastrutture; lunghe serie storiche e confronti tra paesi.

Eurostat. Ufficio statistico dell'Unione Europea; Dati armonizzati (comparabili) per i paesi dell’UE. Serie come l'IPCA (inflazione armonizzata) vengono utilizzate nel benchmarking dell'UE.

FRED (Dati economici della Federal Reserve). la massiccia serie della Fed di St. Louis; Offre un accesso rapido e programmabile (API) ai dati macrofinanziari statunitensi e globali.

OCSE. Indicatori comparativi, indicatori anticipatori, serie di produttività e welfare per le economie sviluppate.

Suggerimento: la risposta alla domanda "fonte corretta" dipende dallo scopo. TURKSTAT per l'inflazione ufficiale della Turchia; FMI/Banca Mondiale confronteranno la Turchia con 30 paesi; FRED per gli interessi degli Stati Uniti. Prendere lo stesso indicatore dalla fonte sbagliata è un errore silenzioso.

Fonti di errori silenziosi: revisione, anno base, unità, descrizione

Gli errori più pericolosi nei dati economici sono silenziosi. Conoscine quattro:

  • Revisione (versione). Molti indicatori (PIL, bilancia dei pagamenti) vengono rivisti mesi dopo il loro primo annuncio. Il dato “provvisorio” oggi, il dato “definitivo” dopo tre mesi sarà diverso. Scopri quale annata (versione) stai utilizzando.
  • Anno base. Gli indici sono stabiliti sulla base di un anno base (=100). È sbagliato confrontare direttamente due serie con anni base diversi.
  • Unità. Milioni o miliardi, TL o dollari, prezzo corrente o fisso? La confusione delle unità è l'errore di analisi più comune.
  • Definizione/ambito. Qual è la definizione di "disoccupazione"? Quali voci sono escluse dall'"inflazione core"? Due serie con lo stesso nome possono misurare cose diverse.
Attenzione: se la cifra per lo stesso indicatore proveniente da due fonti non corrisponde, la prima ipotesi non dovrebbe essere "qualcuno sta mentendo" ma "c'è una differenza nella definizione/base/ambito/revisione". Allineare prima i metadati (citazione dei dati).

Passo dopo passo: raccolta dati basata sull'intelligenza artificiale

  1. Chiarire la necessità. Quale indicatore, quale Paese/provincia, quale periodo, quale frequenza (mensile/trimestrale/annuale), quale definizione?
  2. Seleziona la fonte. Spiegare lo scopo all'IA e suggerire la fonte primaria appropriata e il nome completo della serie.
  3. Convalidare i metadati. Conferma l'unità, l'anno base, la descrizione e la data di aggiornamento della serie selezionata sulla pagina ufficiale.
  4. Genera il codice di download. Per quelli con un'API, come FRED/Banca Mondiale, scrivere il codice Python per l'IA; Rimuovere i passaggi di download per TURKSTAT/EVDS.
  5. Primo controllo. Dopo l'arrivo dei dati, controlla il numero di righe/colonne, i valori mancanti, i valori anomali e l'intervallo di date.
  6. Conferma della fonte. Confrontare almeno alcune osservazioni con la pubblicazione ufficiale; Corrisponde esattamente?

tre mini custodie

Caso 1 – Trappola dell’anno base. Un analista ha ottenuto un indice della produzione industriale da due studi separati; uno era basato su 2015=100 e l'altro era basato su 2021=100. “Combina questi”, ha detto all’intelligenza artificiale. Se saltasse il controllo dei metadati, metterebbe gli indici uno accanto all'altro e vedrebbe un salto falso. Ha colto la differenza di base nella fase di controllo, ha trasformato le due basi in una base comune e poi le ha combinate. Il falso rimbalzo è sparito.

Caso 2: output API fabbricato. Un ricercatore ha detto all'intelligenza artificiale: "Prendete il PIL pro capite della Turchia dalla Banca Mondiale"; L'intelligenza artificiale ha restituito sia il codice che una tabella di numeri come "output di esempio". Il ricercatore non ha utilizzato la tabella; ho semplicemente eseguito il codice e recuperato i dati dall'API reale. Poi si è reso conto che i numeri scritti dall'intelligenza artificiale come "esempi" erano in realtà sbagliati del 10-15%. Strumento di codice, non numero; Questo era il comportamento corretto.

Caso 3 – Differenza di revisione. In una nota pubblicata sei mesi fa, un istituto scriveva che la crescita trimestrale è stata del 4,0%; Secondo gli attuali dati TÜİK, lo stesso trimestre è stato rivisto al 3,5%. Nel nuovo rapporto l'analista ha precisato in una nota quale versione ha utilizzato e ha spiegato la differenza tra i due dati con una revisione. La trasparenza ha preservato la credibilità.

Tabella di selezione della fonte

Scopo

Fonte primaria appropriata

Attenzione

Inflazione in Turchia (CPI/PPI)

TURKSTAT

Anno base, distinzione core/headline

Tasso di cambio, interesse, saldo corrente, riserve

EVDS CBRT

Revisione, definizione di serie

Confronto PIL/inflazione tra paesi

FMI WEO

Proiezione ≠ realizzazione

Sviluppo/serie storiche lunghe

WDI della Banca Mondiale

Copertura, anni mancanti

Indicatori armonizzati UE

Eurostat

Definizione IAPC

Macrofinanza statunitense/globale, API

FRED

Stato della destagionalizzazione

Quattro modelli copiabili

1) Corrispondenza di fonte e serie:

Ho bisogno del seguente indicatore: [indicatore, nazione/provincia, periodo, frequenza, descrizione]. Consiglia la fonte ufficiale primaria più appropriata e il nome completo della serie per questo. Elenca i punti che devo verificare sull'unità, sull'anno base e sulla descrizione della serie. Non fornire numeri; Dimmi solo dove e come acquistarlo.

2) Codice download FRED/Banca Mondiale:

Scrivi un codice in Python con l'API [FRED/World Bank] che scarichi le seguenti serie: [codice/nome serie], [intervallo di date]. Il codice prende i dati in pandasDataFrame, stampa le prime/ultime 5 righe e il numero di valori mancanti. Non darmi un esempio/figura inventata; basta dare il codice funzionante.

3) Elenco di convalida dei metadati:

Utilizzerò la seguente serie: [serie]. Crea un elenco di controllo dei metadati che devi verificare prima dell'uso: volume, anno base, stato della destagionalizzazione, definizione/ambito, data di aggiornamento, stato di revisione. Per ogni articolo, scrivi "cosa e dove confermare" in una frase.

4) Due diagnosi di mancata corrispondenza delle risorse:

Ho ottenuto lo stesso indicatore da due fonti e i numeri sono diversi: Fonte A: [valore, impronta]. Fonte B: [valore, impronta]. Elenca possibili ragioni innocue per questa differenza (definizione, base, ambito, destagionalizzazione, revisione, valuta) e dimmi come verificarle. Non dire "uno ha torto"; Per prima cosa aiutami a spiegare la discrepanza.

Prompt debole / Prompt forte

Suggerimento debole:

Datemi i dati sulla crescita della Turchia negli ultimi 10 anni.

L'IA estrae un'immagine dalla sua memoria, forse vecchia e parzialmente fabbricata; Non vi è alcuna fonte o impronta.

Suggerimento potente:

Utilizzerò la crescita annuale del PIL reale della Turchia nel periodo 2014-2023. Dimmi la fonte principale di questo (TURKSTAT) e il nome completo della serie; dimmi se la serie è a prezzo fisso e dove cercare per verificare l'anno base. Fornisci anche i passaggi/codici per scaricare questi dati. Non produrre i numeri da soli.

Errori comuni

  • Confondere la tabella "sample output" dell'intelligenza artificiale per dati reali. Quei numeri possono essere fabbricati; basta usare il codice/linea guida.
  • Confronto di due serie senza allineare i metadati. La differenza in base/unità/definizione produce risultati spuri.
  • Confondere una proiezione per la realtà. La cifra del prossimo anno nel FMI WEO è una stima.
  • Ignorando la revisione. Non dico quale versione stai utilizzando.
  • Discrepanza di frequenza. Combinazione di una serie mensile con una serie trimestrale senza correzione.
  • Non citare la fonte nelle note. Una cifra non rintracciabile è una cifra insostenibile.

In sintesi

Il potere dell’analisi è il potere dei dati. Usa l'intelligenza artificiale per trovare la fonte giusta, abbinare la serie e scrivere un codice di download; ma ottieni sempre la cifra dalla fonte ufficiale primaria (TURKSTAT, EVDS, FMI, Banca Mondiale, Eurostat, FRED). Neutralizza le fonti di errore silenziose come revisione, anno base, volume e descrizione allineando i metadati. Se due fonti sono in conflitto, confronta prima l'attribuzione.

Compito dell'applicazione

Scegli un indicatore che utilizzi frequentemente nella tua attività. Chiedi all'IA di estrarre la lista di controllo della fonte e dei metadati con i modelli 1 e 3 sopra. Quindi trova lo stesso indicatore da due fonti diverse (ad esempio TURKSTAT e Banca Mondiale) e confronta le cifre; Se c'è una differenza, diagnostica la causa con il modello 4 e annota il risultato in tre frasi.

lista di controllo

  • [ ] Ho scelto la fonte primaria adatta al mio scopo (ho fatto la distinzione tra confronto ufficiale/internazionale di Türkiye).
  • [ ] Ho verificato l'unità, l'anno base, la descrizione e la data di aggiornamento della serie dalla pagina ufficiale.
  • [] Ho utilizzato i dati presi dalla fonte reale, non i "dati campione" forniti dall'intelligenza artificiale.
  • [ ] Ho confrontato testualmente almeno alcune osservazioni con la pubblicazione ufficiale.
  • [ ] Ho controllato lo stato della revisione/versione e ho annotato la versione che stavo utilizzando.
  • [ ] Ho spiegato i due conflitti di origine allineando i metadati.
  • [ ] Ho reso rintracciabile la fonte di ogni figura da me utilizzata con una nota a piè di pagina.