Κέρδη:
- Δυνατότητα σύγκρισης βασικών πηγών οικονομικών δεδομένων (TURKSTAT, CBRT EVDS, IMF WEO, World Bank, Eurostat, FRED) σύμφωνα με το σκοπό, το πεδίο εφαρμογής, τη συχνότητα ενημέρωσης και την αξιοπιστία και να επιλέξετε τη σωστή πηγή
- Δυνατότητα χρήσης τεχνητής νοημοσύνης για εύρεση πηγών δεδομένων, αντιστοίχιση σειριακού κώδικα/περιγραφής και δημιουργία κώδικα λήψης και επιβεβαίωση κάθε αποτελέσματος με την επίσημη πηγή
- Δυνατότητα να δείτε πώς οι διαφορές έκδοσης (αναθεώρησης), έτος βάσης, μονάδας και ορισμού διαταράσσουν την ανάλυση και αποκτούν τη συνήθεια επαλήθευσης μεταδεδομένων
Κάθε οικονομική ανάλυση ξεκινά με δεδομένα και η ποιότητα της ανάλυσης δεν μπορεί ποτέ να υπερβεί την ποιότητα των δεδομένων. Η αρχή του "σκουπίδια μέσα, σκουπίδια έξω" λειτουργεί αναπόφευκτα στα οικονομικά: ακόμη και το πιο κομψό μοντέλο, που βασίζεται σε λάθος βάση, λάθος ορισμό ή λάθος περίοδο, είναι λάθος. Σε αυτήν την ενότητα, θα χρησιμοποιήσουμε τεχνητή νοημοσύνη για να βρούμε τα σωστά δεδομένα, να αντιστοιχίσουμε σειριακούς κωδικούς και να γράψουμε τον κωδικό λήψης. Αλλά ένας χρυσός κανόνας δεν θα αλλάξει: Ο αριθμός προέρχεται από την επίσημη πρωτογενή πηγή, όχι από την τεχνητή νοημοσύνη. Το AI μπορεί να σας δείξει τον δρόμο προς την πηγή. λαμβάνετε τα ίδια τα δεδομένα από αυτήν την πηγή.
Ας γνωρίσουμε τις κύριες πηγές
Η πυξίδα ενός οικονομολόγου περιλαμβάνει τους ακόλουθους πόρους. Ο σκοπός, το πεδίο εφαρμογής και ο ρυθμός ενημέρωσης του καθενός είναι διαφορετικός.
TURKSTAT (Τουρκικό Στατιστικό Ινστιτούτο). Η επίσημη στατιστική αρχή της Τουρκίας. Πληθωρισμός (CPI/PPI), ΑΕΠ, εργατικό δυναμικό, εξωτερικό εμπόριο, βιομηχανική παραγωγή, πληθυσμός. Αυτή είναι η κύρια πηγή για τα στοιχεία που αφορούν συγκεκριμένα την Τουρκία.
CBRT EVDS (Ηλεκτρονικό Σύστημα Διανομής Δεδομένων). Πύλη δεδομένων της Κεντρικής Τράπεζας. Συναλλαγματική ισοτιμία, τόκοι, προσφορά χρήματος, ισοζύγιο πληρωμών, τρέχον ισοζύγιο, αποθεματικά, έρευνες προσδοκιών. Πρώτος σταθμός για οικονομικά και νομισματικά δεδομένα.
ΔΝΤ (Διεθνές Νομισματικό Ταμείο). Ειδικά η βάση δεδομένων WEO (World Economic Outlook): συγκριτικό ΑΕΠ μεταξύ χωρών, πληθωρισμός, χρέος, ισοζύγιο τρεχουσών συναλλαγών και προβλέψεις. Ιδανικό για διεθνή σύγκριση. Αλλά οι προβολές είναι προβλέψεις, όχι πραγματοποιήσεις.
Παγκόσμια Τράπεζα (World Bank — WDI). Δείκτες παγκόσμιας ανάπτυξης: ανάπτυξη, φτώχεια, εκπαίδευση, υγεία, δείκτες υποδομής. μεγάλες ιστορικές σειρές και συγκρίσεις χωρών.
Eurostat. Στατιστική Υπηρεσία της Ευρωπαϊκής Ένωσης; Εναρμονισμένα (συγκρίσιμα) δεδομένα για τις χώρες της Ε.Ε. Σειρές όπως ο ΕνΔΤΚ (εναρμονισμένος πληθωρισμός) χρησιμοποιούνται στη συγκριτική αξιολόγηση της ΕΕ.
FRED (Federal Reserve Economic Data). Τεράστια σειρά του St. Louis Fed. Προσφέρει γρήγορη και προγραμματιζόμενη πρόσβαση (API) για μακροοικονομικά δεδομένα των ΗΠΑ και του κόσμου.
ΟΟΣΑ. Συγκριτικοί δείκτες, κορυφαίοι δείκτες, σειρές παραγωγικότητας και ευημερίας για τις ανεπτυγμένες οικονομίες.
Συμβουλή: Η απάντηση στην ερώτηση «σωστή πηγή» εξαρτάται από τον σκοπό. TURKSTAT για τον επίσημο πληθωρισμό της Τουρκίας. ΔΝΤ/Παγκόσμια Τράπεζα να συγκρίνουν την Τουρκία με 30 χώρες. FRED για το συμφέρον των ΗΠΑ. Η λήψη του ίδιου δείκτη από λάθος πηγή είναι ένα σιωπηλό λάθος.
Πηγές σιωπηλών σφαλμάτων: αναθεώρηση, έτος βάσης, μονάδα, περιγραφή
Τα πιο επικίνδυνα σφάλματα στα οικονομικά δεδομένα είναι αθόρυβα. Γνωρίστε τέσσερα:
- Αναθεώρηση (έκδοση). Πολλοί δείκτες (ΑΕΠ, ισοζύγιο πληρωμών) αναθεωρούνται μήνες μετά την πρώτη τους ανακοίνωση. Ο «προσωρινός» αριθμός σήμερα, ο «τελικός» αριθμός μετά από τρεις μήνες θα είναι διαφορετικός. Μάθετε ποια vintage (έκδοση) χρησιμοποιείτε.
- Έτος βάσης. Οι δείκτες καθορίζονται με βάση ένα έτος βάσης (=100). Είναι λάθος να συγκρίνουμε απευθείας δύο σειρές με διαφορετικά έτη βάσης.
- Μονάδα. Εκατομμύριο ή δισεκατομμύρια, TL ή δολάρια, τρέχουσα ή σταθερή τιμή; Η σύγχυση μονάδων είναι το πιο συνηθισμένο σφάλμα ανάλυσης.
- Ορισμός/πεδίο. Ποιος είναι ο ορισμός της «ανεργίας»; Ποια στοιχεία αποκλείει ο «πυρηνικός πληθωρισμός»; Δύο σειρές με το ίδιο όνομα μπορεί να μετρούν διαφορετικά πράγματα.
Προσοχή: Εάν ο αριθμός για τον ίδιο δείκτη από δύο πηγές δεν ταιριάζει, η πρώτη σας υπόθεση δεν πρέπει να είναι "κάποιος λέει ψέματα" αλλά "υπάρχει διαφορά στον ορισμό/βάση/εύρος/αναθεώρηση". Ευθυγραμμίστε πρώτα τα μεταδεδομένα (παραπομπή δεδομένων).
Βήμα προς βήμα: Συλλογή δεδομένων με τεχνητή νοημοσύνη
- Διευκρινίστε την ανάγκη. Ποιος δείκτης, ποια χώρα/επαρχία, ποια περίοδος, ποια συχνότητα (μηνιαία/τριμηνιαία/ετήσια), ποιος ορισμός;
- Επιλέξτε πηγή. Εξηγήστε το σκοπό στο AI και προτείνετε την κατάλληλη κύρια πηγή και το πλήρες όνομα της σειράς.
- Επικύρωση μεταδεδομένων. Επιβεβαιώστε τη μονάδα, το έτος βάσης, την περιγραφή και την ημερομηνία ενημέρωσης της επιλεγμένης σειράς στην επίσημη σελίδα.
- Δημιουργήστε τον κωδικό λήψης. Για όσους διαθέτουν API, όπως το FRED/World Bank, γράψτε τον κώδικα Python στο AI. Καταργήστε τα βήματα λήψης για TURKSTAT/EVDS.
- Πρώτος έλεγχος. Αφού φτάσουν τα δεδομένα, ελέγξτε τον αριθμό των γραμμών/στηλών, τις τιμές που λείπουν, τις ακραίες τιμές και το εύρος ημερομηνιών.
- Επιβεβαίωση πηγής. Συγκρίνετε τουλάχιστον μερικές παρατηρήσεις με την επίσημη δημοσίευση. Ταιριάζει ακριβώς;
τρεις μίνι θήκες
Περίπτωση 1 — Παγίδα έτους βάσης. Ένας αναλυτής έλαβε έναν δείκτη βιομηχανικής παραγωγής από δύο ξεχωριστές μελέτες. το ένα βασίστηκε στο 2015=100 και το άλλο βασίστηκε στο 2021=100. «Συνδυάστε τα», είπε στην τεχνητή νοημοσύνη. Αν παρέλειπε τον έλεγχο μεταδεδομένων, θα έβαζε τους δείκτες δίπλα-δίπλα και θα έβλεπε ένα ψεύτικο άλμα. Έπιασε τη διαφορά βάσης στο βήμα ελέγχου, μετέτρεψε τα δύο σε κοινή βάση και μετά τα συνδύασε. Η ψεύτικη αναπήδηση έχει φύγει.
Περίπτωση 2 — Κατασκευασμένη έξοδος API. Ένας ερευνητής είπε στην τεχνητή νοημοσύνη: «Αντλήστε το κατά κεφαλήν ΑΕΠ της Τουρκίας από την Παγκόσμια Τράπεζα». Το AI επέστρεψε τόσο τον κωδικό όσο και έναν πίνακα αριθμών ως "εξόδου δείγματος". Ο ερευνητής δεν χρησιμοποίησε τον πίνακα. απλώς έτρεξε τον κώδικα και έλαβε τα δεδομένα από το πραγματικό API. Τότε συνειδητοποίησε ότι οι αριθμοί που έγραφε η τεχνητή νοημοσύνη ως «παραδείγματα» ήταν στην πραγματικότητα 10-15 τοις εκατό έκπτωση. Εργαλείο κωδικού, όχι αριθμός. Αυτή ήταν η σωστή συμπεριφορά.
Περίπτωση 3 — Διαφορά αναθεώρησης. Σε ένα σημείωμα που δημοσιεύτηκε πριν από έξι μήνες, ένα ίδρυμα έγραψε ότι η τριμηνιαία ανάπτυξη ήταν 4,0 τοις εκατό. Στα τρέχοντα στοιχεία της TÜİK, το ίδιο τρίμηνο αναθεωρήθηκε στο 3,5%. Στη νέα έκθεση, ο αναλυτής δήλωσε σε μια υποσημείωση ποια έκδοση χρησιμοποίησε και εξήγησε τη διαφορά μεταξύ των δύο στοιχείων με μια αναθεώρηση. Η διαφάνεια διατήρησε την αξιοπιστία.
Πίνακας επιλογής πηγής
Σκοπός
Κατάλληλη πρωτογενής πηγή
Προσοχή
Πληθωρισμός Τουρκίας (CPI/PPI)
ΤΟΥΡΚΣΤΑΤ
Έτος βάσης, διάκριση πυρήνα/επικεφαλίδας
Συναλλαγματική ισοτιμία, τόκοι, τρέχον υπόλοιπο, αποθεματικά
CBRT EVDS
Αναθεώρηση, ορισμός σειράς
Σύγκριση ΑΕΠ/πληθωρισμού μεταξύ χωρών
ΔΝΤ WEO
Προβολή ≠ πραγματοποίηση
Ανάπτυξη/μεγάλη ιστορική σειρά
Παγκόσμια Τράπεζα WDI
Κάλυψη, χρόνια που λείπουν
Εναρμονισμένοι δείκτες της ΕΕ
Eurostat
Ορισμός ΕνΔΤΚ
ΗΠΑ/παγκόσμια μακροχρηματοδότηση, API
FRED
Κατάσταση εποχικής προσαρμογής
Τέσσερα πρότυπα με δυνατότητα αντιγραφής
1) Αντιστοίχιση πηγής και σειράς:
Χρειάζομαι τον ακόλουθο δείκτη: [δείκτης, χώρα/επαρχία, περίοδος, συχνότητα, περιγραφή]. Προτείνετε την καταλληλότερη κύρια επίσημη πηγή και το πλήρες όνομα της σειράς για αυτό. Καταγράψτε τα σημεία που πρέπει να επαληθεύσω σχετικά με τη μονάδα, το έτος βάσης και την περιγραφή της σειράς. Μην δίνετε αριθμούς. Πες μου μόνο πού και πώς να το αγοράσω.
2) Κωδικός λήψης FRED/Παγκόσμιας Τράπεζας:
Γράψτε έναν κώδικα στην Python με το API [FRED/World Bank] που κατεβάζει την ακόλουθη σειρά: [κωδικός/όνομα σειράς], [εύρος ημερομηνιών]. Ο κώδικας παίρνει τα δεδομένα στο pandasDataFrame, εκτυπώνει τις πρώτες/τελευταίες 5 σειρές και τον αριθμό των τιμών που λείπουν. Μη μου δώσεις παράδειγμα/κατασκευασμένη φιγούρα. απλά δώστε τον κωδικό εργασίας.
3) Λίστα επικύρωσης μεταδεδομένων:
Θα χρησιμοποιήσω την ακόλουθη σειρά: [σειρά]. Δημιουργήστε μια λίστα ελέγχου με μεταδεδομένα που πρέπει να επαληθεύσετε πριν από τη χρήση: όγκος, έτος βάσης, κατάσταση εποχικής προσαρμογής, ορισμός/εύρος, ημερομηνία ενημέρωσης, κατάσταση αναθεώρησης. Για κάθε στοιχείο, γράψτε "τι και πού να επιβεβαιώσετε" σε μία πρόταση.
4) Δύο διαγνώσεις αναντιστοιχίας πόρων:
Πήρα τον ίδιο δείκτη από δύο πηγές και οι αριθμοί είναι διαφορετικοί: Πηγή Α: [τιμή, αποτύπωμα]. Πηγή Β: [τιμή, αποτύπωμα]. Καταγράψτε πιθανούς αθώους λόγους για αυτήν τη διαφορά (ορισμός, βάση, πεδίο εφαρμογής, εποχιακή προσαρμογή, αναθεώρηση, νόμισμα) και πείτε μου πώς να ελέγξω για το καθένα. Μην πείτε "ένας κάνει λάθος"? Πρώτα βοηθήστε με να εξηγήσω την ασυμφωνία.
Αδύναμη προτροπή / Ισχυρή προτροπή
Αδύναμη προτροπή:
Δώστε μου τα στοιχεία ανάπτυξης της Türkiye για τα τελευταία 10 χρόνια.
Το AI βγάζει μια εικόνα από τη μνήμη του, πιθανώς παλιά και μερικώς κατασκευασμένη. Δεν υπάρχει πηγή ή αποτύπωμα.
Ισχυρή προτροπή:
Θα χρησιμοποιήσω την ετήσια αύξηση του πραγματικού ΑΕΠ της Τουρκίας 2014-2023. Πείτε μου την κύρια πηγή για αυτό (TURKSTAT) και το πλήρες όνομα της σειράς. πείτε μου αν η σειρά είναι σταθερή τιμή και πού να ψάξω για να επαληθεύσω το έτος βάσης. Δώστε επίσης τα βήματα/κωδικούς για τη λήψη αυτών των δεδομένων. Μην παράγετε τους ίδιους τους αριθμούς.
Συνήθη λάθη
- Παρεξήγηση του πίνακα "εξόδου δείγματος" της τεχνητής νοημοσύνης με πραγματικά δεδομένα. Αυτοί οι αριθμοί μπορούν να κατασκευαστούν. απλά χρησιμοποιήστε τον κώδικα/οδηγία.
- Σύγκριση δύο σειρών χωρίς ευθυγράμμιση μεταδεδομένων. Η διαφορά στη βάση/μονάδα/ορισμό παράγει ψευδή αποτελέσματα.
- Παρεξήγηση μιας προβολής με την πραγματικότητα. Το ποσοστό του επόμενου έτους στο IMF WEO είναι μια εκτίμηση.
- Αγνοώντας την αναθεώρηση. Χωρίς να δηλώνετε ποια έκδοση χρησιμοποιείτε.
- Αναντιστοιχία συχνότητας. Συνδυασμός μηνιαίας σειράς με τριμηνιαία σειρά χωρίς διόρθωση.
- Χωρίς αναφορά της πηγής στις υποσημειώσεις. Ένας αριθμός που δεν είναι ανιχνεύσιμος είναι ένας αριθμός που δεν μπορεί να υποστηριχθεί.
Συνοπτικά
Η δύναμη της ανάλυσης είναι η δύναμη των δεδομένων. Χρησιμοποιήστε AI για να βρείτε τη σωστή πηγή, να ταιριάξετε τη σειρά και να γράψετε έναν κωδικό λήψης. αλλά πάντα να λαμβάνετε τον αριθμό από την κύρια επίσημη πηγή (TURKSTAT, EVDS, ΔΝΤ, Παγκόσμια Τράπεζα, Eurostat, FRED). Εξουδετερώστε τις σιωπηρές πηγές σφαλμάτων, όπως την αναθεώρηση, το έτος βάσης, τον τόμο και την περιγραφή, ευθυγραμμίζοντας τα μεταδεδομένα. Εάν δύο πηγές συγκρούονται, συγκρίνετε πρώτα την απόδοση.
Εργασία εφαρμογής
Επιλέξτε έναν δείκτη που χρησιμοποιείτε συχνά στην επιχείρησή σας. Ζητήστε από το AI να εξάγει τη λίστα ελέγχου πηγής και μεταδεδομένων με τα πρότυπα 1 και 3 παραπάνω. Στη συνέχεια, βρείτε τον ίδιο δείκτη από δύο διαφορετικές πηγές (π.χ. TURKSTAT και Παγκόσμια Τράπεζα) και συγκρίνετε τα στοιχεία. Εάν υπάρχει διαφορά, διαγνώστε την αιτία με το πρότυπο 4 και σημειώστε το εύρημα σας σε τρεις προτάσεις.
λίστα ελέγχου
- [ ] Επέλεξα την κύρια πηγή κατάλληλη για το σκοπό μου (έκανα τη διάκριση μεταξύ της επίσημης / διεθνούς σύγκρισης της Türkiye).
- [ ] Επιβεβαίωσα τη μονάδα, το έτος βάσης, την περιγραφή και την ημερομηνία ενημέρωσης της σειράς από την επίσημη σελίδα.
- [ ] Χρησιμοποίησα τα δεδομένα που πήρα από την πραγματική πηγή, όχι τα "δείγματα αριθμών" που δίνει η τεχνητή νοημοσύνη.
- [ ] Σύγκρισα τουλάχιστον μερικές παρατηρήσεις αυτολεξεί με την επίσημη δημοσίευση.
- [ ] Έλεγξα την κατάσταση αναθεώρησης/έκδοσης και σημείωσα την έκδοση που χρησιμοποιούσα.
- [ ] Εξήγησα τις δύο διενέξεις πηγών ευθυγραμμίζοντας τα μεταδεδομένα.
- [ ] Έκανα την πηγή κάθε σχήματος που χρησιμοποίησα ανιχνεύσιμη με μια υποσημείωση.