Zyski:
- Umiejętność rozpoznawania struktury, jednostek i typowych problemów jakościowych SCADA, inteligentnych liczników i danych rynkowych
- Możliwość wykrywania brakujących danych, wartości odstających i problemów ze znacznikami czasu za pomocą sztucznej inteligencji oraz ustalania przepływu pracy czyszczenia
- Możliwość weryfikacji pułapek, takich jak rozdzielczość, strefa czasowa i czas letni, w szeregach czasowych energii na wyjściu AI
Prawie każda analiza energii rozpoczyna się od szeregu czasowego: pomiarów ułożonych wzdłuż osi czasu. 15-minutowe zużycie licznika, druga prędkość obrotowa turbiny, godzinowy prąd podajnika (lini dystrybucyjnej) – wszystko to są szeregi czasowe. W tym module dowiemy się, skąd pochodzą dane dotyczące energii, jakie pułapki kryją się w nich i jak wykorzystać sztuczną inteligencję, aby dane te były wiarygodne. Ustalmy tę zasadę od początku: nawet najmądrzejsza analiza z brudnymi danymi daje brudny wynik. W inżynierii energetycznej większość czasu poświęca się nie na model, ale na uwiarygodnienie danych, a sztuczna inteligencja zapewnia w tej części najbezpieczniejszy wkład.
Źródła i struktura danych energetycznych
Dane dotyczące energii pochodzą przede wszystkim z kilku źródeł. SCADA (system nadzoru i akwizycji danych) zbiera chwilowe pomiary z urządzeń rozdzielczych i sieciowych; Zwykle jest to rozdzielczość wyrażona w sekundach lub minutach i obejmuje takie wielkości, jak napięcie, prąd, moc i temperatura. Dane z inteligentnych liczników zazwyczaj mierzą zużycie w odstępach 15-minutowych i stanowią podstawę do rozliczeń i analizy zapotrzebowania. Dane meteorologiczne (temperatura, natężenie promieniowania, prędkość wiatru) są danymi wejściowymi do prognozowania produkcji i popytu. Dane rynkowe (ceny godzinowe) stanowią wkład do analizy ekonomicznej.
Wspólną cechą tych danych jest to, że zawierają znacznik czasu (znacznik daty i godziny, do którego należy każdy pomiar) oraz jedną lub więcej wartości pomiaru. To jest najbardziej krytyczny punkt: jeśli znacznik czasu nie zostanie poprawnie zrozumiany, wszystko inne upadnie.
Rozdzielczość, strefa czasowa i pułapki czasu letniego
Zaskakująco duża część błędów w danych dotyczących energii pochodzi z osi czasu. Zwróćmy szczególną uwagę na trzy pułapki.
Zamieszanie w rozdzielczości. Czy licznik podaje energię 15-minutową (kWh) czy moc chwilową (kW)? Dodanie ich daje różne wyniki: średnia z czterech wartości kW z 15 minut to moc, podczas gdy suma czterech nie odpowiada energii godzinowej (wymagana jest suma energii kwadransowych). Nie można dokonać podsumowania bez jednoczesnego zrozumienia jednostki i rozdzielczości.
Strefa czasowa. Czy dane są przechowywane w czasie lokalnym (TRT/UTC+3 dla Turcji) czy czasie uniwersalnym (UTC)? Dwie serie pochodzące z różnych systemów mogą znajdować się w różnych strefach czasowych; Trzygodzinna zmiana przy łączeniu zakłóca całą analizę godzin szczytowych.
Czas letni (DST). W krajach, które przechodzą na czas letni, godzina „znika” raz w roku i „powtarza się” raz w roku. Tworzy to 23 lub 25-godzinne dni w te dni i przerywa profile godzinowe. Ponieważ Türkiye wprowadziło stały czas letni (UTC+3) od 2016 r., problem ten nie pojawia się w przypadku danych lokalnych, ale nadal można go spotkać podczas pracy z międzynarodowymi lub starymi danymi.
Uwaga: Czy etykieta znacznika czasu to „początek zakresu” czy „koniec zakresu”? Czy zapis oznaczony jako 14:00 wskazuje 14:00-14:15 lub 13:45-14:00? Ta pojedyncza decyzja może przesunąć zegar szczytowy o jedną część. Wyjaśnij tę zasadę na początku dla każdego zestawu danych.
Krok po kroku: proces przygotowania danych przy użyciu sztucznej inteligencji
Krok 1 — Odkrycie. Znaj dane: ile wierszy, jaki zakres, jaka rozdzielczość, jaka jednostka? Podanie AI pierwszych kilkuset wierszy i podsumowanie struktury szybko ujawnia znaczenie kolumn i możliwe jednostki. Jednak szacunkowa jednostka AI jest hipotezą; Potwierdza to dokument źródłowy.
Krok 2 — Standaryzacja osi czasu. Przyciągnij do pojedynczej strefy czasowej, napraw rozdzielczość, określ regułę tagu (początek/koniec). Sztuczna inteligencja może generować kod, który wykrywa nieregularne interwały i brakujące znaczniki czasu.
Krok 3 — Niekompletne i zduplikowane zapisy. Awarie w komunikacji powodują znowu pustkę i podwójne nagrywanie. Sztuczna inteligencja tworzy zestaw reguł sygnalizujących luki i powielania; krótkie przerwy (np. pojedyncze 15 minut) można wypełnić odpowiednią metodą, długie przerwy wyklucza się z analizy i zgłasza.
Krok 4 — Wartości odstające. Ujemne zużycie (brak produkcji), moc przekraczająca fizyczny górny limit, nagłe skoki. Sztuczna inteligencja umożliwia wykrywanie wartości odstających w oparciu o statystyki i reguły; Jednak wartość odstająca nie zawsze jest błędem — może to być również rzeczywiste wydarzenie (na przykład uruchomienie fabryki w trybie online). Inżynier dokonuje tego rozróżnienia.
Krok 5 — Weryfikacja. Oczyszczone dane są testowane za pomocą fizycznych kotwic: wschód/zachód słońca musi zresetować generację energii słonecznej, obciążenie nocne musi być niższe niż dzienne, całkowita energia musi być zgodna z rachunkiem.
Trzy mini etui: w liczbach
Przypadek 1 — Jedna godzina przerwy. Dane jednego z analityków dotyczące produkcji energii słonecznej wykazały, że szczyt w południe przypada na godzinę 14:00, a nie 13:00. Problem nie dotyczył panelu; Dane podano w formacie UTC, ale uznano, że jest to czas lokalny. Kiedy zauważono trzygodzinną zmianę (pojawienie się produkcji przed wschodem słońca zdradziło kotwicę), cała analiza uległa poprawie; Decyzje inwestycyjne uniemożliwiono w oparciu o błędną interpretację.
Przypadek 2 – Zduplikowane nagrania. W 30-dniowych danych godzinowych jednego ze dostawców dystrybucyjnych całkowite zużycie było o około 4 procent wyższe niż oczekiwano. Wykrywanie powtórek wspomagane sztuczną inteligencją wykazało, że niektóre godziny zostały zarejestrowane dwukrotnie podczas ponownego połączenia komunikacyjnego. Po wyczyszczeniu 68 powtarzających się rekordów suma pokrywała się z rachunkiem.
Przypadek 3 – Fałszywe zera. Jeden licznik zgłaszał zużycie jako „0” podczas utraty komunikacji; Jednak konsumpcja trwała nadal. Te fałszywe zera obniżyły średnią i wprowadziły w błąd prognozę popytu. AI zasugerowało regułę „Sprawdź wartości 0 wraz z flagą obecności”; fałszywe zera oznaczono jako brakujące dane i oddzielono od zer prawdziwych (np. zamknięte miejsce pracy).
Słaba podpowiedź/silna podpowiedź
Słaba zachęta:
Wyczyść dane licznika.[dane]
Potężny monit:
Twoja rola: Analityk danych energetycznych. Poniższe dane licznika dotyczą przedziałów 15-minutowych, czasu lokalnego (UTC+3), znacznik czasu wskazuje ROZPOCZĘCIE przedziału, jednostka kWh. Zadania: 1) Wypisz brakujące znaczniki czasu i zduplikowane zapisy (liczba i czas). 2) Oddzielnie zaznacz wartość ujemną i wartości przekraczające fizyczną górną granicę (moc umowna 25 kW); nie usuwaj, tylko zaznacz.3) Zaproponuj sprawdzenie w celu odróżnienia zer fałszywych od zer rzeczywistych, w przypadku których istnieje podejrzenie błędnej komunikacji. Nie wpisuj samodzielnie żadnych wartości; Najpierw go zidentyfikuj, a ja potwierdzę napełnienie.
Potężny monit od początku podaje rozdzielczość, strefę czasową, regułę znacznika i górny limit; Nakłada na sztuczną inteligencję dyscyplinę „najpierw wykryj, zapytaj później”. W ten sposób dane nie zostaną po cichu uszkodzone.
Cztery szablony do kopiowania
1) Profilowanie danych:
Utwórz profil następujących danych: liczba wierszy, zakres dat, rozdzielczość, szacunkowa jednostka i znaczenie każdej kolumny, brakujący współczynnik, min./maks./średnia. Oznacz szacunki jednostek tagiem „wymaga weryfikacji”.
2) Sterowanie osią czasu:
W tych szeregach czasowych należy wykryć: (a) luki poza oczekiwanym zakresem, (b) powtarzające się znaczniki czasu, (c) możliwe przesunięcia ze względu na czas/strefę czasową letnią. Wymień każde znalezisko wraz z zakresem czasowym. Osobno napisz sugestię korekty; APLIKACJA.
3) Reguła wartości odstających:
Oznacz wartości odstające, korzystając z następujących limitów fizycznych: moc 0-[X] kW, temperatura [A]-[B] °C. Sporządź także osobną listę statystycznych wartości odstających (np. zbytnio odbiegających od mediany). W przypadku każdej wartości odstającej zadaj pytanie „możliwy błąd lub zdarzenie faktyczne”; Pozwól mi zdecydować.
4) Weryfikacja po czyszczeniu:
Przetestuj oczyszczone dane za pomocą następujących fizycznych kotwic i zgłoś niespójności: produkcja energii słonecznej w nocy powinna wynosić zero; całkowita energia musi mieścić się w oczekiwanym poziomie rachunku; Obciążenie nocne musi być niższe niż szczyt dzienny. Zapisz wynik pozytywny/nieudany dla każdej kotwicy.
Tabela problemów z jakością danych
problemu
objaw
kotwica weryfikacyjna
Zmiana strefy czasowej
Górny zegar jest w nielogicznym miejscu
Dopasuj do wschodu/zachodu słońca
Czas letni (DST)
23/25 godzin dziennie
Oblicz długość dnia
fałszywe zero
0 w przypadku utraty komunikacji
Dopasuj do flagi komunikacyjnej
zarejestruj się ponownie
Powyżej całkowitego rachunku
Sprawdź niepowtarzalność znacznika czasu
Jednostkowe zamieszanie
Ranga 60/1000 razy wypaczona
Sprawdź konwersję kW↔kWh
wartość ujemna
Ujemna konsumpcja w przypadku braku produkcji
Zasada znaku fizycznego
Typowe błędy
- Ciche uzupełnianie brakujących danych zerem. Zero oznacza „brak zużycia”, a nie „brak danych”; mieszanie tych dwóch zniekształca średnią i prognozę.
- Automatycznie usuwaj wartości odstające. Wartość odstająca może być prawdziwym wydarzeniem; Przed usunięciem wymagana jest recenzja inżyniera.
- Zakładając strefę czasową. Stwierdzenie „to prawdopodobnie lokalne” jest jednym z najkosztowniejszych błędów; Zawsze sprawdzaj u źródła.
- Zbieranie rozpuszczalności poprzez mieszanie. Dodanie wartości mocy (kW) jako energii (kWh) daje nieprawidłową sumę.
- Nie sprawdzam czystości. Wyczyszczone dane mogą być również uszkodzone; Pamiętaj, aby przetestować to za pomocą fizycznych kotwic.
Wskazówka: Zapisz każdy etap czyszczenia danych w „dzienniku danych”: ile rekordów zostało zaznaczonych, ile zostało wypełnionych, jaka zasada została zastosowana. Ten dziennik zapewnia zarówno odtwarzalność, jak i możliwość kontroli; rok później „skąd wzięła się ta liczba?” odpowiada na pytanie.
Podsumowując
Podstawą analizy energetycznej są czyste szeregi czasowe. Dane pochodzą z SCADA, licznika, meteorologii i rynku; każdy ma rozdzielczość, jednostkę, strefę czasową i pułapki czasu letniego. Sztuczna inteligencja bardzo skutecznie przyspiesza wykrywanie brakujących, duplikatów i wartości odstających, ale decyzje dotyczące usuwania i uzupełniania powinny pozostać w gestii inżyniera, a wynik powinien być weryfikowany za pomocą fizycznych kotwic. Żadna analiza nie jest wiarygodna bez odpowiedniego zrozumienia znacznika czasu.
Zadanie aplikacji
Weź do ręki szereg czasowy energii (licznik, produkcja lub temperatura). Poproś AI o raport jakości, korzystając z szablonów „Audyt osi czasu” i „Profilowanie danych”. Następnie ręcznie sprawdź trzy rzeczy: czy jednostka i rozdzielczość są prawidłowe, czy zegar szczytowy jest fizycznie rozsądny, czy całkowita energia jest zgodna z rachunkiem? Krótko opisz znaleziony problem z jakością danych i sposób jego rozwiązania.
lista kontrolna
- [ ] Potwierdziłem źródło, rozdzielczość i jednostkę danych
- [ ] Wyjaśniłem zasadę etykiety strefy czasowej i znacznika czasu (początek/koniec)
- [ ] Sprawdziłem ryzyko 23/25-godzinnego dnia pracy ze względu na czas letni
- [ ] Wykryłem brakujące i zduplikowane rekordy i zgłosiłem je
- [ ] Zbadałem wartości odstające z rozróżnieniem „błąd lub zdarzenie”
- [ ] Odróżniłem zera fałszywe od zer rzeczywistych
- [ ] Sprawdziłem oczyszczone dane za pomocą fizycznych kotwic i prowadziłem dziennik danych