Jednostka 2 / 11

Przetwarzanie danych dotyczących wydatków i faktur

Zyski:

  • Możliwość konwersji dowolnego tekstu i danych fakturowych do tabeli zorganizowanej według ustalonego schematu
  • Możliwość skonfigurowania powtarzalnych monitów o kategoryzację wydatków, obliczenie zwrotu podatku VAT i wykrywanie anomalii
  • Możliwość weryfikacji wyodrębnionych pól finansowych za pomocą kontroli równości podatku VAT i całkowitej spójności

Jednym z zadań, nad którym zespoły księgowe spędzają najwięcej czasu, jest porządkowanie rozproszonych danych dotyczących wydatków i faktur w uporządkowane tabele. Faktura dołączona do e-maila, zdjęcie rachunku wysłanego z WhatsApp, notatka o wydatkach w formie dowolnego tekstu, np. „Posiłek na spotkaniu w Ankarze + taksówka 840 TL”... Wszystko powinno znaleźć się w tym samym miejscu: w wierszu zawierającym kategorie, kwotę, podatek VAT (podatek od wartości dodanej), datę i dostawcę.

Sztuczna inteligencja (AI) ma ogromne możliwości w transformacji „dowolnego tekstu w strukturę”. Ale jeśli chodzi o dane finansowe, niedopuszczalne jest, aby nawet grosz poszedł źle. Zatem w tej części nauczymy się razem dwóch rzeczy: zmuszania sztucznej inteligencji do tworzenia danych według ustalonego schematu (z góry określonej listy pól) oraz sprawdzania poprawności wyników za pomocą kontroli spójności zbiorczej.

Dlaczego „Schemat” jest tak ważny?

Schemat polega na tym, że z góry określasz, które pola będą w każdym wierszu, w jakiej kolejności i w jakim formacie. Jeśli nie podasz schematu, model wygeneruje inny format dla każdej faktury; Wtedy połączenie ich w jedną tabelę byłoby trudne bez ręcznej korekty. Jeśli podasz schemat, dane wyjściowe będą spójne i możliwe do sprawdzenia.

Dobry wykres wydatków zawiera następujące pola: data, dostawca, opis, kategoria, kwota wolna od VAT (podstawa), stawka VAT, kwota VAT, suma z VAT, nr dokumentu.

Wskazówka: Zawsze definiuj pola numeryczne w konwencji „kropka/przecinek”. Powiedzenie „Wpisz kwoty w formacie 1234,56, bez separatora tysięcy” pozwoli uniknąć godzin koszmarnego formatowania podczas późniejszego eksportu do Excela.

Krok po kroku: od dowolnego tekstu do tabeli

  1. Napraw schemat. Wpisz nazwy pól, ich kolejność i format.
  2. Podaj listę kategorii. Poproś modelkę, aby wybrała coś z Twojej listy, a nie tworzyła w głowie kategorie.
  3. Stwórz regułę nieoznaczoności. Pozwól mu opuścić obszar, którego nie jest pewien, pusty i postaw znak „check”.
  4. Sprawdź logikę podatku VAT. Niech model sprawdzi podstawę równania + VAT = suma.
  5. Sprawdź krzyżowo sumę. Czy suma wszystkich linii jest zgodna z sumą kontrolną?

Słaba podpowiedź/silna podpowiedź

Słaba zachęta: wprowadź w tabelę następujące wydatki: - Taksówka spożywcza w Ankarze 840 - artykuły papiernicze 300 z VAT - hotel 2 noce 3600

Daje to wynik z niespójną kategorią, pomieszanym podatkiem VAT i innym formatem w każdej linii.

Potężny monit:Przelicz następujące opłaty za tekst dowolny na tabelę DOKŁADNIE zgodnie z tym schematem:Pola (w tej kolejności): data | dostawca | opis | kategoria |baza | stawka_vat | kwota_vat | łącznie | uwagaZasady:- Kategoria tylko z poniższej listy: [Podróże, Zakwaterowanie, Jedzenie, Artykuły papiernicze, Transport, Inne]- Wpisz kwoty w formacie 1234,56 (bez separatora tysięcy).- Jeśli podano "z VAT", oblicz podstawę i zwrot VAT; Jeżeli nie znasz stawki VAT, w polu notatki wpisz „potwierdzenie stawki” i pozostaw puste. - Podaj równość podstawy opodatkowania + kwota_podatku = suma w każdym wierszu; Jeżeli tego nie przewiduje, w polu uwagi należy wpisać „NIE SPEŁNIA”. - Pozostaw pole, którego nie jesteś pewien, dodaj „sprawdź” do notatki.

Ten monit oblicza podstawę dla artykułów papierniczych, w tym podatek VAT na 250 i VAT na 50, oznacza pozycje z niejednoznacznymi stawkami i generuje czysty wynik, który można połączyć w jedną tabelę.

Logika obliczania zwrotu podatku VAT

Ustalenie podstawy opodatkowania na podstawie kwoty zawierającej podatek VAT jest często wymaganą procedurą w rachunkowości. Wzór: podstawa = suma / (1 + stawka). Przykładowo dla 300 TL z 20% VAT podstawa = 300/1,20 = 250, VAT = 50. Jeśli wyraźnie podasz ten wzór modelowi, margines błędu maleje.

transakcja

formuła

Próbka (20%)

Bez podatku VAT → wliczony w cenę

suma = podstawa × (1 + stawka)

250 × 1,20 = 300

Zawiera podatek VAT → podstawa

podstawa = suma / (1 + stawka)

300 / 1,20 = 250

Kwota podatku VAT

vat = suma - podstawa

300 - 250 = 50

kontrola

podstawa + kadź = suma

250 + 50 = 300

Praca ze zdjęciem faktury i wydrukiem OCR

Wydatki z terenu często przychodzą w postaci zdjęcia paragonu lub faktury w formacie PDF. Technologia wyodrębniania tekstu z tych obrazów nazywa się OCR (optyczne rozpoznawanie znaków). Wizualne narzędzia AI mogą wykonać to zadanie, ale wynik OCR jest zawsze wadliwy: przecinek można odczytać jako kropkę, „5” można pomylić z „S”, a cyfra kwoty może zostać utracona. Dlatego nigdy nie uwzględniaj kwot z OCR bezpośrednio w księgowości.

Wyodrębnij następujące pola z tego obrazu faktury i zapisz je DOKŁADNIE w następującym schemacie:data | dostawca | nr podatkowy | podstawa | stawka_vat | kwota_vat | totalRules:- Wpisz „UNREAD” w dowolnym polu, którego nie możesz odczytać lub którego nie jesteś pewien, nie zgaduj.- podstawa + kwota_vatu = sprawdź sumę; Jeśli nie, zaznacz „SPRAWDŹ”. - Podaj kwoty w formacie 1234.56.

Najważniejszą zasadą bezpieczeństwa jest nie zmuszanie nikogo do odgadnięcia niepewnego obszaru. Jeśli model uzupełni liczbę słowami „najprawdopodobniej tak”, rekord dyskretnie wprowadzi błąd. Flaga „UNREAD” pozwala człowiekowi wrócić do oryginalnego dokumentu i go zatwierdzić.

Wskazówka: Na wydruku OCR najbardziej wiarygodnym polem do odczytania jest zazwyczaj kwota łączna, ponieważ jest ona napisana dużą czcionką. Jeśli równanie podstawa podatku + VAT = suma nie jest spełniona, można sprawdzić, w którym obszarze występuje błąd, wracając do tego równania.

Wykrywanie anomalii i duplikatów rekordów

AI nie tylko tłumaczy; Znajduje także podejrzane przedmioty. Na przykład prawie taka sama kwota od tego samego dostawcy dwa razy tego samego dnia lub niezwykle duży wydatek w tej kategorii.

W poniższej tabeli wydatków zaznacz następujące nieprawidłowości i wpisz przyczynę: 1) Możliwe zdublowanie rekordu (ten sam dostawca + podobna kwota + ostatnia data) 2) Kwoty większe niż 3-krotność średniej dla kategorii 3) Stawka VAT inna niż oczekiwana dla kategorii Wystarczy zaznaczyć i wpisać przyczynę; nie usuwaj ani nie zmieniaj żadnych wierszy.

Przestroga: ostrzeżenie sztucznej inteligencji „to może się powtarzać” jest wskazówką, a nie decyzją. Te dwa rekordy mogą w rzeczywistości oznaczać dwie różne usługi. Decyzję o usunięciu lub połączeniu zawsze podejmują ludzie; Model po prostu przykuwa uwagę.

Mini etui

Przypadek 1 — Stos 300 żetonów. Ekspert ds. księgowości przekształcił 300-wierszową listę wydatków na koniec miesiąca w formie tabeli w ciągu około 15 minut, korzystając z podpowiedzi w postaci diagramu. Zadanie, które w przypadku ręcznego wykonania zajmowało 4 godziny, po weryfikacji zostało skrócone do 40 minut. Zysk to nie tylko prędkość; wzrosła także spójność kategorii.

Przypadek 2 — Złapano podwójną płatność. Komunikat dotyczący nieprawidłowości oznaczał, że faktura na kwotę 4720 TL wystawiona na dostawcę została wprowadzona dwukrotnie z dwoma różnymi numerami dokumentów. Badanie wykazało, że jedna z nich była wersją roboczą, a druga sfinalizowaną fakturą i obie były wymagalne. Bez sztucznej inteligencji płatność byłaby podwójna.

Przypadek 3 – Pułapka stawkowa VAT. Model przypisał 20% VAT na zakup podstawowego artykułu spożywczego; natomiast pozycja ta znajdowała się w grupie o niższej stawce. Dzięki zasadzie „potwierdzenia stawki” linia została oznaczona, zweryfikowana i poprawiona przez źródło eksperckie. Lekcja: Nie zostawiaj stawki VAT modelowi, potwierdź ją z listy lub dokumentu.

Typowe błędy

  • Tłumaczenie danych bez podawania schematu. Każda linia jest w innym formacie, łączenie wymaga ręcznej korekty.
  • Brak listy kategorii. Model pasuje do własnych kategorii; raportowanie staje się niespójne.
  • Brak sprawdzenia równości podatku VAT. podstawa podatku + VAT = wiersze, które nie sumują się do kwoty, są dyskretnie wprowadzane do tabeli.
  • Mylenie ostrzeżenia o anomalii z decyzją. „Można powtórzyć” to początek; Decyzję o usunięciu podejmuje człowiek.
  • Pomijanie sumy kontrolnej. Opieranie się na wynikach bez porównywania sumy wierszy ze znaną kwotą kontrolną.

Podsumowując

  • Podczas przetwarzania danych tekstowych dotyczących wydatków/faktur za pomocą sztucznej inteligencji najbardziej niezawodnym sposobem jest zażądanie danych wyjściowych zgodnie ze stałym schematem.
  • Zapewnienie listy kategorii i wyjaśnienie zasad formatowania (kropka/przecinek, separator tysięcy) zapewnia spójność wyników i możliwość ich przenoszenia.
  • Podaj jawnie wzór na obliczenie zwrotu podatku VAT do modelu i sprawdź równość podstawy podatku + VAT = suma w każdej linii.
  • Sztuczna inteligencja jest skuteczna w oznaczaniu zduplikowanych i nietypowych rekordów, ale decyzję o usunięciu/scaleniu zawsze podejmuje człowiek.
  • Sprawdzanie sumy wierszy ze znaną sumą kontrolną zabezpiecza całe zadanie.

Zadanie aplikacji

Przygotuj mieszaną listę wydatków (rzeczywistą lub próbną) składającą się z co najmniej 10 wierszy; świadomie umieścił zduplikowany wpis i pozycję z niewłaściwą stawką podatku VAT. Przekonwertuj go na tabelę za pomocą zaawansowanego szablonu podpowiedzi, a następnie uruchom monit o anomalię. Sprawdź, czy model łapie dwie ustawione przez Ciebie pułapki i ręcznie zweryfikuj równość podatku VAT w trzech rzędach.

lista kontrolna

  • [ ] Zdefiniowałem stały schemat z nazwami pól, kolejnością i formatem.
  • [ ] Podałem listę kategorii modelowi, nie dałem się zmyślić.
  • [ ] Dodałem regułę formatu liczbowego (kropka/przecinek, bez separatora tysięcy).
  • Sprawdziłem [ ] podstawa opodatkowania + VAT = całkowita równość.
  • [ ] Zleciłem wykonanie skanu anomalii/duplikatów i podjąłem decyzje jako człowiek.
  • [ ] Porównałem sumę wierszy ze znaną sumą kontrolną.