단위 2 / 11

비용 및 송장 데이터 처리

이득:

  • 자유 텍스트 및 송장 데이터를 고정된 스키마에 따라 구성된 테이블로 변환하는 기능
  • 비용 분류, VAT 환산 및 이상 감지를 위한 반복 가능한 프롬프트를 설정하는 기능
  • VAT 동등성 및 전체 일관성 검사를 통해 추출된 금융 필드를 검증하는 기능

회계팀이 가장 많은 시간을 보내는 작업 중 하나는 흩어져 있는 비용과 송장 데이터를 정리된 테이블로 정리하는 것입니다. 이메일에 첨부된 청구서, WhatsApp에서 보낸 영수증 사진, "앙카라 회의 식사 + 택시 840 TL"과 같은 자유 텍스트 비용 메모... 모두 같은 위치에 있어야 합니다. 즉, 카테고리, 금액, VAT(부가가치세), 날짜 및 공급업체 필드로 구성된 줄이 있어야 합니다.

인공 지능(AI)은 이러한 "자유로운 텍스트를 구조로" 변환하는 데 매우 강력합니다. 하지만 금융 데이터에서는 단 한 푼도 잘못되는 일이 용납되지 않습니다. 따라서 이 단원에서는 고정된 스키마(미리 결정된 필드 목록)에 따라 AI가 데이터를 생성하도록 하는 것과 집계 일관성 검사를 통해 출력의 유효성을 검사하는 두 가지 사항을 함께 학습합니다.

"스키마"가 왜 그렇게 중요한가요?

스키마는 각 행에 어떤 필드가 어떤 순서로, 어떤 형식으로 포함될지 미리 알려주는 것입니다. 스키마를 제공하지 않으면 모델은 각 송장에 대해 다른 형식을 생성합니다. 그런 다음 수동으로 수정하지 않으면 단일 테이블로 결합하기가 어렵습니다. 스키마를 제공하면 출력이 일관되고 검증 가능합니다.

좋은 비용 차트에는 날짜, 공급업체, 설명, 카테고리, VAT 제외 금액(기준), VAT 요율, VAT 금액, VAT 포함 총액, 문서 번호 등의 필드가 포함됩니다.

팁: 항상 "마침표/쉼표" 규칙을 사용하여 숫자 필드를 정의하십시오. "천 단위 구분 기호 없이 1234.56 형식으로 금액을 쓰십시오"라고 말하면 나중에 Excel로 내보낼 때 몇 시간 동안 서식을 지정하는 악몽을 피할 수 있습니다.

단계별: 자유 텍스트에서 테이블까지

  1. 계획을 수정하십시오. 필드 이름, 순서 및 형식을 작성합니다.
  2. 카테고리 목록을 제공합니다. 모델에게 머리 속에서 카테고리를 구성하지 말고 목록에서 선택하도록 요청하세요.
  3. 불확실성 규칙을 만드세요. 확실하지 않은 부분은 공백으로 두고 "체크" 표시를 하도록 하십시오.
  4. VAT 로직을 확인하세요. 모델에서 기본 + VAT = 합계 등식을 확인하도록 합니다.
  5. 합계를 교차 확인하세요. 모든 라인의 합계가 체크섬과 일치합니까?

약한 프롬프트 / 강한 프롬프트

약한 프롬프트: 다음 비용을 표로 바꾸십시오. - 앙카라 푸드 택시 840 - 문구류 300(VAT 포함) - 호텔 2박 3600

이는 카테고리가 일치하지 않고, VAT가 혼합되어 있고, 각 행마다 형식이 다른 출력을 제공합니다.

강력한 프롬프트:다음 무료 텍스트 요금을 이 구성표에 따라 정확하게 테이블로 변환합니다.필드(이 순서대로): 날짜 | 공급자 | 설명 | 카테고리 |베이스 | 부가세율 | 부가 가치세 | 합계 | 참고규칙:- 다음 목록의 카테고리만: [여행, 숙박, 음식, 문구류, 교통, 기타]- 금액을 1234.56 형식으로 작성합니다(천 단위 구분 없음).- "VAT 포함"이라고 표시된 경우 기본 및 VAT를 다시 계산합니다. VAT 세율을 모르시는 경우, 비고란에 "세율 확인"이라고 적고 공란으로 남겨두세요. - 각 라인에 과세표준 + VAT_amount = 총액의 균등성을 제공합니다. 제공하지 않는 경우 메모란에 "DOES NOT MEET"이라고 기재하세요. - 확실하지 않은 부분은 그대로 두고 메모에 "체크"를 추가하세요.

이 프롬프트는 VAT를 250으로, VAT를 50으로 포함한 문구류의 기본 금액을 다시 계산하고 세율이 모호한 항목에 플래그를 지정하고 단일 테이블로 결합할 수 있는 깔끔한 출력을 생성합니다.

VAT 환산 논리

VAT를 포함한 금액에서 과세표준을 찾는 것은 회계에서 자주 요구되는 절차입니다. 공식: 기본 = 총액 / (1 + 요율). 예를 들어 20% VAT가 포함된 300TL의 경우 기본 = 300 / 1.20 = 250, VAT = 50입니다. 이 공식을 모델에 명시적으로 제공하면 오차 범위가 줄어듭니다.

거래

공식

샘플(20%)

부가세 별도 → 포함

총액 = 기준 × (1 + 요율)

250 × 1.20 = 300

부가세 포함 → 기본

기본 = 총계 / (1 + 요율)

300 / 1.20 = 250

부가가치세 금액

부가 가치세 = 총액 - 기본

300 − 250 = 50

제어

기본 + 부가 가치세 = 합계

250 + 50 = 300

송장 사진 및 OCR 인쇄물 작업

현장 비용은 영수증 사진이나 PDF 송장으로 도착하는 경우가 많습니다. 이러한 이미지에서 텍스트를 추출하는 기술을 OCR(Optical Character Recognition)이라고 합니다. Visual AI 도구가 작업을 수행할 수 있지만 OCR 출력에는 항상 결함이 있습니다. 쉼표는 점으로 읽힐 수 있고, "5"는 "S"와 혼동될 수 있으며, 금액의 숫자가 손실될 수 있습니다. 따라서 OCR의 금액을 회계에 직접 포함하지 마십시오.

이 송장 이미지에서 다음 필드를 추출하여 다음 스키마에 정확하게 작성합니다.날짜 | 공급자 | 세금 번호 | 베이스 | 부가세율 | 부가 가치세 | totalRules:- 읽을 수 없거나 확실하지 않은 필드에는 "UNREAD"라고 쓰십시오. 추측하지 마십시오.- base + vat_amount = check total; 그렇지 않은 경우 "CHECK"에 표시하십시오. - 금액을 1234.56 형식으로 입력하세요.

불확실한 영역을 누구도 추측하지 못하게 하는 것이 중요한 안전 수칙입니다. 모델이 "가장 가능성이 높은" 숫자를 완성하면 기록은 자동으로 오류를 입력합니다. "UNREAD" 플래그를 사용하면 사람이 원본 문서로 돌아가서 확인할 수 있습니다.

팁: OCR 인쇄물에서는 총 금액이 큰 글꼴로 기록되기 때문에 일반적으로 읽기에 가장 신뢰할 수 있는 필드입니다. 과세표준 + VAT = 총계 방정식이 성립하지 않는 경우, 이 방정식을 역으로 살펴보면 어느 부분에서 오류가 발생했는지 알 수 있습니다.

이상 및 중복 기록 탐지

AI는 단지 번역만 하는 것이 아닙니다. 수상한 물건도 찾아냅니다. 예를 들어 같은 공급업체에서 같은 날 두 번이나 거의 같은 금액을 지출했거나 카테고리에 비해 비정상적으로 큰 비용이 발생한 경우입니다.

아래 비용표에 다음의 이상 사항을 표시하고 그 이유를 적습니다. 1) 중복 기록 가능(동일 공급자 + 유사한 금액 + 최근 날짜)2) 금액이 카테고리 평균의 3배를 초과합니다3) 카테고리에 예상되는 부가세율과 다릅니다. 이유를 표시하고 작성하세요. 행을 삭제하거나 변경하지 마십시오.

주의: AI의 "반복적일 수 있습니다" 경고는 결정이 아니라 힌트입니다. 두 레코드는 실제로 두 개의 서로 다른 서비스일 수 있습니다. 삭제 또는 병합에 대한 결정은 항상 사람이 내립니다. 모델이 시선을 사로잡습니다.

미니 케이스

사례 1 — 300개의 칩 스택. 회계 전문가는 다이어그램 프롬프트를 통해 300줄의 자유 텍스트 월말 지출 목록을 약 15분 만에 테이블로 변환했습니다. 수작업으로 4시간이 걸리던 작업이 검증을 통해 40분으로 단축됐다. 이득은 단지 속도만이 아닙니다. 카테고리 일관성도 높아졌습니다.

사례 2 — 이중 지불이 적발되었습니다. 이상 메시지에는 공급업체에 대한 4,720TL의 송장이 두 개의 서로 다른 문서 번호로 두 번 입력되었음을 표시했습니다. 조사 결과 하나는 초안이고 다른 하나는 확정 송장으로 둘 다 지불 기한이 있는 것으로 나타났습니다. AI가 없으면 이중 지불이 발생합니다.

사례 3 - VAT 세율 트랩. 이 모델은 주식 구매에 20%의 VAT를 할당했습니다. 항목은 낮은 비율 그룹에 속했습니다. "요율 확인" 규칙 덕분에 해당 라인은 전문가 소스에 의해 표시, 확인 및 수정되었습니다. 교훈: VAT 세율을 모델에 맡기지 말고 목록이나 문서에서 확인하세요.

일반적인 실수

  • 스키마를 제공하지 않고 데이터를 번역합니다. 각 줄은 서로 다른 형식으로 제공되므로 결합하려면 수동으로 수정해야 합니다.
  • 카테고리 목록을 제공하지 않습니다. 모델은 자체 카테고리에 적합합니다. 보고가 일관성이 없게 됩니다.
  • VAT 동등성을 확인하지 않았습니다. 과세표준 + 부가 가치세 = 총액에 합산되지 않는 행은 테이블에 자동으로 입력됩니다.
  • 결정을 이상 경고로 착각합니다. "반복될 수 있다"는 것이 시작입니다. 인간은 삭제 결정을 내립니다.
  • 체크섬을 건너뛰는 중입니다. 행의 총합을 알려진 제어량과 비교하지 않고 출력에 의존합니다.

요약하면

  • 무료 텍스트 비용/송장 데이터를 AI로 처리할 때 가장 안정적인 방법은 고정된 스키마에 따라 출력을 요청하는 것입니다.
  • 카테고리 목록을 제공하고 형식 지정 규칙(마침표/쉼표, 천 단위 구분 기호)을 명확히 하면 출력의 일관성과 전송 가능성이 유지됩니다.
  • 모델에 VAT 환산 공식을 명시적으로 제공하고 각 라인에서 과세표준 + VAT = 총액이 동일한지 확인합니다.
  • AI는 중복되고 변칙적인 기록을 표시하는 데 강력하지만 삭제/병합에 대한 결정은 항상 사람이 내립니다.
  • 알려진 체크섬을 사용하여 라인 합계를 교차 검증하면 전체 작업이 보호됩니다.

응용과제

최소 10줄의 혼합 비용 목록(실제 또는 샘플)을 준비합니다. 고의로 중복 항목과 VAT 세율이 잘못된 항목을 포함합니다. 강력한 프롬프트 템플릿을 사용하여 테이블로 변환한 다음 변칙 프롬프트를 실행하세요. 모델이 설정한 두 가지 트랩을 포착하는지 확인하고 세 행에서 VAT 동등성을 수동으로 확인합니다.

체크리스트

  • [ ] 필드 이름, 순서 및 형식을 사용하여 고정된 스키마를 정의했습니다.
  • [ ] 카테고리 목록을 모델에게 주었고, 구성하지는 않았습니다.
  • [ ] 숫자 형식(마침표/쉼표, 천 단위 구분 기호 없음) 규칙을 추가했습니다.
  • [ ] 과세표준 + 부가가치세 = 완전균등을 확인했습니다.
  • [ ] 나는 변칙/중복 스캔을 수행하고 인간으로서 결정을 내렸습니다.
  • [ ] 행 합계를 알려진 체크섬과 비교했습니다.