Единица 2 / 11

Обработка данных о расходах и счетах-фактурах

Прибыль:

  • Возможность конвертировать произвольный текст и данные счетов в таблицу, структурированную по фиксированной схеме.
  • Возможность настройки повторяющихся подсказок для категоризации расходов, расчета возврата НДС и обнаружения аномалий.
  • Возможность проверки извлеченных финансовых полей на равенство НДС и проверку общей согласованности.

Одна из задач, на которую бухгалтеры тратят больше всего времени, — это организация разрозненных данных о расходах и счетах в организованные таблицы. Счет, прикрепленный к электронному письму, фотография квитанции, отправленной из WhatsApp, заметка о расходах в виде произвольного текста, например «Еда для встречи в Анкаре + такси 840 TL»… Все они должны оказаться в одном месте: строка, структурированная с категориями, суммой, НДС (налогом на добавленную стоимость), датой и полями поставщика.

Искусственный интеллект (ИИ) очень эффективен в преобразовании «свободного текста в структуру». Но в финансовых данных недопустимо, чтобы даже копейка ошиблась. Итак, в этом модуле мы изучим две вещи вместе: заставить ИИ производить данные в соответствии с фиксированной схемой (предопределенным списком полей) и проверять выходные данные с помощью совокупных проверок согласованности.

Почему «схема» так важна?

Схема — это когда вы заранее указываете, какие поля будут в каждой строке, в каком порядке и в каком формате. Если вы не предоставите схему, модель создаст отдельный формат для каждого счета; Тогда объединение их в одну таблицу будет затруднительно без корректировки вручную. Если вы предоставите схему, выходные данные будут последовательными и проверяемыми.

Хорошая диаграмма расходов включает в себя следующие поля: дата, поставщик, описание, категория, сумма освобождения от НДС (база), ставка НДС, сумма НДС, общая сумма с НДС, номер документа.

Совет: Всегда определяйте числовые поля, используя соглашение «точка/запятая». Сказав «Запишите суммы в формате 1234,56, без разделителя тысяч», вы избежите часов кошмарного форматирования при последующем экспорте в Excel.

Шаг за шагом: от произвольного текста к таблице

  1. Исправьте схему. Напишите имена полей, порядок и формат.
  2. Дайте список категорий. Попросите модель выбрать из вашего списка, а не выдумывать категории в голове.
  3. Создайте правило неопределенности. Позвольте ему оставить незаполненной область, в которой он не уверен, и поставьте галочку.
  4. Проверьте логику НДС. Попросите модель проверить базу уравнения + НДС = итого.
  5. Перепроверьте итоговую сумму. Соответствует ли сумма всех строк вашей контрольной сумме?

Слабая подсказка/Сильная подсказка

Слабая подсказка: Превратите в таблицу следующие расходы: - Еда-такси Анкары 840 - Канцтовары 300, включая НДС - Отель на 2 ночи 3600

Это дает результат с противоречивой категорией, перепутанным НДС и разным форматом в каждой строке.

Мощная подсказка: Преобразуйте следующие произвольные текстовые начисления в таблицу ТОЧНО по этой схеме: Поля (в этом порядке): дата | поставщик | описание | категория |база | ставка_ватса | сумма_ватса | всего | ПримечаниеПравила: - Категория только из следующего списка: [Путешествие, Проживание, Еда, Канцтовары, Транспорт, Другое] - Укажите суммы в формате 1234,56 (без разделителя тысяч). - Если указано «НДС включен», рассчитайте базу и НДС обратно; Если вы не знаете ставку НДС, в поле примечания напишите «подтверждение ставки» и оставьте его пустым. - Обеспечить равенство налоговой базы + Сумма_НДС = Итого в каждой строке; Если не предоставляет, в поле примечания напишите «НЕ СООТВЕТСТВУЕТ». - Оставьте поле, в котором вы не уверены, поставьте в примечании галочку.

Эта подсказка рассчитывает базу для канцелярских товаров, включая НДС до 250 и НДС до 50, помечает товары с неоднозначными ставками и выдает чистый результат, который можно объединить в одну таблицу.

Логика расчета возврата НДС

Определение налоговой базы из суммы с учетом НДС – часто необходимая процедура в бухгалтерском учете. Формула: база = итого / (1 + ставка). Например, для 300 TL, включая 20% НДС, база = 300/1,20 = 250, НДС = 50. Если вы явно зададите эту формулу в модель, погрешность уменьшится.

транзакция

формула

Образец (20%)

без НДС → включено

итого = база × (1 + ставка)

250 × 1,20 = 300

НДС включен → базовый

база = итого / (1 + ставка)

300/1,20 = 250

сумма НДС

НДС = общая сумма — база

300–250 = 50

контроль

база + НДС = итого

250 + 50 = 300

Работа с фотографией счета и распечаткой OCR

Расходы с места часто приходят в виде фотографии квитанции или счета-фактуры в формате PDF. Технология, которая извлекает текст из этих изображений, называется OCR (оптическое распознавание символов). Инструменты визуального искусственного интеллекта могут справиться с этой задачей, но результаты распознавания всегда ошибочны: запятая может быть прочитана как точка, «5» можно спутать с «S», цифра суммы может быть потеряна. Поэтому никогда не включайте суммы из OCR непосредственно в бухгалтерский учет.

Извлеките следующие поля из этого изображения счета-фактуры и ТОЧНО запишите их в следующую схему: дата | поставщик | номер_налога | база | ставка_ватса | сумма_ватса | TotalRules: - Напишите «НЕПРЧИТАНО» в любом поле, которое вы не можете прочитать или в котором не уверены, не гадайте. - base + vat_amount = проверить итог; Если нет, отметьте «ПРОВЕРИТЬ». - Укажите суммы в формате 1234,56.

Это важнейшее правило безопасности – не заставлять кого-либо угадывать неопределенную область. Если модель завершает число словом «скорее всего», в запись автоматически вносится ошибка. Флаг «НЕПРИТАННО» позволяет человеку вернуться к исходному документу и подтвердить его.

Совет: В распечатке OCR общая сумма обычно является наиболее надежным полем для чтения, поскольку она написана крупным шрифтом. Если уравнение налоговая база + НДС = общая сумма не выполняется, вы можете определить, в какой области возникла ошибка, вернувшись к этому уравнению.

Обнаружение аномалий и дубликатов записей

ИИ не просто переводит; Он также находит подозрительные предметы. Например, почти одна и та же сумма от одного и того же поставщика дважды в один и тот же день или необычно большие расходы для данной категории.

В приведенной ниже таблице расходов отметьте следующие аномалии и напишите причину: 1) Возможные повторяющиеся записи (тот же поставщик + аналогичная сумма + недавняя дата) 2) Суммы, превышающие среднюю сумму по категории более чем в 3 раза 3) Ставка НДС отличается от ожидаемой для категории Просто отметьте и напишите причину; не удаляйте и не изменяйте строки.

Внимание: предупреждение ИИ «это может повторяться» — это подсказка, а не решение. Эти две записи на самом деле могут быть двумя разными службами. Решение об удалении или объединении всегда принимается людьми; Модель просто приковывает ваше внимание.

Мини-кейсы

Случай 1 — Стек из 300 фишек. Эксперт по бухгалтерскому учету преобразовал 300-строчный список расходов на конец месяца в виде произвольного текста в таблицу примерно за 15 минут с помощью диаграммы. Работа, которая при выполнении вручную занимала 4 часа, благодаря проверке сократилась до 40 минут. Выигрыш заключается не только в скорости; Согласованность категорий также увеличилась.

Случай 2 — Обнаружена двойная оплата. В сообщении об аномалии отмечалось, что счет-фактура на сумму 4720 турецких лир поставщику был введен дважды с двумя разными номерами документов. Проверка показала, что один из них представлял собой черновик, а другой — окончательный счет-фактуру, и оба подлежали оплате. Без ИИ была бы двойная оплата.

Случай 3 — ловушка ставки НДС. Модель предусматривала 20% НДС на покупку основных продуктов питания; тогда как товар находился в группе с более низкой ставкой. Благодаря правилу «подтверждения курса» линия была отмечена, проверена и исправлена ​​экспертным источником. Урок: не оставляйте ставку НДС модели, подтвердите ее из списка или документа.

Распространенные ошибки

  • Перевод данных без предоставления схемы. Каждая строка имеет свой формат, объединение требует ручной коррекции.
  • Не предоставляет список категорий. Модель соответствует своей категории; отчетность становится противоречивой.
  • Отсутствие проверки равенства НДС. налоговая база + НДС = строки, которые не складываются в итог, вносятся в таблицу молча.
  • Принятие предупреждения об аномалии за решение. «Может быть повторено» — это начало; Решение об удалении принимает человек.
  • Пропуск контрольной суммы. Опираясь на выходные данные, не сравнивая сумму строк с известной контрольной суммой.

В заключение

  • При обработке произвольных текстовых данных о расходах/счетах с помощью искусственного интеллекта наиболее надежным способом является запрос выходных данных в соответствии с фиксированной схемой.
  • Предоставление списка категорий и разъяснение правил форматирования (точка/запятая, разделитель тысяч) обеспечивает единообразие и возможность переноса вывода.
  • Явно укажите в модели формулу расчета возврата НДС и проверьте равенство налоговой базы + НДС = итого в каждой строке.
  • ИИ обладает мощными возможностями в обнаружении повторяющихся и аномальных записей, но решение об удалении/объединении всегда принимает человек.
  • Перекрестная проверка итогов строк с известной контрольной суммой обеспечивает безопасность всей работы.

Задача приложения

Подготовьте смешанный список расходов (фактический или примерный) объемом не менее 10 строк; сознательно включить дублирующую запись и товар с неправильной ставкой НДС. Преобразуйте ее в таблицу с помощью мощного шаблона подсказки, а затем запустите подсказку об аномалии. Проверьте, улавливает ли модель две установленные вами ловушки, и вручную проверьте равенство НДС в трех строках.

контрольный список

  • [ ] Я определил фиксированную схему с именами полей, порядком и форматом.
  • [ ] Я дал модели список категорий, не давая ему составить список.
  • [ ] Я добавил правило числового формата (точка/запятая, без разделителя тысяч).
  • Я проверил [ ] налоговую базу + НДС = полное равенство.
  • [ ] Я сделал сканирование аномалий/дубликатов и принял решения как человек.
  • [ ] Я сравнил общее количество строк с известной контрольной суммой.