Контрагент прислал архив документов. Внутри 30 актов: часть в PDF, часть в виде сканов, один почему-то сфотографирован на телефон.
Нужно открыть каждый файл, найти номер, дату, сумму, НДС и перенести все это в Excel. Работа несложная, но легко потерять час и ошибиться в одной цифре.
Такую задачу можно отдать нейросети. Главное — не просить ее «разобраться с документами», а заранее определить структуру таблицы и правила проверки.
Сначала убедитесь, что ИИ вообще нужен
Если документы пришли через ЭДО в структурированном формате, собирать реестр с помощью нейросети обычно не стоит. Нужные сведения лучше выгрузить непосредственно из оператора ЭДО или учетной системы.
ИИ полезен, когда исходные данные неструктурированные:
сканы бумажных актов;
обычные PDF;
фотографии документов;
файлы разных форматов;
документы от нескольких контрагентов;
архив без общего реестра.
С 2026 года основным формализованным документом для электронного обмена стал УПД формата 5.03. При этом бумажные и неформализованные электронные первичные документы по-прежнему могут использоваться. Это отдельно разъясняла ФНС.
Поэтому архивы из PDF пока никуда не исчезнут.
Какие данные можно извлечь
Перед загрузкой документов определите, какие столбцы нужны в реестре.
Для актов я бы начал с такого набора:
Столбец | Что записывать |
|---|---|
Имя файла | Название исходного документа |
Вид документа | Акт, УПД, накладная или другой документ |
Номер | Номер документа |
Дата | Дата составления |
Исполнитель | Наименование контрагента |
ИНН исполнителя | ИНН из документа |
Заказчик | Наименование вашей организации |
Договор | Номер и дата договора, если указаны |
Содержание операции | Краткое описание работ или услуг |
Сумма без НДС | Числовое значение |
Ставка НДС | 0%, 5%, 7%, 10%, 20%, без НДС или другое значение |
Сумма НДС | Числовое значение |
Сумма с НДС | Итоговая сумма |
Подписи | Есть или не обнаружены визуально |
Требуется проверка | Да или нет |
Комментарий | Что не удалось распознать |
Необязательно использовать все столбцы. Чем проще задача, тем меньше вероятность, что нейросеть начнет додумывать недостающие сведения.
Отдельно отмечу: ИИ может увидеть изображение подписи, но не способен подтвердить полномочия подписанта или юридическую действительность документа.
Не загружайте сразу весь архив
Начните с трех-пяти документов разного качества:
один хороший PDF;
один нечеткий скан;
один многостраничный акт;
один документ с необычным расположением реквизитов.
Так вы быстро увидите, правильно ли нейросеть понимает структуру документов и не путает ли сумму без НДС с итоговой суммой.
Если сразу загрузить 30 файлов, ошибка в инструкции размножится на весь реестр. Получится быстрая автоматизация неправильного результата — один из самых распространенных эффектов цифровизации.
Готовый промпт для создания реестра
Загрузите тестовую подборку и используйте такой запрос:
Проанализируй приложенные документы и составь реестр для переноса в Excel.
Для каждого документа создай отдельную строку.
Столбцы:
Имя исходного файла.
Вид документа.
Номер документа.
Дата документа.
Наименование исполнителя.
ИНН исполнителя.
Наименование заказчика.
Номер и дата договора.
Краткое содержание работ или услуг.
Сумма без НДС.
Ставка НДС.
Сумма НДС.
Итоговая сумма.
Наличие видимых подписей.
Требуется ручная проверка.
Комментарий.
Важные правила:
не придумывай отсутствующие значения;
если реквизит не найден, напиши «не указано»;
если текст невозможно уверенно прочитать, напиши «не распознано»;
не рассчитывай НДС самостоятельно, если он не выделен в документе;
сохраняй связь каждой строки с именем исходного файла;
если один документ занимает несколько страниц, объедини их в одну строку;
если в одном файле находятся разные документы, создай для них отдельные строки;
суммы запиши как числовые значения без обозначения валюты;
все сомнительные поля перечисли в колонке «Комментарий».
После таблицы укажи:
сколько файлов обработано;
сколько документов найдено;
какие файлы не удалось обработать;
какие строки требуют обязательной ручной проверки.
Главные слова в этом запросе — «не придумывай».
Если нейросеть не может разобрать последнюю цифру ИНН, нам нужен не самый вероятный вариант, а честная пометка «не распознано».
Как перенести результат в Excel
Некоторые нейросети могут сразу подготовить файл XLSX. Если такой возможности нет, попросите вывести результат в виде таблицы или CSV.
После переноса проверьте, что:
даты распознаны именно как даты;
суммы находятся в числовом формате;
ИНН не превратились в экспоненциальную запись;
ведущие нули не исчезли;
многострочные комментарии не разъехались по соседним строкам;
каждый документ связан с исходным файлом.
ИНН и номера документов лучше хранить как текст. Складывать их в Excel обычно не требуется.
Попросите ИИ найти дубли
После создания реестра можно выполнить вторую полезную проверку:
Найди возможные дубли документов.
Сравни строки по номеру, дате, ИНН контрагента и итоговой сумме.
Раздели результат на две группы:
Точные совпадения.
Возможные совпадения, где отличается одно поле.
Не удаляй строки самостоятельно. Добавь колонку «Возможный дубль» и объясни причину.
Это поможет заметить ситуации, когда один акт прислали два раза или сохранили под разными именами.
Но одинаковая сумма еще не означает дубль. Окончательное решение должен принять бухгалтер.
Как проверить готовый реестр
Я бы использовал четыре уровня контроля.
1. Количество документов
Сравните количество исходных документов и строк в реестре.
При этом учитывайте, что один PDF может содержать несколько актов, а один акт — занимать несколько страниц.
2. Контрольная сумма
Посчитайте общую сумму по реестру и сравните ее с данными контрагента, ЭДО или учетной системы.
Если контрольной суммы нет, проверьте хотя бы несколько крупных документов.
3. Выборочная проверка
Откройте несколько актов и вручную сравните:
номер;
дату;
ИНН;
сумму без НДС;
НДС;
итоговую сумму.
Обязательно включите в выборку документы плохого качества и все строки с пометкой «требуется проверка».
4. Проверка реквизитов
Статья 9 закона № 402-ФЗ устанавливает обязательные реквизиты первичного учетного документа. Среди них наименование и дата документа, сведения об экономическом субъекте, содержание операции, величина измерения и информация об ответственных лицах.
Нейросеть может помочь найти отсутствующие поля, но решение о том, можно ли принять документ к учету, остается за бухгалтером.
Какие документы лучше не загружать во внешний сервис
В первичке могут находиться персональные данные, банковские реквизиты, условия договоров и коммерческая информация.
Перед использованием публичной нейросети нужно проверить правила компании и удалить сведения, которые не требуются для составления реестра.
Если документ невозможно нормально обезличить, есть три варианта:
не использовать для него внешний ИИ;
распознавать только заранее вырезанный фрагмент;
применять корпоративное решение в закрытом контуре.
Для регулярной обработки первички третий вариант надежнее. В закрытой системе можно настроить единый шаблон реестра, права доступа, журнал действий и обязательную проверку человеком.
Не загружайте результат сразу в учет
Реестр, подготовленный нейросетью, — это черновик для проверки, а не основание для автоматического создания проводок.
На первом этапе достаточно получить таблицу, сэкономить время на ручном вводе и отметить проблемные документы.
Когда процесс станет регулярным, можно добавлять:
автоматическую проверку контрагента по справочнику;
сопоставление с договором;
поиск документа в ЭДО;
сверку с учетной системой;
передачу подтвержденных данных в 1С.
Но начинать лучше с простого реестра. На нем быстро видно качество исходных документов, реальную точность распознавания и объем ручной проверки.
ИИ хорошо переносит сведения из документов в таблицу. Бухгалтер хорошо понимает, можно ли этим сведениям доверять.
Вместе они справятся с архивом быстрее. По отдельности один потратит вечер, а второй может очень уверенно перепутать цифру восемь с цифрой три.

Начать дискуссию