Сайт не работает без javascript. Включите поддержку javascript в настройках браузера!
🔴 Бесплатный вебинар: "Бухгалтер IT компании IT-льготы под прицелом ФНС"
Игорь Морозов
Автоматизация учета
Читать 3 мин
Как переложить рутину на ИИ для маленькой компании и освободить сотрудников для других задач

Как переложить рутину на ИИ для маленькой компании и освободить сотрудников для других задач

Автоматически извлекайте данные из счетов, паспортов, дипломов, патентов и трудовых книжек за секунды. Точность человека — скорость машины.

1 просмотр121 открытие

Ежедневно сотрудники бухгалтерии, кадровых и юридических служб тратят часы на ручной ввод данных из документов. Счёт на оплату приходит в PDF, паспорт сотрудника — фотографией в мессенджере, диплом кандидата — сканом на почте. Каждый файл приходится открывать, перепечатывать реквизиты, сверять цифры и переносить их в учётную систему.

Ошибки неизбежны: опечатка в ИНН, пропущенная цифра в расчётном счёте, неверная дата в паспорте. Исправление таких ошибок стоит компании времени, а иногда — денег и репутации.

Существующие OCR-решения либо требуют дорогостоящих лицензий, либо не умеют работать с российскими документами, либо выдают «сырой» текст, который всё равно приходится разбирать вручную.

Решение: один инструмент для восьми типов документов

Российский разработчик разработал «ИИ Сканер документов» — бесплатную программу для Windows, которая распознаёт документы с помощью современных языковых моделей и сразу возвращает структурированный JSON, готовый к импорту в 1С, CRM, ERP или собственную информационную систему.

Приложение поддерживает восемь типов документов:

  • Счёт на оплату — реквизиты организации, номер и дата счёта, перечень товаров и услуг, суммы с НДС и без.

  • Реквизиты компании — ИНН, КПП, ОГРН, юридический адрес, банковские реквизиты, ФИО директора и главного бухгалтера.

  • Анкета — ФИО, дата и место рождения, паспортные данные, адреса регистрации и фактического проживания, ИНН, телефон.

  • Паспорт РФ — серия и номер, дата выдачи, код подразделения, ФИО, дата и место рождения.

  • Водительское удостоверение — ФИО, дата рождения, номер ВУ, дата выдачи.

  • Диплом — ФИО выпускника, наименование ВУЗа, специальность, квалификация, регистрационный номер, номер бланка.

  • Патент — данные разрешения на работу для иностранных граждан: ФИО, гражданство, номер документа, вид деятельности, ИНН.

  • ЭТК / Выписка из ПФР — места работы с периодами из электронной трудовой книжки, включая стаж до 1 января 2020 года и сведения с 2020 года.

Программа принимает файлы в форматах PDF, JPG, PNG, DOCX, TXT, RTF и HTML. Для изображений и PDF используется визуальный анализ, для текстовых файлов — извлечение содержимого с последующей обработкой языковой моделью.

Архитектура: свобода выбора провайдера ИИ

В отличие от многих решений, привязанных к одному поставщику нейросетей, «ИИ Сканер документов» позволяет выбрать провайдера под задачи и бюджет организации:

  • OpenAI (GPT-4o) — максимальная точность распознавания сложных макетов.

  • GigaChat — российская модель, работающая без VPN и иностранных сервисов.

  • LM Studio — локальное развёртывание моделей на собственном оборудовании.

  • llama.cpp — лёгкие open-source модели для офлайн-работы.

Пользователь самостоятельно указывает API-ключ, выбирает модель и эндпоинт. Это означает, что данные документов не проходят через сторонние сервисы разработчика: распознавание выполняется напрямую между рабочей станцией и выбранным провайдером.

REST API: интеграция без GUI

Для автоматизации бизнес-процессов приложение предоставляет локальный REST API на порту 5000. Эндпоинты принимают файлы методом POST и возвращают JSON с извлечёнными данными. Это позволяет встраивать распознавание в существующие информационные системы без изменения интерфейса пользователя.

API поддерживает все восемь типов документов и использует те же настройки ИИ, что и графический интерфейс. Примеры запросов и структуры ответов документированы и доступны в справочном разделе приложения.

Как это работает

Процесс занимает три шага:

  1. Загрузка файла. Пользователь перетаскивает документ в окно программы или выбирает через стандартный диалог.

  2. Выбор типа документа. Указывается один из восьми поддерживаемых типов — это определяет набор полей, которые ИИ должен извлечь.

  3. Получение результата. Через несколько секунд данные отображаются в удобной форме и доступны для экспорта в JSON.

Все промпты оптимизированы для российских документов: даты приводятся к формату ДД.ММ.ГГГГ, паспортные номера очищаются от посторонних символов, телефоны нормализуются к виду +7XXXXXXXXXX.

Настройка программы

Информации об авторе

Этот пост написан блогером Трибуны. Вы тоже можете начать писать: сделать это можно .

Начать дискуссию

ГлавнаяПодписка