Ежедневно сотрудники бухгалтерии, кадровых и юридических служб тратят часы на ручной ввод данных из документов. Счёт на оплату приходит в PDF, паспорт сотрудника — фотографией в мессенджере, диплом кандидата — сканом на почте. Каждый файл приходится открывать, перепечатывать реквизиты, сверять цифры и переносить их в учётную систему.
Ошибки неизбежны: опечатка в ИНН, пропущенная цифра в расчётном счёте, неверная дата в паспорте. Исправление таких ошибок стоит компании времени, а иногда — денег и репутации.
Существующие OCR-решения либо требуют дорогостоящих лицензий, либо не умеют работать с российскими документами, либо выдают «сырой» текст, который всё равно приходится разбирать вручную.
Решение: один инструмент для восьми типов документов
Российский разработчик разработал «ИИ Сканер документов» — бесплатную программу для Windows, которая распознаёт документы с помощью современных языковых моделей и сразу возвращает структурированный JSON, готовый к импорту в 1С, CRM, ERP или собственную информационную систему.
Приложение поддерживает восемь типов документов:
Счёт на оплату — реквизиты организации, номер и дата счёта, перечень товаров и услуг, суммы с НДС и без.
Реквизиты компании — ИНН, КПП, ОГРН, юридический адрес, банковские реквизиты, ФИО директора и главного бухгалтера.
Анкета — ФИО, дата и место рождения, паспортные данные, адреса регистрации и фактического проживания, ИНН, телефон.
Паспорт РФ — серия и номер, дата выдачи, код подразделения, ФИО, дата и место рождения.
Водительское удостоверение — ФИО, дата рождения, номер ВУ, дата выдачи.
Диплом — ФИО выпускника, наименование ВУЗа, специальность, квалификация, регистрационный номер, номер бланка.
Патент — данные разрешения на работу для иностранных граждан: ФИО, гражданство, номер документа, вид деятельности, ИНН.
ЭТК / Выписка из ПФР — места работы с периодами из электронной трудовой книжки, включая стаж до 1 января 2020 года и сведения с 2020 года.
Программа принимает файлы в форматах PDF, JPG, PNG, DOCX, TXT, RTF и HTML. Для изображений и PDF используется визуальный анализ, для текстовых файлов — извлечение содержимого с последующей обработкой языковой моделью.
Архитектура: свобода выбора провайдера ИИ
В отличие от многих решений, привязанных к одному поставщику нейросетей, «ИИ Сканер документов» позволяет выбрать провайдера под задачи и бюджет организации:
OpenAI (GPT-4o) — максимальная точность распознавания сложных макетов.
GigaChat — российская модель, работающая без VPN и иностранных сервисов.
LM Studio — локальное развёртывание моделей на собственном оборудовании.
llama.cpp — лёгкие open-source модели для офлайн-работы.
Пользователь самостоятельно указывает API-ключ, выбирает модель и эндпоинт. Это означает, что данные документов не проходят через сторонние сервисы разработчика: распознавание выполняется напрямую между рабочей станцией и выбранным провайдером.
REST API: интеграция без GUI
Для автоматизации бизнес-процессов приложение предоставляет локальный REST API на порту 5000. Эндпоинты принимают файлы методом POST и возвращают JSON с извлечёнными данными. Это позволяет встраивать распознавание в существующие информационные системы без изменения интерфейса пользователя.
API поддерживает все восемь типов документов и использует те же настройки ИИ, что и графический интерфейс. Примеры запросов и структуры ответов документированы и доступны в справочном разделе приложения.
Как это работает
Процесс занимает три шага:
Загрузка файла. Пользователь перетаскивает документ в окно программы или выбирает через стандартный диалог.
Выбор типа документа. Указывается один из восьми поддерживаемых типов — это определяет набор полей, которые ИИ должен извлечь.
Получение результата. Через несколько секунд данные отображаются в удобной форме и доступны для экспорта в JSON.
Все промпты оптимизированы для российских документов: даты приводятся к формату ДД.ММ.ГГГГ, паспортные номера очищаются от посторонних символов, телефоны нормализуются к виду +7XXXXXXXXXX.



Начать дискуссию