PerfectParser — извлечение данных из PDF и сканов с помощью ИИ в Excel, CSV и JSON

PerfectParser — логотип сервиса
Официальный сайт сервиса

PerfectParser — сервис на основе ИИ для извлечения структурированных данных из PDF, сканов и изображений документов. Пользователь описывает обычными словами, какие поля нужны, например номер инвойса, дата и сумма, и получает результат в таблице или JSON. Шаблоны, код и обучение модели для этого не нужны, поэтому сервис рассчитан прежде всего на операционные, бухгалтерские и логистические команды. Разработчик понадобится только для подключения через API.

Что умеет

  • Разбирает инвойсы, packing slips, shipping labels, bills of lading, банковские выписки и контракты. На страницах решений упоминаются также чеки, purchase orders, счета за коммунальные услуги, расчётные листки, удостоверения личности и паспорта, страховые полисы.
  • Принимает PDF, PNG, JPG и сканы, в том числе документы со сложной разметкой.
  • По описанию полей ИИ сам предлагает набор полей с типами (строка, число) и сохраняет его как именованный парсер. Парсер можно поправить той же текстовой инструкцией, без переобучения.
  • Обрабатывает пакеты файлов параллельно и показывает статус и историю каждого пакета. По заявлению сервиса, извлечение занимает менее 10 секунд на документ, а 100 документов обрабатываются за несколько минут.

Как это работает

Работа строится в три шага: загрузка файлов, описание нужных полей и выгрузка результата. Готовые данные скачиваются в Excel, CSV или JSON. Для передачи результатов во внешние системы есть REST API с API-ключом и исходящие webhooks. В документации описаны разделы Quickstart, аутентификация, Account, Parsers, Extractions и Webhooks. Упоминания SDK на сайте нет. Для интеграций без программирования предусмотрен раздел Zapier.

Цены и тарифы

Сервис работает только по оплате за страницы: одна страница равна одному кредиту. Подписки и автопродления нет. Кредиты покупаются пакетами на 100, 250, 500, 1 000, 2 500, 5 000, 10 000 и 25 000 страниц. Стартовый пакет стоит от $19. Пакет на 1 000 страниц стоит $99, то есть $0,099 за страницу, и даёт экономию 48% относительно базовой ставки. Самая низкая цена за страницу на странице тарифов указана как $0,051. Цены приведены без налогов. Купленные кредиты действуют 12 месяцев с даты покупки. Для объёмов больше 25 000 страниц, выделенного SLA и варианта on-premise предусмотрены индивидуальные условия через отдел продаж, ответ обещают в течение одного рабочего дня.

Бесплатный старт и безопасность

При регистрации без банковской карты выдаётся 20 бесплатных страниц. Срок действия этих страниц в описании тарифов не указан, 12-месячное правило относится к купленным кредитам. Данные шифруются алгоритмом AES-256, при передаче используется TLS 1.2 и выше. По FAQ сервиса, загруженные документы не используются для обучения ИИ, удаляются автоматически и не передаются третьим лицам. Заявленная точность извлечения — 99,5%, сервис также указывает более 50 команд-пользователей и более 100 000 обработанных документов. Эти цифры взяты с самого сайта.

Ограничения

В документации не указаны лимиты размера файла и количества страниц в одном документе. Список поддерживаемых форматов явно не перечислен, кроме PDF, PNG, JPG и сканов. Сервис ориентирован на стандартные деловые документы, и результат зависит от качества скана. Для массовых объёмов, нестандартных требований к SLA или развёртывания на собственных серверах нужен запрос в отдел продаж.

Модели оплаты

Имеется тестовый период

Похожие сервисы на PerfectParser

DocBatch.ai

Инструмент для извлечения структурированных данных из документов.

Refractr

API, который превращает счета, письма и PDF в валидированный JSON по схеме, заданной пользователем. Сервис находится в альфа-версии.

ExtractAny

Инструмент для извлечения структурированных данных с веб-сайтов, документов и изображений.

UnDatasIO

Инструмент для преобразования неструктурированных данных из различных форматов файлов в активы, готовые для использования в искусственном интеллекте.

Docsumo

Платформа для извлечения данных из неструктурированных документов с использованием ИИ и технологии оптического распознавания символов (OCR).

Instafill

Инструмент для автозаполнения PDF форм с использованием извлеченных данных из документов.

ChattyDocs

Искусственный интеллект, помощник для анализа больших наборов документов.