Парсер PDF с просмотром результата перед выгрузкой

Парсер PDF в ReadyData позволяет увидеть, как прочитан ваш документ, до скачивания. Проверьте состав блоков и выберите формат для следующего этапа работы.

Начать

Загрузите файл

Перетащите файл сюда или нажмите, чтобы выбрать

0/30 · 0 credits · Free: 1 file

Проверьте парсер на своём PDF

Возьмите характерный раздел: страницу с текстом, таблицу со шапкой и её продолжение.

1

Добавьте проверочный документ

Загрузите PDF, с которым обычно работаете. При необходимости задайте нужный диапазон страниц.

2

Сопоставьте режим с задачей

Content extraction даёт текст и таблицы; Table extraction подходит для строк, столбцов и явных фактов.

3

Оцените полученные блоки

Нажмите Process files. Проверьте, есть ли нужные разделы и не попали ли подписи или колонтитулы в строки таблицы.

4

Скачайте подходящий результат

Выберите JSON для структуры блоков, TXT для текста или Excel для таблиц. Проверьте файл в целевой программе.

Наличие выгрузки ещё не означает готовые данные

Файл может открываться, но содержать лишние строки, неверные заголовки или неподходящую структуру.

Не тот вид JSON
Пользователь ожидает свои бизнес-поля, хотя универсальное извлечение возвращает блоки документа.
Макет влияет на результат
Один аккуратный пример не показывает, как будут прочитаны переносы и сложные таблицы ваших файлов.
Image 1

Выберите рабочий способ переноса

Проверка на знакомом документе помогает понять, что нужно доработать после извлечения.

Пример каталога
Условный пример: шапка «Артикул / Название / Цена» должна соответствовать данным под ней, а не стать первой товарной позицией.
Контроль пригодности
Откройте экспорт в своей программе и проверьте поля перед созданием дальнейшего преобразования.
Без обязательного кода
Для загрузки, просмотра и скачивания используется интерфейс браузера.

Вопросы о выборе и проверке парсера

Что содержится в результате и как оценить его на своём материале.