PDF в CSV
Извлеките таблицы из PDF в файлы CSV.
Перетащите PDF сюда или нажмите для выбора
PDF в пределах лимита вашего тарифа
Таблица, запертая внутри PDF, — классический тупик: цифры видно, а работать с ними нельзя. Этот инструмент находит таблицы и записывает каждую отдельным CSV — обычным текстом, который без возражений читают Excel, Google Таблицы, скрипт на Python и импорт в базу данных.
Как это работает
- 1
Загрузите PDF
Перетащите документ с таблицами. По одному файлу за раз.
- 2
Таблицы находятся сами
Каждая страница проверяется на табличную структуру, и каждая найденная таблица обрабатывается отдельно.
- 3
Скачайте CSV
Одна таблица вернётся файлом .csv, несколько — архивом: в CSV нет понятия листов.
Почему этот инструмент
Результат, с которым работают
CSV принимают везде — таблицы, скрипты, базы данных, аналитика. В отличие от файла Excel, для открытия не нужен сам Excel.
Одна таблица — один файл
Таблицы не слипаются в кашу. Каждая сохраняет свои строки и колонки и называется по странице, откуда пришла.
Excel открывает корректно
Файлы пишутся с меткой UTF-8, поэтому кириллица и диакритика не превращаются в кракозябры при открытии в Excel.
Удаляется сразу
Документ обрабатывается на нашем сервере и удаляется сразу после завершения задачи.
Частые вопросы
Какие таблицы распознаются?
Таблицы с видимыми линиями и ровными колонками находятся надёжно. Данные, свёрстанные одними пробелами, неоднозначны даже для человека — они могут выйти неточно или не выйти вовсе.
Почему я получил архив вместо CSV?
Потому что таблиц нашлось больше одной. CSV по определению — одна плоская таблица, поэтому каждая пишется в свой файл, а набор упаковывается в zip.
Сработает ли это со сканом?
Напрямую — нет: скан это изображение, читать в нём нечего. Сначала прогоните его через OCR, чтобы добавить текстовый слой, и только потом конвертируйте.
А если таблиц не найдено?
Инструмент сообщит об этом, а не вернёт пустой файл. Если данные в документе не совсем табличные, лучше подойдут «PDF в Excel» или «PDF в текст».