Конвертер PDF в CSV
Извлекайте таблицы и структурированные данные из файлов PDF в формат CSV онлайн бесплатно. Выберите разделитель (запятая, точка с запятой, табуляция или вертикальная черта), настройте чувствительность извлечения, просмотрите данные, а затем мгновенно загрузите их — все это обрабатывается локально в вашем браузере без загрузки на сервер.
No PDF file loaded
Upload a PDF above to extract its data as CSV.
Что такое преобразование PDF в CSV (значения, разделенные запятыми)?
Преобразование PDF в CSV (значения, разделенные запятыми) преобразует каждую выбранную страницу PDF в файл csv (значения, разделенные запятыми), который можно открывать, редактировать, совместно использовать или встраивать в любое место, где поддерживаются файлы изображений. Наш конвертер PDF в CSV предназначен для быстрого экспорта страниц без программного обеспечения для настольного конвертера.
Как работает наш конвертер PDF в CSV
Конвертер загружает ваш PDF-файл в браузер, отображает страницы с выбранным разрешением и подготавливает загружаемый вывод в формате CSV (значения, разделенные запятыми). Обработка остается локальной для вашего сеанса, что позволяет избежать загрузки документов в удаленную службу преобразования.
Параметры качества экспорта
Инструменты преобразования PDF в изображение могут предоставлять такие настройки, как разрешение, качество изображения и пакетные загрузки. Более высокие настройки обеспечивают более четкое изображение для печати и подробного просмотра, а более низкие настройки создают файлы меньшего размера для быстрого обмена.
Структура выходного файла CSV (значения, разделенные запятыми)
Каждый экспортированный файл представляет собой обработанную PDF-страницу в виде отдельного изображения в формате CSV (значения, разделенные запятыми). Это делает результат полезным для миниатюр, предварительного просмотра, снимков экрана, визуального обзора, повторного использования контента и систем, которые не принимают полную загрузку PDF-файлов.
Как открыть файлы CSV (значения, разделенные запятыми): Файлы CSV (значения, разделенные запятыми) можно открывать на вкладках браузера, в средствах просмотра изображений, в инструментах дизайна, в потоках загрузки CMS, при предварительном просмотре операционной системы и во многих рабочих процессах с документами. Используйте экспорт ZIP, если вам нужны все страницы вместе за одну загрузку.
Часто задаваемые вопросы
Конвертер читает ваш PDF-файл локально в вашем браузере с помощью pdfjs-dist. Он извлекает все текстовые элементы с каждой страницы вместе с их координатами X/Y, а затем использует кластеризацию координат для группировки элементов в строки и столбцы. Результат записывается в виде файла CSV с использованием выбранного вами разделителя.
Поддерживаются четыре разделителя: Запятая (,) — стандартный формат CSV, используемый большинством инструментов; Точка с запятой (;) — распространена в европейских регионах, где в качестве десятичных разделителей используются запятые; Tab (\t) — создает файлы TSV (значения, разделенные табуляцией), совместимые с импортом электронных таблиц; Труба (|) — полезна, когда данные содержат запятые и точки с запятой.
Нет. Вся обработка выполняется исключительно в вашем веб-браузере с использованием клиентского JavaScript. Ваш PDF-файл никогда не загружается и никуда не передается, что обеспечивает полную конфиденциальность важных или конфиденциальных документов.
Да. Инструмент обрабатывает каждую страницу. В режиме «Один раздел на странице» каждая страница становится разделом с отдельной надписью и вкладкой в предварительном просмотре. В режиме «Объединить все страницы» весь контент объединяется в один непрерывный CSV-файл с пустыми строками, разделяющими страницы.
«Плотный» сохраняет строгие границы столбцов и строк — лучше всего подходит для плотных, хорошо структурированных таблиц. «Широкий» объединяет текстовые элементы, которые находятся дальше друг от друга, в одну ячейку или строку — это полезно для PDF-файлов со свободными интервалами или непоследовательными макетами. Начните с «Нормального» и отрегулируйте его, если вывод выглядит смещенным.
Да. После извлечения установите для параметра «Область загрузки» значение «Все страницы (объединенный файл)». Данные каждой страницы будут записаны в виде раздела, помеченного номером страницы, разделенного пустыми строками.
Нет — этот инструмент извлекает встроенный цифровой текст из файлов PDF. Отсканированные PDF-файлы, состоящие только из изображений, не содержат машиночитаемого текста. Для отсканированных документов сначала запустите наш инструмент PDF OCR, чтобы сгенерировать текст с возможностью поиска, а затем преобразуйте его в CSV.