Извлечь встроенные файлы
Находите и извлекайте скрытые вложения, таблицы данных и XML-документы счетов, встроенные в ваши PDF-файлы.
Extraction Settings
Files are scanned and extracted directly within your browser. Select options below to download.
Upload a PDF to scan attachments
Upload a PDF to parse its catalog attachments.
Зачем использовать «Извлечь встроенные файлы»?
- Полный разбор вложений: сканирует пространства имён каталога PDF, чтобы обнаружить и найти любые файлы, встроенные в качестве вложений документа.
- Пакетные ZIP-загрузки: извлекайте все вложения по отдельности или мгновенно собирайте их в один ZIP-архив, экономя время.
- Песочница с приоритетом приватности: разбор вложений и бинарное извлечение происходят локально в браузере. Данные не покидают устройство.
- Без ограничений и быстро: обрабатывайте и скачивайте файлы без регистрации, очередей, ограничений размера и водяных знаков.
Когда извлекать встроенные файлы из PDF
- Извлечение данных электронных счетов: восстанавливайте структурированные XML-данные ZUGFeRD или Factur-X из расчётных документов для автоматизации кредиторской задолженности.
- Восстановление исходных таблиц: извлекайте Excel-файлы, CSV-данные или исследовательские таблицы, вложенные в PDF публикаций.
- Распаковка дизайн-ресурсов: восстанавливайте изображения высокого разрешения, векторные исходники или CAD-вложения из портфолио вёрстки.
- Доступ к судебным материалам: открывайте доказательства, медиафайлы и приложения, вложенные в основные юридические документы.
- Доступ к интерактивным материалам: извлекайте учебное аудио, видеоклипы и примеры скриптов из интерактивных учебных пакетов.
- Проверка скрытых файлов: изучайте входящие PDF, чтобы выявить и проверить встроенные вложения на безопасность и соответствие требованиям.
Что такое встроенные файлы в PDF?
Встроенный файл (также называемый вложением) — это любой файл (таблица, изображение, XML-документ или ZIP-архив), сохранённый прямо в бинарной структуре PDF-документа. В отличие от изображений и текстовых блоков, которые отрисовываются в визуальной вёрстке страницы, встроенные файлы хранятся как необработанные бинарные потоки, привязанные к внутреннему каталогу PDF, и работают подобно вложениям в письме.
Как работает конвейер извлечения
Инструмент использует `pdfjs-dist`, чтобы разобрать пространство имён Catalog документа PDF. В частности, он разрешает словарь `/Names`, обращаясь к дереву имён `/EmbeddedFiles`. Это пространство имён содержит ссылки на все спецификации встроенных файлов. Инструмент получает имя, размер и необработанный бинарный буфер (Uint8Array) каждого вложения, что позволяет скачивать их напрямую на клиенте или собирать в ZIP-архив.
Конфиденциальность и локальный разбор
Многие PDF-инструменты загружают документы во внешние облачные системы, что создаёт серьёзный риск для корпоративных документов. Наш инструмент работает полностью в браузере. Весь бинарный разбор и распаковка выполняются локально в потоке браузера на вашем устройстве, гарантируя 100 % конфиденциальность финансовых таблиц, счетов и договоров.
Поддержка стандартов ZUGFeRD и Factur-X
В европейских правилах выставления счетов (например, ZUGFeRD и Factur-X) счета отправляются как гибридные PDF/A-документы. Такие файлы содержат визуальную вёрстку PDF для чтения человеком и встроенный XML-файл со структурированными данными. Наш инструмент позволяет легко извлечь этот XML-файл, что обеспечивает быстрый импорт данных в бухгалтерские программы.
Отличие от гиперссылок: гиперссылки в PDF указывают на внешние веб-адреса или якоря на других страницах, для них нужны интернет и отдельные вкладки браузера. Встроенные же файлы самодостаточны и находятся внутри самого PDF. Это гарантирует, что вложения всегда распространяются вместе с основным PDF и доступны полностью офлайн.
Часто задаваемые вопросы
Этот инструмент сканирует внутреннюю структуру PDF-документа, чтобы найти скрытые вложения или встроенные файлы. Вы можете скачать файлы по отдельности или упаковать их в один ZIP-архив.
Любой формат, встроенный в PDF (таблицы CSV/XLSX, изображения, документы Word, файлы кода, XML-данные или другие PDF), извлекается в исходном бинарном виде.
Да. Извлечение выполняется на 100 % локально в вашем браузере. Файлы не загружаются на серверы и не обрабатываются извне, что обеспечивает полную приватность.
Да, он находит и извлекает встроенные структурированные XML-файлы счетов (например, factur-x.xml или zugferd-invoice.xml) из PDF для электронного выставления счетов.
Стандартные средства отображения PDF в браузерах отдают приоритет вёрстке и страницам документа, игнорируя каталог вложений. Этот инструмент делает скрытые файлы видимыми и доступными для скачивания.
Да. Инструмент «Извлечь встроенные файлы» полностью бесплатен: без регистрации, водяных знаков и ограничений на файлы.