Перейти к содержимому
Aback Tools Logo

Извлечь встроенные файлы

Находите и извлекайте скрытые вложения, таблицы данных и XML-документы счетов, встроенные в ваши PDF-файлы.

Extraction Settings

Files are scanned and extracted directly within your browser. Select options below to download.

Upload a PDF to scan attachments

Upload a PDF to parse its catalog attachments.

Зачем использовать «Извлечь встроенные файлы»?

  • Полный разбор вложений: сканирует пространства имён каталога PDF, чтобы обнаружить и найти любые файлы, встроенные в качестве вложений документа.
  • Пакетные ZIP-загрузки: извлекайте все вложения по отдельности или мгновенно собирайте их в один ZIP-архив, экономя время.
  • Песочница с приоритетом приватности: разбор вложений и бинарное извлечение происходят локально в браузере. Данные не покидают устройство.
  • Без ограничений и быстро: обрабатывайте и скачивайте файлы без регистрации, очередей, ограничений размера и водяных знаков.

Когда извлекать встроенные файлы из PDF

  • Извлечение данных электронных счетов: восстанавливайте структурированные XML-данные ZUGFeRD или Factur-X из расчётных документов для автоматизации кредиторской задолженности.
  • Восстановление исходных таблиц: извлекайте Excel-файлы, CSV-данные или исследовательские таблицы, вложенные в PDF публикаций.
  • Распаковка дизайн-ресурсов: восстанавливайте изображения высокого разрешения, векторные исходники или CAD-вложения из портфолио вёрстки.
  • Доступ к судебным материалам: открывайте доказательства, медиафайлы и приложения, вложенные в основные юридические документы.
  • Доступ к интерактивным материалам: извлекайте учебное аудио, видеоклипы и примеры скриптов из интерактивных учебных пакетов.
  • Проверка скрытых файлов: изучайте входящие PDF, чтобы выявить и проверить встроенные вложения на безопасность и соответствие требованиям.

Что такое встроенные файлы в PDF?

Встроенный файл (также называемый вложением) — это любой файл (таблица, изображение, XML-документ или ZIP-архив), сохранённый прямо в бинарной структуре PDF-документа. В отличие от изображений и текстовых блоков, которые отрисовываются в визуальной вёрстке страницы, встроенные файлы хранятся как необработанные бинарные потоки, привязанные к внутреннему каталогу PDF, и работают подобно вложениям в письме.

Как работает конвейер извлечения

Инструмент использует `pdfjs-dist`, чтобы разобрать пространство имён Catalog документа PDF. В частности, он разрешает словарь `/Names`, обращаясь к дереву имён `/EmbeddedFiles`. Это пространство имён содержит ссылки на все спецификации встроенных файлов. Инструмент получает имя, размер и необработанный бинарный буфер (Uint8Array) каждого вложения, что позволяет скачивать их напрямую на клиенте или собирать в ZIP-архив.

Конфиденциальность и локальный разбор

Многие PDF-инструменты загружают документы во внешние облачные системы, что создаёт серьёзный риск для корпоративных документов. Наш инструмент работает полностью в браузере. Весь бинарный разбор и распаковка выполняются локально в потоке браузера на вашем устройстве, гарантируя 100 % конфиденциальность финансовых таблиц, счетов и договоров.

Поддержка стандартов ZUGFeRD и Factur-X

В европейских правилах выставления счетов (например, ZUGFeRD и Factur-X) счета отправляются как гибридные PDF/A-документы. Такие файлы содержат визуальную вёрстку PDF для чтения человеком и встроенный XML-файл со структурированными данными. Наш инструмент позволяет легко извлечь этот XML-файл, что обеспечивает быстрый импорт данных в бухгалтерские программы.

Отличие от гиперссылок: гиперссылки в PDF указывают на внешние веб-адреса или якоря на других страницах, для них нужны интернет и отдельные вкладки браузера. Встроенные же файлы самодостаточны и находятся внутри самого PDF. Это гарантирует, что вложения всегда распространяются вместе с основным PDF и доступны полностью офлайн.

Часто задаваемые вопросы

Этот инструмент сканирует внутреннюю структуру PDF-документа, чтобы найти скрытые вложения или встроенные файлы. Вы можете скачать файлы по отдельности или упаковать их в один ZIP-архив.

Любой формат, встроенный в PDF (таблицы CSV/XLSX, изображения, документы Word, файлы кода, XML-данные или другие PDF), извлекается в исходном бинарном виде.

Да. Извлечение выполняется на 100 % локально в вашем браузере. Файлы не загружаются на серверы и не обрабатываются извне, что обеспечивает полную приватность.

Да, он находит и извлекает встроенные структурированные XML-файлы счетов (например, factur-x.xml или zugferd-invoice.xml) из PDF для электронного выставления счетов.

Стандартные средства отображения PDF в браузерах отдают приоритет вёрстке и страницам документа, игнорируя каталог вложений. Этот инструмент делает скрытые файлы видимыми и доступными для скачивания.

Да. Инструмент «Извлечь встроенные файлы» полностью бесплатен: без регистрации, водяных знаков и ограничений на файлы.