Eingebettete Dateien extrahieren
Finden und bergen Sie versteckte Anhänge, Datenblätter und XML-Rechnungsdokumente, die in Ihren PDF-Dateien eingebettet sind.
Extraction Settings
Files are scanned and extracted directly within your browser. Select options below to download.
Upload a PDF to scan attachments
Upload a PDF to parse its catalog attachments.
Warum „Eingebettete Dateien extrahieren“ nutzen?
- Vollständiges Anhang-Parsing: durchsucht die Namensräume des PDF-Katalogs, um eingebettete Dateien in den Anhängen des Dokuments zu erkennen und zu finden.
- ZIP-Stapel-Downloads: Extrahieren Sie alle Anhänge einzeln oder bündeln Sie sie sofort in einem ZIP-Archiv, um Zeit zu sparen.
- Datenschutzorientierte Sandbox: Anhang-Parsing und binäre Extraktion erfolgen lokal in Ihrem Browser. Keine Daten verlassen Ihr Gerät.
- Keine Limits und schnell: Verarbeiten und laden Sie Dateien ohne Registrierung, Warteschlangen, Größenbeschränkungen oder Wasserzeichen.
Wann Sie eingebettete Dateien aus PDFs extrahieren sollten
- E-Rechnungsdaten extrahieren: Gewinnen Sie strukturierte ZUGFeRD- oder Factur-X-XML-Daten aus Abrechnungsdokumenten für die automatisierte Kreditorenbuchhaltung.
- Quelltabellen bergen: Extrahieren Sie Excel-Tabellen, CSV-Daten oder Forschungsblätter aus Publikations-PDFs.
- Design-Assets entpacken: Gewinnen Sie hochauflösende Bilder, Vektordateien oder CAD-Anhänge aus Layout-Portfolios.
- Zugriff auf juristische Anlagen: Öffnen Sie Beweisdateien, Medien oder Anlagen, die in juristischen Schriftsätzen gebündelt sind.
- Interaktive Medien öffnen: Extrahieren Sie Trainings-Audio, Videoclips oder Beispielskripte aus interaktiven Schulungspaketen.
- Versteckte Dateien prüfen: Untersuchen Sie eingehende PDFs, um eingebettete Anhänge auf Sicherheit und Compliance zu prüfen.
Was sind eingebettete Dateien in PDFs?
Eine eingebettete Datei (auch Anhang genannt) ist jede Datei - etwa eine Tabelle, ein Bild, ein XML-Dokument oder ein ZIP-Archiv -, die direkt in der binären Struktur eines PDF-Dokuments gespeichert ist. Anders als Bilder oder Textblöcke, die im visuellen Seitenlayout gerendert werden, liegen eingebettete Dateien als rohe Binärströme vor, die mit dem internen PDF-Katalog verknüpft sind - ähnlich wie E-Mail-Anhänge.
Wie die Extraktionspipeline funktioniert
Dieses Tool nutzt `pdfjs-dist`, um den Catalog-Namensraum des PDF-Dokuments zu parsen. Genauer gesagt löst es das `/Names`-Dictionary auf, indem es den Namensbaum `/EmbeddedFiles` abfragt. Dieser Namensraum enthält Verweise auf alle Spezifikationen eingebetteter Dateien. Das Tool ermittelt Name, Dateigröße und rohen Binärpuffer (Uint8Array) jedes Anhangs und ermöglicht so direkte Client-Downloads oder das Packen in ein ZIP-Archiv.
Vertraulichkeit und lokales Parsing
Viele PDF-Tools laden Ihre Dokumente in externe Cloud-Systeme hoch, was für Unternehmensdokumente ein ernstes Sicherheitsrisiko darstellt. Unser Tool arbeitet vollständig im Browser. Das gesamte binäre Parsing und Entpacken erfolgt lokal im Browser-Thread Ihres Geräts, sodass Finanztabellen, Rechnungen oder Verträge zu 100 % vertraulich bleiben.
Unterstützung der Standards ZUGFeRD & Factur-X
In europäischen Abrechnungsvorgaben (etwa ZUGFeRD und Factur-X) werden Rechnungen als hybride PDF/A-Dokumente versendet. Diese Dateien enthalten ein menschenlesbares visuelles PDF-Layout und eine eingebettete XML-Datei mit den strukturierten Daten. Unser Tool extrahiert diese zugrunde liegende XML-Datei mühelos, sodass die Daten schnell in Buchhaltungssoftware importiert werden können.
Unterschied zu Hyperlinks: Hyperlinks in einem PDF verweisen auf externe Web-URLs oder Anker auf anderen Seiten und benötigen eine Internetverbindung sowie externe Browser-Tabs. Eingebettete Dateien hingegen sind im PDF-Dokument selbst enthalten. So werden Anhänge immer mit dem Haupt-PDF ausgeliefert und sind vollständig offline zugänglich.
Häufig gestellte Fragen
Dieses Tool durchsucht die interne Struktur eines PDF-Dokuments nach versteckten Anhängen oder eingebetteten Dateien. Sie können einzelne Dateien herunterladen oder sie in einem ZIP-Archiv bündeln.
Jedes im PDF eingebettete Dateiformat (CSV-/XLSX-Tabellen, Bilder, Word-Dokumente, Codedateien, XML-Daten oder andere PDFs) lässt sich im ursprünglichen Binärformat extrahieren.
Ja. Die Extraktion läuft zu 100 % lokal in Ihrem Webbrowser. Es werden keine Dateien auf einen Server hochgeladen oder extern verarbeitet - vollständige Privatsphäre.
Ja, es kann die eingebetteten strukturierten Rechnungs-XML-Dateien (wie factur-x.xml oder zugferd-invoice.xml) in PDFs für die elektronische Rechnungsstellung finden und extrahieren.
Standard-PDF-Renderer in Browsern priorisieren Dokumentlayout und Seiten und ignorieren den Anhangskatalog. Dieses Tool macht diese versteckten Dateien sichtbar und herunterladbar.
Ja. Das Tool „Eingebettete Dateien extrahieren“ ist zu 100 % kostenlos - ohne Registrierung, Wasserzeichen oder Dateilimits.