PDF-zu-JSON-Konverter
Extrahieren Sie die vollständige Inhaltsstruktur jeder PDF-Datei in sauberes, strukturiertes JSON. Erhalten Sie Textelemente mit Koordinaten, gruppierten Zeilen, Seitenabmessungen und Dokumentmetadaten – alles lokal in Ihrem Browser verarbeitet, ohne Server-Uploads. Wählen Sie aus drei Ausgabemodi und laden Sie das Ergebnis herunter oder kopieren Sie es.
No PDF loaded
Upload a PDF above to extract its content as JSON.
Was ist die Konvertierung von PDF in JSON?
Bei der PDF-zu-JSON-Konvertierung wird jede ausgewählte PDF-Seite in eine JSON-Datei gerendert, die überall dort geöffnet, bearbeitet, geteilt oder eingebettet werden kann, wo Bilddateien unterstützt werden. Unser PDF-zu-JSON-Konverter ist für den schnellen Seitenexport ohne Desktop-Konvertersoftware konzipiert.
So funktioniert unser PDF-zu-JSON-Konverter
Der Konverter lädt Ihre PDF-Datei in den Browser, rendert Seiten in der ausgewählten Auflösung und bereitet die herunterladbare JSON-Ausgabe vor. Die Verarbeitung bleibt lokal in Ihrer Sitzung, wodurch das Hochladen von Dokumenten zu einem Remote-Konvertierungsdienst vermieden wird.
Qualitätsoptionen exportieren
PDF-to-Image-Tools können Einstellungen wie DPI, Bildqualität und gebündelte Downloads offenlegen. Höhere Einstellungen erzeugen eine schärfere Ausgabe zum Drucken und zur detaillierten Überprüfung, während niedrigere Einstellungen kleinere Dateien für eine schnelle Weitergabe erstellen.
Struktur der JSON-Ausgabedatei
Jede exportierte Datei stellt eine gerenderte PDF-Seite als eigenständiges JSON-Bild dar. Dadurch ist das Ergebnis nützlich für Miniaturansichten, Vorschauen, Screenshots, visuelle Überprüfung, Wiederverwendung von Inhalten und Systeme, die keine vollständigen PDF-Uploads akzeptieren.
So öffnen Sie JSON-Dateien: JSON-Dateien können in Browser-Registerkarten, Bildbetrachtern, Design-Tools, CMS-Upload-Flows, Betriebssystemvorschauen und vielen Dokument-Workflows geöffnet werden. Nutzen Sie den ZIP-Export, wenn Sie alle Seiten zusammen in einem Download benötigen.
Häufig gestellte Fragen
Das Tool extrahiert die vollständige Inhaltsstruktur Ihrer PDF-Datei in ein JSON-Dokument. Im strukturierten Modus umfasst dies: Dokumentmetadaten (Titel, Autor, Datum), Seitenabmessungen, einzelne Textelemente mit X/Y-Koordinaten und Schriftgrößen, gruppierte Textzeilen und ein Nur-Text-Transkript. Kompaktmodi geben nur Zeilen oder nur Text aus.
„Strukturiert“ bietet die meisten Details – Metadaten, seitenbezogene Elemente mit Koordinaten, gruppierte Zeilen und Text. „Nur Zeilen“ ist kompakter und gibt Y-gruppierte Textzeilen pro Seite aus. „Nur Text“ ist die minimalste Option und stellt nur eine reine Textzeichenfolge pro Seite bereit. Verwenden Sie Structured für Entwickler, die präzise Layoutdaten benötigen, und Text für die einfache Inhaltsextraktion.
Ja. Verwenden Sie das Feld „Seitenbereich“, um anzugeben, welche Seiten extrahiert werden sollen. Geben Sie für jede Seite „alle“, eine einzelne Seitennummer wie „3“, durch Kommas getrennte Seiten wie „1,3,7“ oder Bereiche wie „2–5“ ein. Sie können diese kombinieren: „1,3-5,8“ extrahiert die Seiten 1, 3, 4, 5 und 8.
Nein. Die gesamte Extraktion erfolgt vollständig in Ihrem Webbrowser mit clientseitigem JavaScript (pdfjs-dist). Ihre PDF-Datei wird niemals auf einen Server hochgeladen oder übertragen.
Bei Aktivierung im strukturierten Modus enthält jedes Textelement in der JSON-Ausgabe seine X- und Y-Position auf der Seite (in Punkten, vom Ursprung unten links) sowie Breite, Höhe und Schriftgröße. Dies ist nützlich für eine präzise Layoutanalyse, die Erkennung von Begrenzungsrahmen oder die programmgesteuerte Replikation des PDF-Layouts.
Ja. Wählen Sie in der JSON-Formateinstellung zwischen 2-Leerzeichen-Einzug (Standard), 4-Leerzeichen-Einzug oder Minimiert (kein Leerzeichen). Die minimierte Ausgabe ist ideal für die programmatische Nutzung. Eine eingerückte Ausgabe ist für die menschliche Überprüfung einfacher.
Nur teilweise – das Tool extrahiert eingebetteten digitalen Text. Wenn es sich bei einer PDF-Datei um ein gescanntes Bild handelt, werden seine Seiten in der Ausgabe mit leeren Elementarrays und ohne Text angezeigt. Führen Sie die PDF-Datei zunächst durch ein OCR-Tool aus, um eingebetteten Text zu generieren, bevor Sie sie in JSON konvertieren.