Saltar al contenido
Aback Tools Logo

Convertidor de PDF a JSON

Extraiga la estructura de contenido completa de cualquier archivo PDF en un JSON limpio y estructurado. Obtenga elementos de texto con coordenadas, líneas agrupadas, dimensiones de página y metadatos de documentos, todo procesado localmente en su navegador sin cargas en el servidor. Elija entre tres modos de salida y descargue o copie el resultado.

No PDF loaded

Upload a PDF above to extract its content as JSON.

¿Qué es la conversión de PDF a JSON?

La conversión de PDF a JSON convierte cada página PDF seleccionada en un archivo json que se puede abrir, editar, compartir o incrustar en cualquier lugar donde se admitan archivos de imagen. Nuestro conversor de pdf a json está diseñado para exportar páginas rápidamente sin un software de conversión de escritorio.

Cómo funciona nuestro convertidor de PDF a JSON

El convertidor carga su PDF en el navegador, representa las páginas con la resolución seleccionada y prepara la salida json descargable. El procesamiento permanece local en su sesión, lo que evita cargar documentos a un servicio de conversión remota.

Opciones de calidad de exportación

Las herramientas de conversión de PDF a imagen pueden exponer configuraciones como DPI, calidad de imagen y descargas incluidas. Las configuraciones más altas producen resultados más nítidos para impresión y revisión detallada, mientras que las configuraciones más bajas crean archivos más pequeños para compartirlos rápidamente.

Estructura del archivo JSON de salida

Cada archivo exportado representa una página PDF renderizada como una imagen json independiente. Esto hace que el resultado sea útil para miniaturas, vistas previas, capturas de pantalla, revisión visual, reutilización de contenido y sistemas que no aceptan cargas de PDF completos.

Cómo abrir archivos JSON: los archivos JSON se pueden abrir en pestañas del navegador, visores de imágenes, herramientas de diseño, flujos de carga de CMS, vistas previas del sistema operativo y muchos flujos de trabajo de documentos. Utilice la exportación ZIP cuando necesite todas las páginas juntas en una sola descarga.

Preguntas frecuentes

La herramienta extrae la estructura de contenido completa de su PDF en un documento JSON. En el modo estructurado, esto incluye: metadatos del documento (título, autor, fechas), dimensiones por página, elementos de texto individuales con coordenadas X/Y y tamaños de fuente, líneas de texto agrupadas y una transcripción de texto sin formato. Los modos compactos generan solo líneas o solo texto.

"Estructurado" proporciona la mayor cantidad de detalles: metadatos, elementos por página con coordenadas, líneas agrupadas y texto. "Solo líneas" es más compacto y genera filas de texto agrupadas en Y por página. "Solo texto" es el mínimo y proporciona solo una cadena de texto sin formato por página. Utilice Estructurado para desarrolladores que necesiten datos de diseño precisos y Texto para una extracción de contenido sencilla.

Sí. Utilice el campo Rango de páginas para especificar qué páginas extraer. Ingrese "todos" para cada página, un único número de página como "3", páginas separadas por comas como "1,3,7" o rangos como "2-5". Puede combinar estos: "1,3-5,8" extrae las páginas 1, 3, 4, 5 y 8.

No. Toda la extracción se ejecuta completamente en su navegador web utilizando JavaScript del lado del cliente (pdfjs-dist). Su archivo PDF nunca se carga ni se transmite a ningún servidor.

Cuando está habilitado en modo estructurado, cada elemento de texto en la salida JSON incluye su posición X e Y en la página (en puntos, desde el origen inferior izquierdo), así como el ancho, alto y tamaño de fuente. Esto es útil para un análisis de diseño preciso, la detección de cuadros delimitadores o la replicación del diseño de PDF mediante programación.

Sí. Elija entre sangría de 2 espacios (predeterminada), sangría de 4 espacios o Minificada (sin espacios en blanco) en la configuración de Formato JSON. La producción minimizada es ideal para el consumo programático; La salida sangrada es más fácil para la revisión humana.

Sólo parcialmente: la herramienta extrae el texto digital incrustado. Si un PDF es una imagen escaneada, sus páginas aparecerán en el resultado con matrices de elementos vacíos y sin texto. Primero ejecute el PDF a través de una herramienta OCR para generar texto incrustado antes de convertirlo a JSON.