Saltar al contenido
Aback Tools Logo

Extractor de metadatos PDF

Cargue cualquier PDF para extraer todos los metadatos incrustados. El PDF Metadata Extractor lee tanto el Diccionario de información del documento (título, autor, tema, palabras clave, creador, productor, fechas de creación/modificación) como los metadatos XMP (elementos Dublin Core, propiedades de Adobe XMP, información de derechos, identificadores de documentos, idioma y propiedades personalizadas) utilizando pdf-lib y pdfjs-dist. Los campos están organizados por grupo de origen (Información de archivo, Información de documento, Metadatos XMP) y categorizados por tipo (Identidad, Contenido, Fechas, Estadísticas, Software). Con filtrado basado en pestañas, exportación como texto, descripciones por campo y un indicador de estado: todo el procesamiento se ejecuta localmente en su navegador sin cargas. Gratis, no es necesario registrarse.

PDF Metadata Extractor

Upload any PDF to extract all embedded metadata, including the Document Info Dictionary (title, author, subject, keywords, creator, producer, creation/ modification dates) and XMP metadata when available. The tool uses pdf-lib and pdfjs-dist to read metadata locally - all processing runs entirely in your browser with zero uploads. No signup required.

Drop a PDF here or click to browse

Upload any PDF to extract its metadata - no file upload, all processing is local

Comprender la extracción de metadatos de PDF

  • ¿Qué son los metadatos PDF? Los metadatos de PDF son información descriptiva incorporada dentro de los archivos PDF que documenta las propiedades del archivo: quién lo creó, cuándo se creó, qué software se utilizó y palabras clave para la categorización. Estos metadatos se almacenan en dos ubicaciones principales: el Diccionario de información del documento (una estructura clave-valor simple especificada por el estándar PDF) y los metadatos XMP (Plataforma de metadatos extensible), un estándar basado en Adobe XML que proporciona metadatos más ricos y extensibles que incluyen elementos Dublin Core, información de derechos y propiedades personalizadas.
  • Cómo funciona la extracción de metadatos de PDF PDF Metadata Extractor utiliza dos bibliotecas de PDF complementarias para una cobertura máxima. pdf-lib lee el Diccionario de información del documento directamente para extraer autor, título, tema, palabras clave, creador, productor y fechas de creación/modificación. pdfjs-dist (la biblioteca de renderizado de PDF de Mozilla) luego extrae metadatos XMP analizando el flujo de metadatos XML incrustado, brindando acceso a elementos Dublin Core (dc:title, dc:creator, dc:description), propiedades de Adobe XMP (xmp:CreateDate, xmp:ModifyDate, xmp:CreatorTool) e información de administración de derechos (dc:rights). Los resultados de ambas fuentes se fusionan y organizan por grupo de fuentes para mayor claridad.
  • Información del documento frente a metadatos XMP El Diccionario de información del documento es el sistema de metadatos más antiguo y simple definido en la especificación PDF. Admite un conjunto fijo de campos: Título, Autor, Asunto, Palabras clave, Creador, Productor, Fecha de creación y Fecha de modificación. Los metadatos XMP, introducidos con PDF 1.4 (Adobe Acrobat 5.0), proporcionan una estructura más completa y extensible utilizando XML. XMP puede incluir metadatos de Dublin Core (título, creador, descripción, tema, derechos, idioma), propiedades de Adobe PDF (productor, versión PDF) y espacios de nombres personalizados. Los PDF modernos suelen contener ambos, mientras que es posible que los PDF más antiguos solo tengan el Diccionario de información del documento.
  • Basado en navegador y privado Todo el procesamiento de PDF se ejecuta completamente en su navegador: sus documentos nunca se cargan en ningún servidor. La herramienta utiliza pdf-lib para leer el Diccionario de información del documento y pdfjs-dist para extraer metadatos XMP, ambos ejecutándose localmente a través de WebAssembly y JavaScript. Esto lo hace adecuado para analizar archivos PDF confidenciales, documentos legales, contratos y archivos comerciales confidenciales sin ningún problema de privacidad. Sin registro, sin recopilación de datos, sin seguimiento de uso.

Preguntas frecuentes

Un extractor de metadatos PDF lee los metadatos ocultos incrustados en archivos PDF y los muestra en un formato legible. Esto incluye el Diccionario de información del documento (título, autor, tema, palabras clave, creador, productor, fechas de creación/modificación) y metadatos XMP (elementos Dublin Core, propiedades de Adobe XMP, información de derechos). Estos metadatos no son visibles al visualizar el contenido del PDF y pueden revelar información valiosa sobre el origen y el historial del documento.

El Diccionario de información del documento es un almacén de metadatos de valores clave simple definido en la especificación PDF, que admite un conjunto fijo de campos como Título, Autor, Asunto y Palabras clave. XMP (Plataforma de metadatos extensible) es un estándar basado en XML que proporciona metadatos más completos y extensibles, incluidos elementos Dublin Core, propiedades personalizadas, gestión de derechos e información de procedencia. Los PDF modernos suelen contener ambos, y XMP proporciona metadatos más completos.

Del Diccionario de información del documento: título, autor, tema, palabras clave, solicitud de creador, solicitud de productor, fecha de creación y fecha de modificación. De metadatos XMP: título, autor, descripción, tema, herramienta de creación, fechas de creación/modificación/metadatos, identificador de documento, idioma, información de derechos/derechos de autor, URL de origen y cualquier propiedad de espacio de nombres personalizado. La herramienta también extrae información básica del archivo: nombre del archivo, tamaño del archivo, versión del PDF, recuento de páginas y estado de cifrado.

La herramienta intenta leer metadatos de archivos PDF cifrados utilizando la opción ignoreEncryption de pdf-lib, que a veces puede acceder al Diccionario de información del documento sin la contraseña. Sin embargo, es posible que los archivos PDF fuertemente cifrados (AES-256) con acceso restringido a metadatos no sean legibles. La extracción de metadatos XMP de archivos PDF cifrados normalmente requiere la contraseña correcta. La herramienta informará claramente si un PDF está cifrado.

No. Todo el procesamiento se realiza íntegramente en su navegador. El archivo PDF se lee localmente utilizando File API y se procesa en la memoria mediante pdf-lib y pdfjs-dist. Sus documentos nunca salen de su dispositivo: sin cargas, sin recopilación de datos, sin solicitudes de servidores de terceros.

Es posible que falten campos de metadatos porque el creador del PDF no los completó, los metadatos se eliminaron por razones de privacidad o el PDF se creó con una herramienta que no completa ciertos campos. La herramienta muestra claramente qué campos tienen valores y cuáles están vacíos. El indicador de estado (Completo/Parcial/Mínimo) proporciona una evaluación rápida de cuántos metadatos se encontraron.

La herramienta admite archivos PDF de todas las versiones, desde PDF 1.0 hasta la última especificación PDF 2.0. La versión PDF se detecta desde el encabezado del archivo. Los metadatos XMP son compatibles desde PDF 1.4 en adelante. Es posible que los archivos PDF más antiguos solo tengan metadatos del Diccionario de información del documento, que es totalmente compatible.

Sí, 100% gratis, para siempre. Sin registro, sin cuenta, sin nivel premium, sin límites de uso y sin anuncios. Analice tantos archivos PDF como necesite. Todo el procesamiento se realiza localmente en su navegador sin costos de servidor.