Extractor de metadatos de documentos
Cargue cualquier documento de Office (DOCX, XLSX o PPTX) para extraer todos los metadatos ocultos. El Extractor de metadatos de documentos lee la estructura ZIP interna y analiza los archivos de metadatos XML (docProps/core.xml y docProps/app.xml) para mostrar información del autor, fechas de creación, historial de revisiones, estadísticas de documentos, detalles de la empresa y propiedades personalizadas. Los campos están organizados por espacio de nombres (Archivo, Núcleo, Aplicación, Personalizado) y categorizados por tipo (Identidad, Contenido, Fechas, Estadísticas, Software). Con filtrado basado en pestañas, exportación como texto y un desglose claro campo por campo, todo el procesamiento se ejecuta localmente en su navegador sin cargas. Gratis, no es necesario registrarse.
Upload any Office document (DOCX, XLSX, or PPTX) to extract all embedded metadata. The tool reads the internal ZIP structure and parses the XML metadata files to find author information, creation dates, revision history, document statistics, and more. All processing runs entirely in your browser - no uploads, no signup required.
Drop an Office document here or click to browse
Supports DOCX, XLSX, and PPTX files - no file upload
Acerca de
- ¿Qué son los metadatos de documentos? Los metadatos del documento son información incrustada almacenada dentro de los archivos de Office que describe las propiedades del documento: quién lo creó, cuándo se creó, qué software se utilizó y estadísticas sobre su contenido. Estos metadatos se almacenan en archivos XML dentro del paquete Office Open XML (ZIP) y están separados del contenido visible del documento.
- Cómo funciona la extracción de metadatos Los archivos XML abiertos de Office (DOCX, XLSX, PPTX) son archivos ZIP que contienen archivos XML que definen la estructura del documento. El Extractor de metadatos de documentos abre estos archivos ZIP usando JSZip, lee los archivos docProps/core.xml (metadatos de Dublin Core) y docProps/app.xml (propiedades específicas de la aplicación) y los analiza con fast-xml-parser para extraer todos los campos de metadatos.
- Tipos de metadatos encontrados Los metadatos principales incluyen: título, tema, creador, palabras clave, descripción, última modificación por, número de revisión, categoría, estado del contenido, marcas de tiempo creadas/modificadas e idioma. Los metadatos de la aplicación incluyen: nombre y versión de la aplicación, tiempo total de edición, recuento de páginas/palabras/caracteres (Word), diapositivas/notas/diapositivas ocultas (PowerPoint), empresa y administrador.
- Basado en navegador y privado Todo el procesamiento se ejecuta completamente en su navegador: sus documentos nunca se cargan en ningún servidor. La herramienta utiliza JSZip para leer la estructura ZIP y analiza archivos de metadatos XML localmente. Esto lo hace adecuado para analizar documentos confidenciales, archivos legales y datos comerciales confidenciales sin ningún problema de privacidad.
Preguntas frecuentes
Un extractor de metadatos de documentos lee los metadatos ocultos incrustados en los documentos de Office (DOCX, XLSX, PPTX) y los muestra en un formato legible. Estos metadatos incluyen nombres de autores, fechas de creación, historial de revisiones, estadísticas de documentos, información de la empresa y versión de la aplicación, información que no es visible en el contenido del documento.
La herramienta admite formatos Office Open XML: DOCX (documentos de Word), XLSX (hojas de cálculo de Excel) y PPTX (presentaciones de PowerPoint). Los formatos binarios más antiguos (DOC, XLS, PPT) no son compatibles directamente, aunque algunos pueden contener metadatos compatibles si se convirtieron desde formatos más nuevos.
Los metadatos principales incluyen: título, tema, creador/autor, palabras clave, descripción, última modificación por, número de revisión, categoría, estado del contenido, idioma y marcas de tiempo de creación/modificación. Los metadatos de la aplicación incluyen: nombre y versión de la aplicación, tiempo total de edición, recuento de páginas/palabras/caracteres/párrafos (Word), diapositivas/notas/diapositivas ocultas (PowerPoint), hojas (Excel), nombre de la empresa y administrador. Las propiedades personalizadas también se extraen cuando están presentes.
La herramienta puede extraer metadatos de cualquier archivo XML abierto de Office estándar que no esté cifrado ni protegido con contraseña. Los archivos cifrados o protegidos con contraseña no se pueden abrir porque el contenido ZIP está cifrado. Los archivos protegidos con IRM (Gestión de derechos de información) también pueden resultar inaccesibles.
No. Todo el procesamiento se realiza íntegramente en su navegador. El archivo se lee localmente utilizando File API y JSZip extrae el contenido ZIP en la memoria. Sus documentos nunca salen de su dispositivo: sin cargas, sin registro de datos, sin solicitudes de terceros.
Es posible que falten campos de metadatos porque el autor no los completó, el documento se creó con software que no completa ciertos campos o los metadatos se eliminaron intencionalmente por razones de privacidad. La herramienta muestra todos los campos que encuentra y marca claramente cuáles no están presentes.
Esta herramienta es de sólo lectura. Para eliminar metadatos de documentos, puede utilizar la herramienta Eliminación de metadatos de documentos (incluida en este paquete) o utilizar la función Inspector de documentos integrada de las aplicaciones de Office.
Sí, 100% gratis, para siempre. Sin registro, sin cuenta, sin nivel premium, sin límites de uso y sin anuncios. Analiza tantos documentos como necesites. Todo el procesamiento se realiza localmente en su navegador.