Extrator de metadados de documentos
Carregue qualquer documento do Office (DOCX, XLSX ou PPTX) para extrair todos os metadados ocultos. O Document Metadata Extractor lê a estrutura ZIP interna e analisa os arquivos de metadados XML (docProps/core.xml e docProps/app.xml) para exibir informações do autor, datas de criação, histórico de revisões, estatísticas do documento, detalhes da empresa e propriedades personalizadas. Os campos são organizados por namespace (Arquivo, Núcleo, Aplicativo, Personalizado) e categorizados por tipo (Identidade, Conteúdo, Datas, Estatísticas, Software). Com filtragem baseada em guias, exportação como texto e uma divisão clara campo por campo - todo o processamento é executado localmente em seu navegador, sem uploads. Gratuito, sem necessidade de inscrição.
Upload any Office document (DOCX, XLSX, or PPTX) to extract all embedded metadata. The tool reads the internal ZIP structure and parses the XML metadata files to find author information, creation dates, revision history, document statistics, and more. All processing runs entirely in your browser - no uploads, no signup required.
Drop an Office document here or click to browse
Supports DOCX, XLSX, and PPTX files - no file upload
Sobre
- O que são metadados de documentos? Os metadados do documento são informações incorporadas armazenadas em arquivos do Office que descrevem as propriedades do documento: quem o criou, quando foi criado, qual software foi usado e estatísticas sobre seu conteúdo. Esses metadados são armazenados em arquivos XML no pacote Office Open XML (ZIP) e são separados do conteúdo visível do documento.
- Como funciona a extração de metadados Os arquivos Office Open XML (DOCX, XLSX, PPTX) são arquivos ZIP que contêm arquivos XML que definem a estrutura do documento. O Document Metadata Extractor abre esses arquivos ZIP usando JSZip, lê os arquivos docProps/core.xml (metadados do Dublin Core) e docProps/app.xml (propriedades específicas do aplicativo) e os analisa com o analisador fast-xml para extrair todos os campos de metadados.
- Tipos de metadados encontrados Os metadados principais incluem: título, assunto, criador, palavras-chave, descrição, última modificação por, número de revisão, categoria, status do conteúdo, carimbos de data/hora criados/modificados e idioma. Os metadados do aplicativo incluem: nome e versão do aplicativo, tempo total de edição, contagens de páginas/palavras/caracteres (Word), slides/notas/slides ocultos (PowerPoint), empresa e gerente.
- Baseado em navegador e privado Todo o processamento é executado inteiramente em seu navegador - seus documentos nunca são carregados em nenhum servidor. A ferramenta usa JSZip para ler a estrutura ZIP e analisar arquivos de metadados XML localmente. Isso o torna adequado para analisar documentos confidenciais, arquivos jurídicos e dados comerciais confidenciais sem quaisquer preocupações com privacidade.
Perguntas frequentes
Um extrator de metadados de documentos lê os metadados ocultos incorporados em documentos do Office (DOCX, XLSX, PPTX) e os exibe em um formato legível. Esses metadados incluem nomes de autores, datas de criação, histórico de revisões, estatísticas de documentos, informações da empresa e versão do aplicativo – informações que não são visíveis no próprio conteúdo do documento.
A ferramenta oferece suporte aos formatos Office Open XML: DOCX (documentos do Word), XLSX (planilhas do Excel) e PPTX (apresentações do PowerPoint). Os formatos binários mais antigos (DOC, XLS, PPT) não são suportados diretamente, embora alguns possam conter metadados compatíveis se forem convertidos de formatos mais recentes.
Os metadados principais incluem: título, assunto, criador/autor, palavras-chave, descrição, última modificação por, número de revisão, categoria, status do conteúdo, idioma e carimbos de data/hora de criação/modificação. Os metadados do aplicativo incluem: nome e versão do aplicativo, tempo total de edição, contagens de páginas/palavras/caracteres/parágrafos (Word), slides/notas/slides ocultos (PowerPoint), planilhas (Excel), nome da empresa e gerente. As propriedades customizadas também são extraídas quando presentes.
A ferramenta pode extrair metadados de qualquer arquivo Office Open XML padrão que não seja criptografado ou protegido por senha. Arquivos protegidos por senha ou criptografados não podem ser abertos porque o conteúdo ZIP está criptografado. Arquivos protegidos com IRM (Gerenciamento de Direitos de Informação) também podem estar inacessíveis.
Não. Todo o processamento acontece inteiramente no seu navegador. O arquivo é lido localmente usando a API File e o JSZip extrai o conteúdo ZIP na memória. Seus documentos nunca saem do seu dispositivo - sem uploads, sem registro de dados, sem solicitações de terceiros.
Os campos de metadados podem estar faltando porque o autor não os preencheu, o documento foi criado com software que não preenche determinados campos ou os metadados foram removidos intencionalmente por motivos de privacidade. A ferramenta mostra todos os campos que encontra e marca claramente quais não estão presentes.
Esta ferramenta é somente leitura. Para remover metadados de documentos, você pode usar a ferramenta Document Metadata Remover (incluída neste pacote) ou usar o recurso Inspetor de Documentos integrado dos aplicativos do Office.
Sim - 100% grátis, para sempre. Sem inscrição, sem conta, sem nível premium, sem limites de uso e sem anúncios. Analise quantos documentos você precisar. Todo o processamento é feito localmente no seu navegador.