Lompat ke konten
Aback Tools Logo

Ekstraktor Metadata PDF

Unggah PDF apa pun untuk mengekstrak semua metadata yang tertanam. Ekstraktor Metadata PDF membaca Kamus Info Dokumen (judul, penulis, subjek, kata kunci, pembuat, produser, tanggal pembuatan/modifikasi) dan metadata XMP (elemen Dublin Core, properti Adobe XMP, informasi hak, pengidentifikasi dokumen, bahasa, dan properti khusus) menggunakan pdf-lib dan pdfjs-dist. Bidang disusun berdasarkan grup sumber (Info File, Info Dokumen, Metadata XMP) dan dikategorikan berdasarkan jenis (Identitas, Konten, Tanggal, Statistik, Perangkat Lunak). Dengan pemfilteran berbasis tab, ekspor sebagai teks, deskripsi per bidang, dan indikator kesehatan - semua pemrosesan berjalan secara lokal di browser Anda tanpa unggahan. Gratis, tidak perlu mendaftar.

PDF Metadata Extractor

Upload any PDF to extract all embedded metadata, including the Document Info Dictionary (title, author, subject, keywords, creator, producer, creation/ modification dates) and XMP metadata when available. The tool uses pdf-lib and pdfjs-dist to read metadata locally - all processing runs entirely in your browser with zero uploads. No signup required.

Drop a PDF here or click to browse

Upload any PDF to extract its metadata - no file upload, all processing is local

Memahami Ekstraksi Metadata PDF

  • Apa itu Metadata PDF? Metadata PDF adalah informasi deskriptif yang tertanam di dalam file PDF yang mendokumentasikan properti file – siapa yang membuatnya, kapan dibuat, perangkat lunak apa yang digunakan, dan kata kunci untuk kategorisasi. Metadata ini disimpan di dua lokasi utama: Kamus Info Dokumen (struktur nilai kunci sederhana yang ditentukan oleh standar PDF) dan metadata XMP (Extensible Metadata Platform), standar berbasis Adobe XML yang menyediakan metadata yang lebih kaya dan lebih dapat diperluas termasuk elemen Dublin Core, informasi hak, dan properti khusus.
  • Cara Kerja Ekstraksi Metadata PDF PDF Metadata Extractor menggunakan dua perpustakaan PDF yang saling melengkapi untuk cakupan maksimum. pdf-lib membaca Kamus Info Dokumen secara langsung untuk mengekstrak penulis, judul, subjek, kata kunci, pembuat, produser, dan tanggal pembuatan/modifikasi. pdfjs-dist (perpustakaan rendering PDF Mozilla) kemudian mengekstrak metadata XMP dengan menguraikan aliran metadata XML yang tertanam, menyediakan akses ke elemen Dublin Core (dc:title, dc:creator, dc:description), properti Adobe XMP (xmp:CreateDate, xmp:ModifyDate, xmp:CreatorTool), dan informasi manajemen hak (dc:rights). Hasil dari kedua sumber digabungkan dan diatur berdasarkan grup sumber untuk kejelasan.
  • Info Dokumen vs Metadata XMP Kamus Info Dokumen adalah sistem metadata yang lebih lama dan lebih sederhana yang ditentukan dalam spesifikasi PDF. Ini mendukung serangkaian bidang tetap: Judul, Penulis, Subjek, Kata Kunci, Pencipta, Produser, Tanggal Pembuatan, dan Tanggal Mod. Metadata XMP, diperkenalkan dengan PDF 1.4 (Adobe Acrobat 5.0), menyediakan struktur yang lebih komprehensif dan dapat diperluas menggunakan XML. XMP dapat menyertakan metadata Dublin Core (judul, pembuat, deskripsi, subjek, hak, bahasa), properti Adobe PDF (produser, PDFVersion), dan ruang nama khusus. PDF modern sering kali berisi keduanya, sedangkan PDF lama mungkin hanya memiliki Kamus Info Dokumen.
  • Berbasis Browser & Pribadi Semua pemrosesan PDF berjalan sepenuhnya di browser Anda - dokumen Anda tidak pernah diunggah ke server mana pun. Alat ini menggunakan pdf-lib untuk membaca Kamus Info Dokumen dan pdfjs-dist untuk mengekstrak metadata XMP, keduanya berjalan secara lokal melalui WebAssembly dan JavaScript. Hal ini membuatnya cocok untuk menganalisis PDF rahasia, dokumen hukum, kontrak, dan file bisnis sensitif tanpa masalah privasi apa pun. Tidak ada pendaftaran, tidak ada pengumpulan data, tidak ada pelacakan penggunaan.

Pertanyaan yang Sering Diajukan

Ekstraktor Metadata PDF membaca metadata tersembunyi yang tertanam dalam file PDF dan menampilkannya dalam format yang dapat dibaca. Ini termasuk Kamus Info Dokumen (judul, penulis, subjek, kata kunci, pembuat, produser, tanggal pembuatan/modifikasi) dan metadata XMP (elemen Dublin Core, properti Adobe XMP, informasi hak). Metadata ini tidak terlihat saat melihat konten PDF dan dapat mengungkapkan informasi berharga tentang asal usul dan sejarah dokumen.

Kamus Info Dokumen adalah penyimpanan metadata nilai kunci sederhana yang ditentukan dalam spesifikasi PDF, mendukung serangkaian bidang tetap seperti Judul, Penulis, Subjek, dan Kata Kunci. XMP (Extensible Metadata Platform) adalah standar berbasis XML yang menyediakan metadata yang lebih kaya dan dapat diperluas termasuk elemen Dublin Core, properti khusus, manajemen hak, dan informasi asal. PDF modern sering kali berisi keduanya, dengan XMP menyediakan metadata yang lebih komprehensif.

Dari Kamus Info Dokumen: judul, pengarang, subjek, kata kunci, lamaran pembuat, lamaran produser, tanggal pembuatan, dan tanggal modifikasi. Dari metadata XMP: judul, penulis, deskripsi, subjek, alat pembuat, tanggal pembuatan/modifikasi/metadata, pengidentifikasi dokumen, bahasa, informasi hak/hak cipta, URL sumber, dan properti ruang nama khusus apa pun. Alat ini juga mengekstrak informasi file dasar: nama file, ukuran file, versi PDF, jumlah halaman, dan status enkripsi.

Alat ini mencoba membaca metadata dari PDF terenkripsi menggunakan opsi abaikan Enkripsi pdf-lib, yang terkadang dapat mengakses Kamus Info Dokumen tanpa kata sandi. Namun, PDF yang sangat terenkripsi (AES-256) dengan akses metadata terbatas mungkin tidak dapat dibaca. Ekstraksi metadata XMP dari PDF terenkripsi biasanya memerlukan kata sandi yang benar. Alat ini akan melaporkan dengan jelas jika PDF dienkripsi.

Tidak. Semua pemrosesan terjadi sepenuhnya di browser Anda. File PDF dibaca secara lokal menggunakan File API dan diproses di memori oleh pdf-lib dan pdfjs-dist. Dokumen Anda tidak pernah keluar dari perangkat Anda - tidak ada unggahan, tidak ada pengumpulan data, tidak ada permintaan server pihak ketiga.

Bidang metadata mungkin hilang karena pembuat PDF tidak mengisinya, metadata dihapus karena alasan privasi, atau PDF dibuat dengan alat yang tidak mengisi bidang tertentu. Alat ini dengan jelas menunjukkan bidang mana yang memiliki nilai dan mana yang kosong. Indikator kesehatan (Lengkap/Sebagian/Minimal) memberikan penilaian cepat tentang berapa banyak metadata yang ditemukan.

Alat ini mendukung file PDF semua versi dari PDF 1.0 hingga spesifikasi PDF 2.0 terbaru. Versi PDF terdeteksi dari header file. Metadata XMP didukung mulai PDF 1.4 dan seterusnya. PDF lama mungkin hanya memiliki metadata Kamus Info Dokumen, yang didukung sepenuhnya.

Ya - 100% gratis, selamanya. Tanpa pendaftaran, tanpa akun, tanpa tingkat premium, tanpa batasan penggunaan, dan tanpa iklan. Analisis PDF sebanyak yang Anda perlukan. Semua pemrosesan dilakukan secara lokal di browser Anda tanpa biaya server.