Saltar al contenido
Aback Tools Logo

Extractor de PDF-JavaScript

Extraiga y analice JavaScript incrustado en archivos PDF. Cargue un PDF para escanear en busca de scripts OpenAction (se ejecutan automáticamente al abrir el documento), acciones adicionales (AA) a nivel de documento y página, entradas de JavaScript del árbol de nombres y secuencias JS sin formato. Vea el código extraído con el contexto fuente, cópielo al portapapeles o descárguelo para un análisis más detallado. Todo el procesamiento es local y privado y no es necesario registrarse.

PDF JavaScript Extractor
Extract and analyze JavaScript embedded in PDF files. Detects OpenAction auto-execute scripts, document and page-level Additional Actions (AA), Names tree JavaScript entries, and raw JS streams. View, copy, and download extracted code.

Drop your PDF here

or click to browse

Unencrypted PDF files only

Upload a PDF file to scan for embedded JavaScript. The tool detects OpenAction scripts (auto-execute on open), Additional Actions, named JavaScript entries, and raw JS streams. All processing is local — your file never leaves your device.

¿Por qué utilizar nuestro extractor de PDF JavaScript?

  • Detección de JavaScript de múltiples fuentes: Detecta JavaScript de todas las fuentes de PDF: OpenAction (ejecución automática al abrir el documento), acciones adicionales (AA) a nivel de documento y página, entradas del árbol de nombres y secuencias JS incrustadas sin formato. Ningún guión pasa desapercibido.
  • Visor de código con contexto: vea JavaScript extraído en un visor de código resaltado con sintaxis con ubicación de origen, evento desencadenante y número de página. Cada entrada muestra su origen (OpenAction, Page AA, etc.) y la condición de activación para un contexto completo.
  • Ofuscación y detección de amenazas: marca automáticamente JavaScript ofuscado o minimizado. Los scripts de OpenAction se destacan como amenazas de alta prioridad ya que se ejecutan automáticamente. Se detectan patrones sospechosos como eval(), ActiveXObject y codificación Base64.
  • 100% local del navegador y privado: todo el análisis de PDF y la extracción de JavaScript se ejecutan completamente en su navegador mediante pdfjs-dist y análisis binario sin formato. Sus archivos PDF y el código extraído nunca salen de su dispositivo. Sin cargas, sin servidores, sin seguimiento.

Casos de uso comunes para PDF JavaScript Extractor

  • Análisis de PDF de malware y phishing: los analistas de seguridad pueden escanear archivos PDF sospechosos en busca de JavaScript malicioso que se ejecute al abrirlos. Los scripts de OpenAction son un vector común para descargas no autorizadas, phishing de credenciales y entrega de malware. Identifique y extraiga rápidamente el script incrustado para su posterior análisis.
  • Auditoría de seguridad y análisis forense: audite documentos PDF en busca de acciones de JavaScript ocultas o no autorizadas. Detecte scripts de ejecución automática, activadores de validación de formularios, controladores de eventos del mouse y acciones de impresión/documento que podrían filtrar datos o modificar el comportamiento del documento sin el conocimiento del usuario.
  • Formularios PDF de ingeniería inversa: extraiga y analice JavaScript de formularios PDF con scripts complejos de validación, cálculo o formato. Comprenda cómo interactúan los campos del formulario, qué datos se procesan y si el formulario realiza solicitudes de red u operaciones de archivos.
  • Investigación y pruebas de vulnerabilidades: los investigadores pueden examinar JavaScript basado en PDF en busca de vulnerabilidades de complementos del navegador, intentos de escape de la zona de pruebas y uso inusual de API. Extraiga y estudie muestras de JavaScript en PDF del mundo real para la investigación de vulnerabilidades y el desarrollo de reglas de detección.
  • Preparación para la desinfección de documentos: antes de desinfectar un PDF, utilice esta herramienta para localizar y revisar todo el JavaScript incrustado. Comprenda qué hace cada script para que pueda decidir si conservarlo o eliminarlo. Combina perfectamente con herramientas de desinfección de PDF para una limpieza exhaustiva de documentos.
  • Educación y capacitación: aprenda sobre los aspectos internos de JavaScript de PDF examinando ejemplos reales. Comprenda OpenAction, acciones adicionales y entradas de JavaScript con nombre. Un recurso valioso para cursos de seguridad, capacitación en ciencia forense digital y educación en formato PDF.

¿Qué es PDF JavaScript?

PDF JavaScript es una función de secuencias de comandos definida en la especificación PDF que permite a los desarrolladores incrustar código JavaScript en documentos PDF. Este código puede responder a eventos de documentos (apertura, cierre, impresión), eventos de página (entrada, salida), eventos de formulario (presiones de teclas, cambios de valores, formato, validación) y eventos del mouse. PDF JavaScript utiliza un subconjunto del lenguaje JavaScript con objetos adicionales específicos de Acrobat (aplicación, documento, consola, seguridad, etc.). Si bien los archivos PDF legítimos utilizan JavaScript para la validación de formularios, el cálculo automático o funciones interactivas, los autores de malware frecuentemente explotan la misma capacidad para crear archivos PDF maliciosos que se ejecutan automáticamente al abrirlos, lo que hace que la detección de JavaScript sea una capacidad de seguridad crítica.

Cómo funciona nuestro extractor de PDF JavaScript

La herramienta utiliza un enfoque doble que combina el análisis pdfjs-dist con el escaneo binario sin formato para una extracción exhaustiva de JavaScript:

  1. Extracción estructurada de pdfjs-dist: carga el PDF utilizando la biblioteca pdfjs-dist y recorre la estructura del documento para encontrar entradas de JavaScript. Esto incluye verificar el catálogo en busca de entradas OpenAction (scripts que se ejecutan cuando se abre el documento), escanear el diccionario de nombres en busca de acciones JavaScript nombradas, examinar acciones adicionales (AA) a nivel de documento para eventos de guardar/imprimir y verificar cada página en busca de entradas AA a nivel de página.
  2. Escaneo binario sin formato: analiza los bytes de PDF sin formato utilizando la coincidencia de patrones basada en expresiones regulares para encontrar palabras clave y estructuras relacionadas con JavaScript que pdfjs-dist podrían no exponer a través de su API de alto nivel. Esto incluye la búsqueda de referencias de /JavaScript, entradas de /OpenAction, diccionarios /AA que contienen acciones /JS y secuencias de contenido con patrones de código similares a JavaScript.
  3. Análisis y clasificación: cada entrada extraída se clasifica por tipo de fuente (OpenAction, DocumentAA, PageAA, NamesTree, RawStream), condición de activación y número de página. El código se analiza en busca de patrones de ofuscación y uso sospechoso de API. Los resultados se muestran en una lista ordenable con un visor de códigos para una inspección detallada.

Tipos de fuentes PDF JavaScript

  • OpenAction (crítico): la fuente más peligrosa: JavaScript que se ejecuta automáticamente cuando se abre el PDF, sin ninguna interacción del usuario. Comúnmente utilizado para la entrega de malware y ataques de phishing. Marcado instantáneamente como de alta prioridad.
  • Acciones adicionales del documento (AA): JavaScript activado por eventos a nivel de documento como WillSave, DidSave, WillPrint, DidPrint y DocumentClose. Estos scripts se ejecutan en respuesta a las acciones del usuario, pero se pueden utilizar para la filtración de datos o para un comportamiento persistente.
  • Acciones adicionales de página (AA): JavaScript adjunto a páginas específicas, activado por eventos a nivel de página como PageOpen, PageClose y entrada/salida del mouse. Puede ejecutarse mientras el usuario navega por el documento.
  • JavaScript con nombre (árbol de nombres): acciones de JavaScript registradas en el diccionario de nombres del documento con identificadores únicos. Estas pueden ser referenciadas por otras acciones o activadas mediante programación. A menudo se utiliza para lógica de forma compleja.
  • JavaScript de flujo sin formato: JavaScript detectado mediante escaneo binario sin formato de flujos comprimidos u ofuscados. Estos pueden estar incrustados en ubicaciones no estándar o utilizar una codificación que los oculte de los analizadores de alto nivel.

Privacidad y seguridad

Esta herramienta se ejecuta completamente en su navegador utilizando JavaScript del lado del cliente con pdfjs-dist para el análisis de PDF. Sus archivos PDF, todo el código JavaScript extraído, los resultados del escaneo y cualquier dato que copie nunca se cargan en ningún servidor, no se almacenan en ninguna base de datos ni se transmiten a través de la red. Todo el análisis de PDF, la coincidencia de patrones, la detección de ofuscación y la extracción de código se ejecutan localmente en su dispositivo. No hay llamadas API, seguimiento de análisis, cookies ni recopilación de datos de ningún tipo. Esto lo hace completamente seguro para analizar documentos PDF confidenciales, propietarios o potencialmente maliciosos.

Preguntas frecuentes

PDF JavaScript permite ejecutar secuencias de comandos incrustadas cuando se abre, se imprime o se interactúa con un PDF. Si bien los usos legítimos incluyen la validación de formularios, los ciberdelincuentes frecuentemente utilizan PDF JavaScript como arma para la entrega de malware y el phishing. Detectar y extraer este JavaScript es un paso crítico en el análisis de seguridad de PDF.

Un script OpenAction se ejecuta automáticamente en el momento en que se abre un PDF, sin necesidad de interacción del usuario. Esto lo convierte en el tipo de PDF JavaScript más peligroso. Los atacantes utilizan OpenAction para iniciar páginas de phishing, descargar malware o explotar vulnerabilidades del navegador.

No. Los archivos PDF cifrados no se pueden analizar porque sus estructuras internas son inaccesibles sin la contraseña. Primero debe descifrar o desbloquear el PDF antes de utilizar esta herramienta.

La herramienta busca patrones de ofuscación comunes, incluidas llamadas a eval(), creación de ActiveXObject, uso de String.fromCharCode, escapes Unicode excesivos, codificación Base64 y código minimizado. Las entradas que coinciden con múltiples patrones sospechosos se marcan como ofuscadas.

La compatibilidad con JavaScript se introdujo en PDF 1.3 (Acrobat 4.0). La herramienta funciona con todas las versiones de PDF hasta la 2.0 y puede detectar JavaScript en todo el rango de versiones.

No. La herramienta solo lee y muestra el código JavaScript extraído, nunca lo ejecuta. El código se muestra como texto sin formato en un visor de solo lectura. Está completamente seguro siempre que no ejecute el código extraído fuera de esta herramienta.

La herramienta proporciona contexto para cada entrada, incluida su fuente (OpenAction, AA, etc.), evento desencadenante y número de página. Los scripts de OpenAction se marcan automáticamente como de alta prioridad. La detección de ofuscación y la coincidencia de patrones ayudan a identificar códigos potencialmente maliciosos.

Algunos productores de PDF utilizan estructuras no estándar o compresión que ocultan JavaScript de los analizadores estándar. El escaneo binario sin formato utiliza la coincidencia de patrones de expresiones regulares en los bytes del PDF y puede detectar scripts que están ofuscados o ubicados en ubicaciones no estándar.

Sí, 100 % gratis, sin registro, sin cuenta y sin límites de uso. Escanee y extraiga JavaScript de tantos archivos PDF como desee. Todo el procesamiento es local en su navegador.