Decodificador de flujos PDF
Inspecciona las entrañas de cualquier PDF. El decodificador de flujos PDF enumera todos los objetos de flujo del archivo, descomprime los filtros FlateDecode, LZW, ASCII85 y ASCIIHex, y muestra los operadores tipo PostScript ya decodificados, todo localmente en tu navegador y sin necesidad de subir nada a un servidor.
Drop a PDF here or click to browse
Unencrypted PDFs only
Upload a PDF to start inspecting its stream objects
Upload a PDF to inspect its content streams
¿Por qué usar nuestro decodificador de flujos PDF?
- Decodificación de flujos con varios filtros: el decodificador descomprime automáticamente flujos FlateDecode (zlib/deflate), LZWDecode, ASCII85Decode y ASCIIHexDecode para que puedas leer el contenido de operadores PDF sin software adicional.
- Explora objetos por número: navega por la tabla de objetos del PDF y salta a cualquier objeto indirecto por su número. Cada objeto de flujo muestra los metadatos de su diccionario (Length, Filter, Subtype) junto al contenido decodificado.
- 100 % privado: se ejecuta en tu navegador: todo el análisis del PDF y la decodificación de flujos se realizan localmente en tu navegador con JavaScript del lado del cliente. Tu PDF nunca sale de tu dispositivo, así que los archivos propietarios y confidenciales quedan totalmente seguros.
- Acceso instantáneo para desarrolladores, sin registro: sube cualquier PDF y empieza a inspeccionar flujos en segundos, sin cuenta, sin límite de tamaño y totalmente gratis. Ideal para depuración, ingeniería inversa y flujos de trabajo de desarrollo con PDF.
Casos de uso habituales del decodificador de flujos PDF
- Investigación de errores de renderizado PDF: inspecciona el flujo de contenido sin procesar de una página que se renderiza mal para identificar operadores mal formados, recursos ausentes o problemas de codificación que causan el fallo.
- Desarrollo de bibliotecas PDF: cuando crees bibliotecas de generación o análisis de PDF, usa el decodificador para verificar que tus flujos de salida contienen los operadores y parámetros correctos antes de probarlos en un visor.
- Inspección de contenido incrustado: decodifica flujos XObject incrustados (formularios, imágenes y patrones) para inspeccionar sus secuencias de operadores y confirmar que el subcontenido referencia los recursos correctos.
- Depuración de cadenas de filtros: identifica cadenas de varios filtros (por ejemplo, FlateDecode + ASCII85Decode) en PDF complejos y decodifica cada capa para verificar el contenido intermedio y final.
- Investigación de seguridad en PDF: examina flujos de contenido en PDF sospechosos para identificar JavaScript ofuscado, scripts incrustados o secuencias de operadores inusuales que puedan indicar contenido malicioso.
- Prototipado de extracción de datos: usa el contenido decodificado para entender la disposición de operadores de un PDF antes de crear un analizador que extraiga posiciones de texto, cambios de fuente o comandos de dibujo de forma programática.
¿Qué es un flujo de contenido PDF?
Dentro de todo documento PDF, el contenido de la página se codifica como uno o varios flujos de contenido: secuencias de operadores tipo PostScript almacenadas en objetos binarios comprimidos. Estos flujos contienen instrucciones para renderizar texto (bloques BT/ET), dibujar trazados (m, l, c, h), definir colores (sc, scn, g, k), mostrar imágenes (Do) y transformar el estado gráfico (q, Q, cm). Antes de decodificarlos, los flujos se comprimen con filtros como FlateDecode (zlib deflate), LZWDecode , ASCII85Decode o combinaciones en cadena de estos. Un decodificador de flujos PDF descomprime estos filtros y presenta el texto de operadores sin procesar para inspección humana.
Cómo funciona nuestro decodificador de flujos PDF
- Subir: arrastra tu PDF a la herramienta. El binario sin procesar se analiza en tu navegador para extraer todos los objetos indirectos y sus entradas de referencia cruzada, sin necesidad de subirlo a un servidor.
- Explorar: la lista de objetos muestra cada objeto de flujo con su número de objeto, longitud del flujo, cadena de filtros y tipo de diccionario. Filtra por palabra clave para encontrar objetos concretos.
- Decodificar: selecciona cualquier objeto para descomprimir su flujo. Los filtros FlateDecode, LZWDecode, ASCII85 y ASCIIHex se aplican en el orden correcto. El contenido decodificado se muestra en un visor monoespaciado con opciones de copiar y descargar.
Filtros compatibles y salida
- FlateDecode: flujos comprimidos con zlib/deflate, el filtro más común en los PDF modernos. Se decodifica a texto de operadores sin procesar.
- LZWDecode: compresión Lempel-Ziv-Welch heredada que se usa en PDF antiguos. Se decodifica a texto de operadores sin procesar.
- ASCII85Decode / ASCIIHexDecode: envoltorios de codificación ASCII para datos binarios. Se decodifican a los bytes subyacentes o al texto de operadores.
- Filtros de imagen binaria: DCTDecode (JPEG), JPXDecode, CCITTFaxDecode, JBIG2Decode: se marcan como datos de imagen binaria y no se muestran como texto.
Privacidad y público objetivo
El decodificador de flujos PDF es una herramienta para desarrolladores y usuarios avanzados pensada para depurar PDF, desarrollar bibliotecas, investigar seguridad y prototipar extracción de datos. Toda la decodificación se ejecuta localmente en tu navegador: tu PDF nunca sale de tu dispositivo. Nota: esta herramienta lee la capa de codificación sin procesar del PDF y no sustituye a un visor completo conforme a la especificación PDF. Algunas cadenas de filtros complejas o la compresión de flujos de objetos (ObjStm) pueden no resolverse del todo en todos los casos.
Preguntas frecuentes
Un flujo de contenido PDF es una secuencia comprimida de operadores que describe el contenido de la página: texto, trazados, colores e imágenes. Al decodificarlo, los operadores tipo PostScript sin procesar se vuelven legibles para las personas.
El decodificador de flujos PDF admite FlateDecode (zlib/deflate), LZWDecode, ASCII85Decode y ASCIIHexDecode. Las cadenas de varios filtros se decodifican en orden. Los filtros binarios de imagen (DCTDecode, JPXDecode) se marcan como binarios.
Algunos flujos contienen datos de imagen comprimidos (JPEG, JBIG2) que no son legibles por humanos ni siquiera después de decodificarlos. Estos se marcan como binarios en lugar de mostrar bytes sin procesar.
No. Todo el decodificador de flujos PDF funciona localmente en tu navegador con JavaScript del lado del cliente. Tu PDF nunca se transmite a ningún servidor externo.
Usa el campo de filtro para buscar objetos de tipo «Page». Los flujos de contenido de página suelen aparecer con el tipo «Page» o «Stream». También puedes buscar por número de objeto si lo conoces desde un visor de PDF.
No. En los PDF cifrados, los flujos están protegidos por la clave de cifrado del documento. Elimina primero el cifrado y luego usa el decodificador de flujos.
Sí, totalmente gratis. Sin registro, sin límite de tamaño de archivo y sin restricciones sobre cuántos PDF o flujos inspecciones.