Visor de contenido etiquetado de PDF
Inspecciona el árbol de estructura lógica completo de cualquier PDF etiquetado. El visor de contenido etiquetado de PDF muestra toda la jerarquía de etiquetas (encabezados, párrafos, tablas, figuras y enlaces) como un árbol desplegable, señala las figuras sin texto alternativo y muestra el orden de lectura exacto que seguirán los lectores de pantalla.
Tag Legend
Upload a tagged PDF to enable inspection
Upload a tagged PDF to view its structure tree
¿Por qué usar nuestro visor de contenido etiquetado de PDF?
- Inspección completa del árbol de etiquetas: el visor de contenido etiquetado de PDF muestra el árbol de estructura lógica completo de tu PDF (Document, Part, Sect, Article, P, H1-H6, Table, Figure, Link y Span) en una jerarquía desplegable exactamente como la recorren los lectores de pantalla.
- Visibilidad de alt y rol: consulta de un vistazo los atributos Alt, ActualText y Title asociados a cada nodo de etiqueta. Identifica las figuras e imágenes sin descripciones de texto alternativo exigidas por WCAG 2.1 y PDF/UA.
- 100 % privado: funciona en tu navegador. Toda la extracción del árbol de etiquetas se ejecuta localmente en tu navegador con JavaScript del lado del cliente. Tu PDF nunca sale de tu dispositivo, así que los documentos confidenciales permanecen totalmente seguros.
- Resultados instantáneos y sin registro: sube cualquier PDF etiquetado y consulta el árbol de estructura completo en segundos, sin cuenta, sin límite de tamaño de archivo y totalmente gratis para usarlo tantas veces como quieras.
Casos de uso habituales del visor de contenido etiquetado de PDF
- Auditorías de cumplimiento WCAG y PDF/UA: verifica que un documento PDF tenga un árbol de etiquetas completo y bien estructurado antes de enviarlo a una revisión de accesibilidad WCAG 2.1 o PDF/UA (ISO 14289).
- Pruebas con lectores de pantalla: comprende el orden de lectura exacto que seguirá un lector de pantalla en un documento e identifica saltos en la jerarquía de encabezados, secciones desordenadas y descripciones de figuras ausentes.
- Documentos del sector público y gubernamental: comprueba que los PDF públicos cumplan los requisitos de la legislación de accesibilidad (por ejemplo, la Sección 508 en EE. UU., la EN 301 549 en la UE) antes de publicarlos en sitios web oficiales.
- Flujos de publicación accesible: inspecciona los PDF exportados desde InDesign, Word o Acrobat para confirmar que la estructura de etiquetas, el orden de lectura y los niveles de encabezado se mantuvieron intactos durante la exportación.
- Auditoría de texto alternativo: identifica rápidamente todas las etiquetas Figure e Image de cada página y comprueba cuáles carecen de atributos Alt o ActualText, algo esencial para la accesibilidad con lectores de pantalla.
- Comprobaciones de accesibilidad legales y de contratación: valida los PDF de proveedores antes de la firma de una contratación. Confirma que los contratos, informes y documentos técnicos cumplen los estándares de accesibilidad exigidos por tu organización.
¿Qué es el contenido etiquetado de un PDF?
Un PDF etiquetado es un documento que contiene un árbol de estructura lógica oculto junto a su contenido visual. Este árbol define el significado semántico y el orden de lectura de cada elemento: los encabezados, párrafos, listas, tablas, figuras y enlaces se representan como nodos de etiqueta con nombre (por ejemplo, <H1>, <P>, <Table>, <Figure>). Los lectores de pantalla, las líneas braille y los motores de reflujo usan este árbol —y no el diseño visual— para presentar el documento a las personas con discapacidad. Sin etiquetas, un PDF es prácticamente inaccesible, porque las tecnologías de asistencia no pueden determinar el orden de lectura correcto ni la estructura semántica del contenido de la página.
Cómo funciona nuestro visor de contenido etiquetado de PDF
- Subir: arrastra tu PDF a la herramienta. El árbol de estructura se extrae de las entradas /MarkInfo y /StructTreeRoot del PDF con pdfjs-dist, todo dentro de tu navegador.
- Analizar: el visor recorre el árbol de estructura de forma recursiva y recopila el tipo de etiqueta, el rol, el texto Alt, el ActualText, los atributos Title y el número de página de cada nodo.
- Inspeccionar: la jerarquía completa de etiquetas se muestra como un árbol desplegable. Cada nodo indica su nombre de etiqueta, los atributos asociados y la página a la que pertenece. Los nodos con Alt ausente en elementos Figure/Image aparecen resaltados.
Tipos de etiquetas mostradas
- Document / Part / Sect / Div: etiquetas contenedoras que definen agrupaciones estructurales y secciones del documento.
- H / H1-H6: etiquetas de encabezado que definen el esquema del documento y la jerarquía navegable de encabezados.
- P / L / LI / LBody: etiquetas de contenido de párrafo y listas que contienen el flujo principal de texto.
- Table / TR / TH / TD / Figure / Link / Span: etiquetas de elementos semánticos para tablas, imágenes, hipervínculos y fragmentos de texto en línea.
Limitaciones y privacidad
El visor de contenido etiquetado de PDF lee el árbol de estructura lógica declarado en el PDF. Solo los PDF exportados con etiquetas (desde Word, InDesign o el flujo de accesibilidad de Acrobat) mostrarán un árbol significativo. Los PDF escaneados y la mayoría de los exportados para impresión no tienen árbol de etiquetas. Todo el procesamiento se ejecuta localmente en tu navegador: tu PDF nunca se sube a ningún servidor.
Preguntas frecuentes
Un PDF etiquetado contiene un árbol de estructura lógica que define el significado semántico y el orden de lectura de cada elemento: encabezados, párrafos, listas, tablas y figuras. Los lectores de pantalla usan este árbol, y no el diseño visual, para presentar el contenido a las personas con discapacidad.
El PDF se creó sin etiquetado de accesibilidad: desde un flujo de impresión, una imagen escaneada o sin usar las opciones de exportación para accesibilidad. Añade etiquetas con Adobe Acrobat Pro o con un flujo de publicación accesible.
El visor muestra todos los tipos de estructura estándar: Document, Part, Sect, Div, Article, P, H hasta H6, L/LI/LBody, Table/TR/TH/TD, Figure, Link, Span y etiquetas personalizadas asignadas por rol.
Las etiquetas Figure e Image sin atributo Alt o ActualText se resaltan porque la falta de texto alternativo es un fallo de accesibilidad habitual en PDF/UA y WCAG 2.1 que los lectores de pantalla no pueden resolver por sí solos.
No. Todo el visor de contenido etiquetado de PDF funciona localmente en tu navegador con JavaScript del lado del cliente. Tu PDF nunca se transmite a ningún servidor externo.
No: el visor de contenido etiquetado de PDF es una herramienta de inspección de solo lectura. Corregir las etiquetas requiere una herramienta de autoría como Adobe Acrobat Pro o una exportación accesible desde tu documento de origen.
Sí, totalmente gratis. Sin registro, sin límite de tamaño de archivo y sin restricciones en el número de PDF que inspecciones.