Просмотр тегированного содержимого PDF
Изучите полное логическое дерево структуры любого тегированного PDF. Просмотрщик тегированного содержимого PDF показывает всю иерархию тегов — заголовки, абзацы, таблицы, рисунки и ссылки — в виде раскрывающегося дерева, отмечает рисунки без альтернативного текста и показывает точный порядок чтения, которому будут следовать программы экранного доступа.
Tag Legend
Upload a tagged PDF to enable inspection
Upload a tagged PDF to view its structure tree
Зачем использовать наш просмотрщик тегированного содержимого PDF?
- Полная проверка дерева тегов: просмотрщик тегированного содержимого PDF отображает полное логическое дерево структуры вашего PDF — Document, Part, Sect, Article, P, H1-H6, Table, Figure, Link и Span — в виде раскрывающейся иерархии точно так, как по ней проходят программы экранного доступа.
- Видимость alt-текста и ролей: сразу видите атрибуты Alt, ActualText и Title у каждого узла тега. Находите рисунки и изображения без описаний альтернативного текста, требуемых WCAG 2.1 и PDF/UA.
- 100 % приватно — работает в браузере: всё извлечение дерева тегов выполняется локально в вашем браузере на клиентском JavaScript. Ваш PDF никогда не покидает устройство, поэтому конфиденциальные документы остаются полностью защищёнными.
- Мгновенный результат без регистрации: загрузите любой тегированный PDF и увидьте полное дерево структуры за секунды — без аккаунта, без ограничения размера файла и совершенно бесплатно, сколько угодно раз.
Типичные сценарии использования просмотрщика тегированного содержимого PDF
- Аудит соответствия WCAG и PDF/UA: убедитесь, что документ PDF имеет полное и правильно структурированное дерево тегов, прежде чем отправлять его на проверку доступности по WCAG 2.1 или PDF/UA (ISO 14289).
- Тестирование программ экранного доступа: поймите точный порядок чтения документа программой экранного доступа — выявите пропуски в иерархии заголовков, разделы не по порядку и отсутствующие описания рисунков.
- Документы государственных и публичных организаций: проверьте, что публичные PDF соответствуют требованиям законодательства о доступности (например, Section 508 в США, EN 301 549 в ЕС), прежде чем публиковать их на официальных сайтах.
- Процессы доступной публикации: проверяйте экспортированные PDF из InDesign, Word или Acrobat, чтобы убедиться, что структура тегов, порядок чтения и уровни заголовков сохранились при экспорте без изменений.
- Аудит альтернативного текста: быстро находите все теги Figure и Image на каждой странице и проверяйте, у каких отсутствуют атрибуты Alt или ActualText — это критично для доступности с программами экранного доступа.
- Юридические проверки и проверки при закупках: проверяйте PDF от поставщиков перед согласованием закупки. Убеждайтесь, что договоры, отчёты и технические документы соответствуют стандартам доступности, принятым в вашей организации.
Что такое тегированное содержимое PDF?
Тегированный PDF — это документ, который помимо визуального содержимого содержит скрытое логическое дерево структуры. Это дерево определяет смысловое значение и порядок чтения каждого элемента: заголовки, абзацы, списки, таблицы, рисунки и ссылки представлены именованными узлами тегов (например, <H1>, <P>, <Table>, <Figure>). Программы экранного доступа, брайлевские дисплеи и движки переформатирования используют именно это дерево, а не визуальную вёрстку, чтобы представить документ людям с инвалидностью. Без тегов PDF практически недоступен, поскольку вспомогательные технологии не могут определить правильный порядок чтения или смысловую структуру содержимого страницы.
Как работает наш просмотрщик тегированного содержимого PDF
- Загрузка: перетащите PDF в инструмент. Дерево структуры извлекается из записей /MarkInfo и /StructTreeRoot PDF с помощью pdfjs-dist, полностью в вашем браузере.
- Разбор: просмотрщик рекурсивно обходит дерево структуры и собирает для каждого узла тип тега, роль, текст Alt, ActualText, атрибуты Title и номер страницы.
- Проверка: полная иерархия тегов отображается в виде раскрывающегося дерева. Каждый узел показывает имя тега, связанные атрибуты и страницу, к которой он относится. Узлы с отсутствующим Alt у элементов Figure/Image подсвечиваются.
Отображаемые типы тегов
- Document / Part / Sect / Div: контейнерные теги, задающие структурные группы и разделы документа.
- H / H1-H6: теги заголовков, задающие структуру документа и навигируемую иерархию заголовков.
- P / L / LI / LBody: теги содержимого абзацев и списков, в которых находится основной текстовый поток.
- Table / TR / TH / TD / Figure / Link / Span: смысловые теги элементов для таблиц, изображений, гиперссылок и встроенных фрагментов текста.
Ограничения и приватность
Просмотрщик тегированного содержимого PDF читает логическое дерево структуры, объявленное в PDF. Содержательное дерево покажут только PDF, экспортированные с тегами (из Word, InDesign или через процесс доступности в Acrobat). У отсканированных PDF и большинства PDF, экспортированных для печати, дерева тегов нет. Вся обработка выполняется локально в вашем браузере — ваш PDF никогда не загружается на сервер.
Часто задаваемые вопросы
Тегированный PDF содержит логическое дерево структуры, которое определяет смысловое значение и порядок чтения каждого элемента — заголовков, абзацев, списков, таблиц и рисунков. Программы экранного доступа используют именно это дерево, а не визуальную вёрстку, чтобы представить содержимое людям с инвалидностью.
PDF был создан без разметки доступности: из процесса печати, из отсканированного изображения или без использования параметров доступного экспорта. Добавьте теги с помощью Adobe Acrobat Pro или в рамках доступного процесса публикации.
Просмотрщик отображает все стандартные типы структуры: Document, Part, Sect, Div, Article, P, H до H6, L/LI/LBody, Table/TR/TH/TD, Figure, Link, Span, а также пользовательские теги с сопоставлением ролей.
Теги Figure и Image без атрибута Alt или ActualText подсвечиваются, потому что отсутствие альтернативного текста — распространённое нарушение доступности PDF/UA и WCAG 2.1, которое программы экранного доступа не могут обойти.
Нет. Весь просмотрщик тегированного содержимого PDF работает локально в вашем браузере на клиентском JavaScript. Ваш PDF никогда не передаётся на внешние серверы.
Нет — просмотрщик тегированного содержимого PDF предназначен только для чтения и проверки. Для исправления тегов нужен редактор вроде Adobe Acrobat Pro или доступный экспорт из исходного документа.
Да, полностью бесплатный. Без регистрации, без ограничения размера файла и без ограничений на количество проверяемых PDF.