PDF etiquetado
Un PDF etiquetado contiene una capa oculta de estructura —etiquetas— que indica a la qué es cada parte del contenido y en qué orden leerla: esto es un encabezado de nivel dos, esto es una lista de cuatro elementos, esta celda de tabla pertenece a ese encabezado de columna, esta imagen significa X, este adorno es decorativo y debe omitirse.
Sin etiquetas, un PDF es solo tinta colocada en una página: un tiene que adivinar qué es un encabezado, dónde empiezan los párrafos y en qué deben leerse las columnas, y a menudo se equivoca. Las etiquetas son invisibles a simple vista y no cambian en absoluto la apariencia del documento. El contenido que no esté cubierto por una etiqueta debe marcarse como , para que no quede nada ambiguo.
La mayoría de los fallos de accesibilidad en los PDF se deben a etiquetas ausentes, incompletas o incorrectas. Reconstruir correctamente esta estructura es el núcleo de lo que hace la remediación de PDF. Estas etiquetas de estructura no son lo mismo que las que aplicas a los documentos para agruparlos.
Más información
- Tagged PDF Best Practice Guide: Syntax - la guía para desarrolladores de la PDF Association sobre PDF etiquetado