Etiquetado de PDF
Silktide comprueba si cada documento PDF de su sitio web incluye etiquetas de accesibilidad. Las etiquetas son una capa oculta que describe la estructura del documento —qué texto es un encabezado, cuál es un párrafo, dónde empieza y termina una lista— y el software que lee un documento en voz alta depende completamente de ellas.
Un almacena esa estructura en un , del mismo modo que una página web la almacena en . Un PDF sin etiquetas no tiene nada: es tinta colocada en una página, y toda pregunta que un necesite responder debe inferirse por dónde están las cosas.
Por qué es importante
Esta es la mayor barrera de accesibilidad que puede tener un documento, y es la base sobre la que se sustenta todo lo demás. Sin etiquetas no hay un fiable, por lo que un boletín de dos columnas se lee de corrido, mezclando dos frases sin relación entre sí. Las tablas se convierten en una ristra de números sin nada que indique de qué columna proceden. Los encabezados son indistinguibles del texto en negrita, así que no hay forma de hojear, y la persona lectora debe escuchar un informe de cincuenta páginas desde el principio para encontrar una sección. Las imágenes no tienen ninguna descripción.
El resultado práctico es que muchos PDF sin etiquetas no solo son incómodos sin visión, sino que son inutilizables. Como las necesitan etiquetas para hacer cualquier cosa, ninguna otra corrección de PDF ayuda hasta que esta esté aplicada: el texto alternativo, los encabezados y los encabezados de tabla se almacenan todos en las etiquetas.
Los documentos sin etiquetas también son el motivo más común por el que una organización suspende una auditoría de accesibilidad de documentos, y los PDF publicados por organismos del sector público están explícitamente dentro del alcance de la mayoría de las normativas de accesibilidad.
Cómo solucionarlo
- Corríjalo en el documento de origen siempre que aún disponga de él. Volver a exportar desde el archivo original es más rápido y produce una mejor estructura que reparar el PDF después.
- En Microsoft Word, aplique estilos reales de encabezado y de lista en lugar de ampliar manualmente el texto, y luego exporte a PDF con "Etiquetas de estructura del documento para la accesibilidad" activado.
- En Adobe InDesign, configure el orden de los artículos y las etiquetas de exportación de los estilos de párrafo, y luego exporte como un PDF etiquetado.
- En LibreOffice, exporte con "Accesibilidad universal (PDF/UA)" seleccionado.
- O deje que Silktide lo remedie. Silktide puede reconstruir una estructura de etiquetas completa para un documento sin cambiar su apariencia. Consulte Cómo funciona la remediación de PDF.
- O añada etiquetas a mano en un editor de PDF como Adobe Acrobat Pro. Acrobat puede autoetiquetar un documento en un solo paso, pero el autoetiquetado es un punto de partida más que una solución: espere corregir usted mismo después el orden de lectura, los niveles de encabezado y los encabezados de tabla.
- Si el documento es un escaneado, reconozca primero el texto. Una página escaneada es una fotografía, y no hay nada que las etiquetas puedan describir hasta que el haya producido texto real. Consulte Documentos escaneados.
Si un documento se publica solo en PDF por costumbre, a menudo la mejor solución no es arreglar el PDF. Una página web es más fácil de hacer accesible, más fácil de mantener actualizada y más fácil de leer en un teléfono.
Cómo lo prueba Silktide
- Busca los documentos PDF enlazados desde su sitio web y analiza cada archivo único una sola vez, por muchas páginas que apunten a él.
- Lee el documento para comprobar si declara un árbol de estructura y si está marcado como etiquetado.
- Informa del documento cuando falta cualquiera de los dos.
- Informa de cada documento una sola vez, independientemente de cuántas páginas contenga.
Esta comprobación solo verifica si existen etiquetas, no si son correctas. Un documento etiquetado aún puede representar mal su propio contenido; eso es lo que examinan las otras comprobaciones de documentos y la revisión con IA.
Solución de problemas
El documento se ve bien cuando lo abro
Las etiquetas son invisibles. No cambian nada en la apariencia de un documento en pantalla o impreso, por lo que un documento que se ve perfecto puede estar completamente sin etiquetar. Lo que cambian las etiquetas es lo que el software puede deducir sobre el contenido.
Puedo seleccionar y copiar el texto, ¿entonces no está etiquetado?
No. El texto seleccionable y las etiquetas son cosas distintas. El texto es extraíble siempre que las palabras estén almacenadas como caracteres en lugar de como una imagen, y eso ocurre con o sin etiquetas. Las etiquetas añaden la estructura alrededor del texto: qué es un encabezado, en qué orden leer, qué significan las imágenes.
El documento no aparece en la lista
Silktide informa de los PDF a los que puede acceder desde sus páginas. Un documento al que nadie enlaza no aparecerá, y tampoco lo hará uno que no se pudo abrir para su análisis —por ejemplo, un archivo protegido con contraseña—. Consulte Documentos protegidos con contraseña y restringidos.
He vuelto a publicar el documento pero la comprobación lo sigue informando
Los resultados se actualizan la próxima vez que se pruebe el documento. Tenga también en cuenta que reemplazar un archivo en la misma dirección no siempre es suficiente por sí solo: compruebe que la página realmente enlaza al archivo nuevo.
Más información
- Comprender el Criterio de Conformidad 1.3.1: Información y relaciones (WCAG 2.2)
- PDF13: Proporcionar texto de reemplazo mediante la entrada /Alt (WCAG)
- Comprender la accesibilidad de los PDF - las normas detrás de esta comprobación y cómo encajan entre sí
- Etiquetado de contenido en PDF · Asignación de roles en PDF