Passer au contenu
SilktideAide

Texte PDF lisible

Silktide vérifie si le texte de vos documents PDF existe comme véritable texte, plutôt que seulement comme des images de texte. Une page numérisée semble identique à une page tapée au clavier, mais les logiciels ne peuvent lire que celle tapée au clavier.

Pourquoi c’est important

Lorsqu’un PDF ne contient aucun , un n’a rien à annoncer — le document entier est muet pour les personnes aveugles ou ayant une basse vision. Personne ne peut sélectionner, copier ou rechercher le texte, les moteurs de recherche ne peuvent pas indexer le contenu, et les outils de traduction ne peuvent pas le traiter.

Cela se produit le plus souvent avec des documents papier numérisés enregistrés directement en PDF, et avec des outils de conception qui, à l’exportation, aplatissent le texte en images. Ces documents sont fréquents précisément là où ils causent le plus de tort : formulaires, politiques et dossiers archivés.

Comment corriger le problème

  1. Exportez le PDF à partir du document numérique d’origine — un traitement de texte ou un outil de mise en page — plutôt que de numériser un tirage papier. Cela conserve le vrai texte.
  2. Pour les documents qui n’existent que sur papier, numérisez-les, puis exécutez une , fonctionnalité offerte par la plupart des outils PDF. Relisez le texte reconnu, car la ROC fait des erreurs.
  3. Pour le contenu important, envisagez de publier une page Web plutôt que le PDF (ou en plus du PDF) — les pages HTML sont plus faciles à maintenir accessibles.

Rendre le texte lisible est la première étape; un document pleinement accessible a aussi besoin de structure. Voir remédiation des PDF pour savoir comment Silktide peut corriger des documents pour vous.

Comment Silktide vérifie cela

  1. Analyser chaque document PDF trouvé sur votre site Web.
  2. Extraire tout le texte réel que contient le document.
  3. Signaler le document lorsqu’aucun mot lisible ne peut être extrait, ce qui signifie que son contenu n’existe que sous forme d’images.

Chaque document réussit ou échoue dans son ensemble.

Dépannage

Je peux lire le PDF sans problème

Vos yeux lisent l’image du texte; les logiciels n’en sont pas capables. Pour voir ce qu’une machine perçoit, essayez de sélectionner une phrase dans le PDF ou de rechercher un mot que vous voyez sur la page. Si vous ne pouvez pas le sélectionner ni le trouver, le texte est une image.

Le document contient surtout des images par conception

Un album photo ou une affiche peut légitimement contenir peu de texte. Si le document ne transmet rien au moyen de texte représenté sous forme d’images, vous pouvez le constat.

Pour en savoir plus

Dernière mise à jour

Cette page vous a-t-elle été utile?