Zum Inhalt springen
SilktideHilfe

Lesbarer PDF-Text

Silktide prüft, ob der Text in Ihren PDF-Dokumenten als echter Text vorhanden ist, statt nur als Bilder von Text. Eine gescannte Seite sieht identisch wie eine getippte aus, aber Software kann nur die getippte lesen.

Warum das wichtig ist

Wenn ein PDF keinen enthält, hat ein nichts vorzulesen - das gesamte Dokument ist für blinde Menschen oder Menschen mit Sehbehinderung stumm. Niemand kann den Text markieren, kopieren oder durchsuchen, Suchmaschinen können den Inhalt nicht indizieren, und Übersetzungswerkzeuge können ihn nicht verarbeiten.

Am häufigsten passiert dies bei gescannten Papierdokumenten, die direkt als PDF gespeichert werden, und bei Design-Tools, die Text beim Export in Bilder umwandeln. Solche Dokumente sind genau dort häufig, wo sie am meisten schaden: Formulare, Richtlinien und archivierte Unterlagen.

So beheben Sie das

  1. Exportieren Sie das PDF aus dem ursprünglichen digitalen Dokument - einem Textverarbeitungs- oder Layout-Programm - anstatt einen Ausdruck zu scannen. Dadurch bleibt echter Text erhalten.
  2. Für Dokumente, die nur auf Papier existieren, scannen Sie sie und führen Sie anschließend aus, die in den meisten PDF-Tools enthalten ist. Lesen Sie den erkannten Text Korrektur, da OCR Fehler macht.
  3. Für wichtige Inhalte sollten Sie in Erwägung ziehen, eine Webseite anstelle des PDFs (oder zusätzlich dazu) zu veröffentlichen - HTML-Seiten lassen sich leichter barrierefrei halten.

Den Text maschinenlesbar zu machen, ist der erste Schritt; ein vollständig barrierefreies Dokument braucht außerdem Struktur. Siehe PDF-Nachbearbeitung, wie Silktide Dokumente für Sie nachbearbeiten kann.

So prüft Silktide das

  1. Analysiert jedes auf Ihrer Website gefundene PDF-Dokument.
  2. Extrahiert jeden echten Text, den das Dokument enthält.
  3. Meldet das Dokument, wenn keine lesbaren Wörter extrahiert werden können, das heißt, sein Inhalt existiert nur als Bilder.

Jedes Dokument wird als Ganzes bestanden oder nicht bestanden.

Fehlerbehebung

Ich kann das PDF problemlos lesen

Ihre Augen lesen das Bild des Textes; Software kann das nicht. Um zu sehen, was eine Maschine sieht, versuchen Sie, im PDF einen Satz zu markieren oder nach einem Wort zu suchen, das Sie auf der Seite sehen. Wenn Sie es nicht markieren oder finden können, ist der Text ein Bild.

Das Dokument besteht absichtlich überwiegend aus Bildern

Ein Fotoalbum oder Poster kann berechtigterweise nur wenig Text enthalten. Wenn das Dokument nichts durch abgebildeten Text vermittelt, können Sie den Fund .

Mehr erfahren

Zuletzt aktualisiert

War diese Seite hilfreich?

Lesbarer PDF-Text | Silktide-Hilfe