Ratgeber
Shotomatic Team
6 Min. Lesezeit

Warum kann ich Text in meiner gespeicherten E-Lehrbuch-PDF nicht auswählen?

Erkenne, ob deine PDF nur Seitenbilder, keine Textebene, fehlerhafte OCR oder eine Kopiersperre enthält, bevor du sie bearbeitest.

Student, der die Textauswahl in einer gespeicherten Lehrbuch-PDF prüft

Eine PDF kann wie ein normales Lehrbuch aussehen und trotzdem keinen auswählbaren Text enthalten. Sie besteht möglicherweise aus Seitenbildern, besitzt eine fehlerhafte OCR-Ebene, verwendet eine ungewöhnliche Schriftkodierung oder schränkt das Kopieren über Dokumentberechtigungen ein.

Kurz gesagt: Prüfe Suche, Auswahl und Dokumentberechtigungen. Nutze OCR nur für Seiten, die du verarbeiten darfst. Ist das Kopieren gesperrt, fordere eine freigegebene Datei an, statt die Beschränkung zu umgehen.

Ermitteln, welche Art von PDF vorliegt

TestergebnisWahrscheinlicher Typ
Wörter lassen sich sauber auswählen und richtig kopierenPDF mit nativem Text
Die Suche funktioniert, kopierter Text enthält aber FehlerBild-PDF mit OCR oder fehlerhafter Kodierung
Die ganze Seite wird als ein Objekt ausgewähltPDF nur aus Bildern
Auswahl ist gesperrt und Berechtigungen zeigen BeschränkungenGeschützte PDF
Manche Seiten funktionieren, andere nichtGemischtes Dokument

Prüfe mehr als eine Seite. Titelbilder und gescannte Anhänge können auch in einer ansonsten textbasierten PDF als Bilder vorliegen.

Suche und Auswahl auf dem Mac testen

Öffne die Datei in Vorschau oder einem anderen vertrauenswürdigen PDF-Reader.

  1. Wähle in Vorschau Werkzeuge > Textauswahl. Mit einem Rechteck- oder Anmerkungswerkzeug kann auswählbarer Text fälschlich nicht verfügbar wirken.
  2. Drücke Command-F und suche nach einem auffälligen Wort, das auf der Seite steht.
  3. Ziehe die Auswahl über einen Satz.
  4. Kopiere ihn in eine vorübergehende reine Textnotiz.
  5. Vergleiche jedes Zeichen mit dem sichtbaren Satz.
  6. Wiederhole den Test auf einer Seite mit Tabelle, Fußnote und Gleichung.
  7. Ist die Auswahl weiterhin deaktiviert, öffne Werkzeuge > Informationen einblenden, wechsle zum Verschlüsselungsinspektor und prüfe, ob die PDF ein Passwort verlangt oder das Kopieren einschränkt.

Lösche den vorübergehend kopierten Text, wenn er lizenziertes Material enthält, das du nicht aufbewahren musst.

Apples Anleitung zur Fehlerbehebung in Vorschau erklärt sowohl die Textauswahl als auch den Verschlüsselungsinspektor. Gehört die Datei dir und hast du das Passwort erhalten, gib es über die normale Abfrage ein. Versuche nicht, eine Berechtigung zu entfernen, die du nicht ändern darfst.

PDF nur aus Bildern

Eine reine Bild-PDF ist ein Behälter für fotografierte oder aufgenommene Seiten. Das kommt häufig bei Scans und Dokumenten aus Screenshots vor. Das Layout bleibt gut erhalten, der Computer sieht jedoch Pixel statt Wörter.

Wenn du die Quelle erstellt hast, sie besitzt oder verarbeiten darfst, kann OCR eine unsichtbare Textebene ergänzen. Danach werden Suche und grobes Kopieren möglich, während das Seitenbild sichtbar bleibt.

Auf einem aktuellen Mac bietet Vorschau eine eingebaute Funktion:

  1. Wähle Ablage > Duplizieren, damit das ursprüngliche Bilddokument unverändert bleibt.
  2. Öffne das Duplikat und wähle Ablage > Exportieren.
  3. Aktiviere Text einbetten.
  4. Speichere die neue PDF und öffne sie erneut.
  5. Wiederhole den Such- und Kopiertest von oben.

Laut Apples Anleitung zu „Text einbetten“ erscheint die Option nur, wenn Vorschau noch keinen Text im Dokument erkannt hat. Fehlt sie, enthält die PDF möglicherweise bereits eine Textebene. Prüfe dann fehlerhafte OCR, Kodierung oder Berechtigungen, statt einen zweiten OCR-Durchlauf anzuwenden.

Die Gegenüberstellung von Screenshot-PDF und Browser-PDF erklärt, warum vom Browser erzeugter nativer Text gewöhnlich besser funktioniert als OCR.

OCR-Text ist vorhanden, aber fehlerhaft

OCR liest die sichtbare Seite und schätzt die Zeichen. Häufige Verwechslungen betreffen:

  • O und 0;
  • l, I und 1;
  • rn und m;
  • hoch- und tiefgestellte Zeichen;
  • die Lesereihenfolge in mehreren Spalten;
  • getrennte Wörter am Zeilenende;
  • Ligaturen und Zierschriften;
  • Gleichungen und chemische Schreibweisen.

Nutze OCR, um eine Seite zu finden, nicht als ungeprüfte Quelle für Zitate. Vergleiche Zitate, Formeln, Namen und Zahlen mit dem Bild.

Nativer Text mit ungewöhnlicher Kodierung

Manche PDFs stellen Zeichen aus eingebetteten Schriften sichtbar richtig dar, kopieren sie aber in falscher Reihenfolge oder als andere Symbole. Auch die Suche kann unzuverlässig funktionieren.

Prüfe die Datei in einem zweiten standardkonformen PDF-Reader. Ist die offizielle Datei fehlerhaft, melde sie dem Anbieter mit Seitenzahl und einem kurzen, nicht vertraulichen Beispiel. Der Verlag kann die Textebene genauer neu erzeugen als ein weiterer OCR-Durchlauf.

Kopieren ist eingeschränkt

Eine geschützte PDF kann das Lesen erlauben und gleichzeitig Kopieren, Drucken oder Bearbeiten einschränken. Behandle OCR, Screenshots, Passwortentfernung oder einen anderen Konverter nicht als Umweg um diese Sperre.

Nutze stattdessen:

  • die Notiz- oder Zitierfunktion des Readers;
  • Kopieren nur innerhalb einer offiziellen Freigabe;
  • eine angeforderte barrierefreie Datei oder Forschungskopie;
  • eine DRM-freie Alternative aus der Bibliothek;
  • eine Fehlerkorrektur des Verlags bei einem Problem mit der Barrierefreiheit.

Nenne bei einer Supportanfrage den genauen Titel, die ISBN, Seite, den Reader und die verwendete Hilfstechnologie.

Gemischte PDFs seitenweise prüfen

Eine Lehrbuch-PDF kann native Kapitel mit gescannten Anhängen oder bildbasierten Abbildungen verbinden. Eine erfolgreiche Suche beweist nicht, dass jede Seite durchsuchbar ist.

Teste:

  • Vorspann und Inhaltsverzeichnis;
  • eine gewöhnliche Textseite;
  • eine Seite mit vielen Abbildungen;
  • den Index;
  • Anhänge;
  • jeden für die Aufgabe wichtigen Abschnitt.

Ist OCR erlaubt, verarbeite nur die betroffenen Seiten und bewahre die ursprüngliche Datei als visuelle Referenz auf.

Bessere Ausgabe für zukünftige Speicherungen

Nutze ein offizielles PDF oder EPUB, wenn es verfügbar ist. Verwende den offiziellen Druckbefehl des Readers für erlaubte Seiten. Eine Browser-PDF kann nativen Text erhalten, sofern die Druckansicht vollständig ist.

Du erstellst aus erlaubten Seitenbildern eine durchsuchbare PDF? Shotomatic hält die Aufnahmen in der richtigen Reihenfolge und ergänzt beim PDF-Export eine durchsuchbare OCR-Ebene. Sind die Bilder bereits vorhanden, kannst du sie mit dem kostenlosen Werkzeug direkt im Browser zu einer PDF verbinden. Da OCR Fehler enthalten kann, bleibt die sichtbare Seite die Referenz.

FAQ

Wie erkenne ich, ob die PDF nur aus Bildern besteht?

Verhält sich die ganze Seite wie ein Bild und findet die Suche keine sichtbaren Wörter, fehlt wahrscheinlich eine Textebene.

Ist OCR vollkommen fehlerfrei?

Nein. Vergleiche Gleichungen, Tabellen, Fußnoten, Namen und Zahlen mit der sichtbaren Seite.

Warum kann ich suchen, aber keinen fehlerfreien Text kopieren?

OCR-Fehler, Schriftkodierung, Lesereihenfolge oder Dokumentberechtigungen können die Ursache sein.

Kann ich eine Kopiersperre entfernen?

Diese Anleitung erklärt keine Umgehung von Beschränkungen. Bitte um eine freigegebene Datei oder nutze die erlaubten Funktionen des offiziellen Readers.

Ähnliche Artikel

Weitere Artikel

EBSCO-E-Books in der Mobil-App offline lesen

Leihe EBSCO-E-Books in der Mobil-App aus und erkenne DRM-freie PDF- oder EPUB-Titel, die sich als portable, nicht ablaufende Dateien laden lassen.

5 Min. Lesezeit
Bibliotheksnutzer lädt ein EBSCO-E-Book zum Offlinelesen herunter

Arbeitest du mit Seiten, die du speichern darfst?

Shotomatic hält erlaubte Seitenaufnahmen in der richtigen Reihenfolge, lässt dich den Satz prüfen und exportiert auf deinem Mac eine durchsuchbare PDF. Beschränkungen des Viewers oder Drucklimits werden dabei nicht umgangen.

Warum kann ich Text in meiner gespeicherten E-Lehrbuch-PDF nicht auswählen? | Blog | Shotomatic