Funktion
v1.6.0
Shotomatic Team
1 Min. Lesezeit

Durchsuchbare PDF-Exporte mit OCR

Eine eingebettete OCR-Textebene macht exportierte PDFs durchsuchbar und berücksichtigt bei der Platzierung das Seitenlayout.

Mit der integrierten OCR werden PDF-Exporte aus Screenshots durchsuchbar.

Durchsuchbare PDF-Exporte

  • Eingebettete Textebene zum Suchen und Auswählen von Text.
  • Tagged-PDF-Ausgabe für bessere Barrierefreiheit.
  • Layoutabhängige OCR-Platzierung für mehrspaltige Seiten.

Markierter OCR-Text in einem exportierten PDF
Beispiel: Der erkannte Text lässt sich direkt im exportierten PDF markieren.

So entsteht die OCR-Ebene

Die Texterkennung läuft beim PDF-Export automatisch. Du musst keine zusätzliche Option einschalten und deinen Ablauf nicht ändern.

Im Hintergrund passiert Folgendes:

  • Tesseract.js läuft lokal mit gebündelten Sprachdaten.
  • Shotomatic wertet Begrenzungsrahmen für Wörter, Zeilen und Blöcke aus, um Spalten und Lesereihenfolge zu erkennen.
  • Jedes Wort wird auf die Koordinaten im fertigen PDF skaliert und als unsichtbare Textebene eingefügt.
  • Ist der Tagged-PDF-Modus aktiv, gruppiert Shotomatic Wörter zu Absätzen und hinterlegt ActualText für assistive Technologien.

Aktualisiere Shotomatic auf Version 1.6.0, um durchsuchbare PDFs mit OCR zu exportieren.

Ähnliche Funktionen und Updates

Ähnliche Funktionen

Weitere Updates

Bereit für einen einfacheren Screenshot-Ablauf?

Automatisiere wiederkehrende Aufnahmen und spare Zeit.

Durchsuchbare PDF-Exporte mit OCR | Updates | Shotomatic