Ein gescanntes PDF ist nur ein Bild einer Seite. Dein Computer sieht Pixel, keine Wörter — du kannst den Text also nicht markieren, ein Zitat kopieren oder mit Strg+F nach einer Phrase suchen. Die Lösung heißt OCR (optische Zeichenerkennung): Eine Software liest das Bild, erkennt die Buchstaben und legt eine unsichtbare Textebene hinter den Scan. Die Seite sieht identisch aus, ist aber jetzt durchsuchbar und markierbar.
So geht's
Öffne das OCR-Tool, lege dein gescanntes PDF ab und wähle die Sprache des Dokuments (das ist wichtig — OCR erkennt deutlich genauer, wenn es weiß, welches Alphabet und Wörterbuch zu erwarten sind). Das Tool verarbeitet jede Seite und liefert ein neues PDF mit fest eingebauter durchsuchbarer Textebene zurück.
Alles läuft auf unseren Servern, und die Datei wird zwei Stunden später gelöscht — kein Konto, kein Wasserzeichen.
Tipps für ein sauberes Ergebnis
Scanne wenn möglich mit 300 DPI — bei zu niedriger Auflösung verschwimmen die Buchstaben ineinander. Halte die Seiten gerade; starker Schräglauf verschlechtert die Erkennung. Und denk daran: OCR liest unvollkommene Bilder nach bestem Wissen — Handschrift, verspielte Schriftarten und blasse Fotokopien werden nie perfekt erkannt.