OCR PDF: gescanntes PDF durchsuchbar machen
Lade ein gescanntes PDF: Jede Seite wird per Texterkennung gelesen, und der gefundene Text wird unsichtbar unter das Bild gelegt. Danach kannst du nach Wörtern suchen, markieren und kopieren, ohne dass sich das Aussehen des Dokuments ändert.
- Kostenlos
- 15 Sprachen
- Originalbild bleibt unverändert
- Verarbeitung auf deinem Gerät
100 % privat — Alles wird direkt in deinem Browser verarbeitet: Deine Dateien, deine Stimme und dein Bild werden niemals an die Server von Chatzam gesendet.
Wie mache ich OCR bei einem PDF?
-
Gescanntes PDF laden
Das Tool erkennt sofort, welche Seiten nur Bilder sind und welche bereits Text enthalten.
-
Sprachen wählen
Deutsch ist voreingestellt; füge Englisch, Französisch oder eine andere Sprache hinzu, wenn das Dokument mehrere Sprachen mischt.
-
Durchsuchbares PDF herunterladen
Verfolge den Fortschritt Seite für Seite und lade dann das PDF herunter, bei Bedarf auch den reinen Text als .txt.
Ein Scan, der sich wie ein echtes PDF verhält
Unsichtbarer Text, wortgenau
Jedes erkannte Wort liegt genau auf seinem Bild: Suche und Markierung treffen die richtige Stelle.
Kein Qualitätsverlust
Die Seitenbilder werden weder neu komprimiert noch skaliert; Seiten, die schon Text enthalten, bleiben unverändert.
Schiefe Seiten werden aufgerichtet
Eine quer oder auf dem Kopf gescannte Seite wird erkannt und vor dem Lesen richtig herum gedreht.
Mehrere Sprachen gleichzeitig
Bis zu 5 von 15 Sprachen, darunter Deutsch, Englisch, Französisch, Spanisch, Italienisch und Portugiesisch.
Was ist OCR bei einem PDF?
Ein PDF aus einem Scanner oder einer Scan-App enthält nur Fotos von Seiten: Du siehst Wörter, aber die Software sieht nur Pixel. Du kannst also nicht mit Strg+F nach einem Namen suchen, keinen Absatz kopieren und das Dokument nicht von einer Vorlesesoftware vorlesen lassen. OCR, die optische Zeichenerkennung, analysiert das Bild und findet die Buchstaben darin. Dieses Tool legt den Text anschließend als unsichtbare Ebene ins PDF, ausgerichtet auf jedes Wort. Das Dokument sieht genau gleich aus, wird aber durchsuchbar, markierbar und indexierbar, wie ein PDF, das direkt aus einem Textverarbeitungsprogramm erstellt wurde.
Wie bekomme ich das beste Ergebnis?
Die Qualität der Erkennung hängt vor allem vom Scan ab. Ein Scan mit 300 dpi, gut beleuchtet, in Schwarzweiß oder Graustufen, liefert bei gedrucktem Text hervorragende Ergebnisse. Die Seiten werden mit etwa 300 dpi gelesen, was auch bei einem kleineren Scan Spielraum lässt. Gib alle vorkommenden Sprachen an: Bei einer zweisprachigen Anleitung auf Deutsch und Englisch fügst du beide hinzu, sonst werden Umlaute oder fremde Wörter schlechter erkannt. Handschrift, Stempel und Text auf sehr unruhigem Hintergrund bleiben schwierig. Mach nach der OCR einen Test: Suche nach einem seltenen Wort aus dem Dokument, um zu prüfen, ob es gefunden wird.
Deine Dokumente bleiben auf deinem Gerät
Gescannte PDFs enthalten oft sensible Unterlagen: Ausweise, Gehaltsabrechnungen, Verträge, Rezepte. Hier wird die Datei direkt in deinem Browser geöffnet und gelesen; sie wird nie auf einen Server hochgeladen. Nur die Sprachmodelle, ein paar Megabyte pro Sprache, werden bei der ersten Nutzung heruntergeladen und dann vom Browser zwischengespeichert. Die Verarbeitung dauert je nach Leistung des Geräts einige bis etwa zwanzig Sekunden pro Seite; du kannst sie jederzeit abbrechen. Sobald das PDF durchsuchbar ist, kannst du es mit den anderen PDF-Tools komprimieren, in Word umwandeln oder den Text daraus extrahieren.
Häufig gestellte Fragen
Wie mache ich ein gescanntes PDF bearbeitbar?
Die OCR fügt dem PDF den erkannten Text hinzu: Dann kannst du ihn suchen, markieren und kopieren. Um den Inhalt zu überarbeiten, wandle das durchsuchbare PDF anschließend mit „PDF in Word umwandeln“ um oder exportiere den Text als .txt.
Wird mein PDF auf einen Server hochgeladen?
Nein. Das PDF wird vollständig in deinem Browser gelesen und verarbeitet. Nur die Sprachmodelle werden beim ersten Mal heruntergeladen und dann zwischengespeichert.
Ist das neue PDF größer oder schlechter in der Qualität?
Die Originalbilder bleiben unverändert, ohne neue Komprimierung. Die Datei wächst nur um den hinzugefügten Text, meist ein paar Dutzend Kilobyte.
Was passiert mit Seiten, die schon Text enthalten?
Sie werden erkannt und bleiben unverändert. Nur Seiten, die reine Bilder sind, durchlaufen die Texterkennung.
Erkennt das Tool Handschrift?
Es ist für gedruckten oder maschinengeschriebenen Text gemacht. Eine sehr saubere Handschrift kann teilweise erkannt werden, aber das Ergebnis ist nicht zuverlässig.