PDF-OCR — Gescanntes PDF in Text umwandeln

PDF-OCR extrahiert bearbeitbaren Text aus gescannten oder reinen Bild-PDFs direkt in deinem Browser. Wenn dein PDF nur aus Bildern der Seiten besteht — ein Scan, ein Foto oder ein Export ohne eingebettete Textebene — liefert das normale Kopieren und Einfügen nichts, und genau das behebt dieses Werkzeug für gescanntes PDF in Text. Jede Seite wird gerendert und mit Tesseract OCR gelesen, dann wird der erkannte Text zusammengeführt, sodass du ihn kopieren oder als .txt-Datei herunterladen kannst. Alles läuft zu 100% in deinem Browser, dein Dokument wird also nie hochgeladen und bleibt vollständig privat. Ideal für Quittungen, Verträge, Bücher, Formulare und andere bildbasierte PDFs ohne auswählbaren Text.

🔒 100 % privat — Dateien verlassen dein Gerät nie

Wird geladen…

So funktioniert es

  1. Ziehe dein gescanntes oder reines Bild-PDF auf die Seite oder klicke, um eine .pdf-Datei von deinem Gerät auszuwählen.
  2. Das Tool rendert jede Seite auf ein hochauflösendes Canvas und führt Tesseract OCR aus und zeigt den Live-Fortschritt der aktuellen Seite.
  3. Lies den erkannten Text, während er das Ausgabefeld füllt — Seite für Seite, getrennt durch Leerzeilen.
  4. Kopiere den Text in die Zwischenablage oder lade ihn als .txt-Datei herunter — kein Upload, nichts verlässt dein Gerät.

Häufige Fragen

Für welche Art von PDF funktioniert dieses OCR-Tool?

Es ist für gescannte oder reine Bild-PDFs gedacht — Seiten, die Bilder ohne eingebetteten, auswählbaren Text sind. Jede Seite wird als Bild gerendert und per OCR gelesen. Hat dein PDF bereits eine echte Textebene, ist ein normaler PDF-zu-Text-Extraktor schneller und genauer.

Wird mein PDF auf einen Server hochgeladen?

Nein. Der gesamte Vorgang läuft zu 100% in deinem Browser mit pdf.js und Tesseract.js. Dein PDF wird lokal gelesen, die OCR läuft auf deinem eigenen Gerät und nichts wird jemals hochgeladen, sodass dein Dokument vollständig privat bleibt.

Welche Sprachen kann es erkennen?

Die OCR verwendet das englische Sprachmodell (eng) und funktioniert daher am besten mit englischsprachigen Dokumenten. Text in anderen Alphabeten oder mit vielen Akzenten wird möglicherweise nicht genau erkannt.

Gibt es ein Limit für Dateigröße oder Seitenzahl?

Es gibt kein festes Limit, aber OCR ist rechenintensiv und läuft auf deinem Gerät. Große PDFs mit vielen Seiten dauern länger und brauchen mehr Speicher, sodass sehr große oder hochauflösende Dokumente auf schwächeren Rechnern langsam sein können.

Wie genau ist der extrahierte Text?

Die Genauigkeit hängt vom Scan ab. Saubere, kontrastreiche, gerade Seiten in einer klaren Schrift liefern die besten Ergebnisse. Unscharfe Scans, schiefe Seiten, Handschrift, winzige Schriften oder komplexe mehrspaltige Layouts können Fehler verursachen, daher solltest du das Ergebnis Korrektur lesen.

Kann ich den Text wieder herausbekommen?

Ja. Der erkannte Text landet in einem bearbeitbaren Ausgabefeld, in dem du ihn markieren, mit einem Klick in die Zwischenablage kopieren oder als einfache .txt-Datei herunterladen kannst, die jede Seite durch eine Leerzeile trennt.

Über dieses Tool

Kostenloses PDF-OCR, das gescannte oder reine Bild-PDFs mit Tesseract lokal in bearbeitbaren Text umwandelt. Kopieren oder als .txt herunterladen — 100% im Browser, keine Uploads.

Verwandte Tools