Ein gescanntes PDF privat per OCR verarbeiten – Text in Ihrem Browser erkennen

Wählen Sie ein gescanntes PDF und eine Sprache; jede Seite wird lokal von Tesseract (nach WebAssembly kompiliert) gerendert und erkannt, und der erkannte Text wird angezeigt und als .txt-Datei zum Download angeboten.

Quick answer

What it does
Wählen Sie ein gescanntes PDF und eine Sprache; jede Seite wird lokal von Tesseract (nach WebAssembly kompiliert) gerendert und erkannt, und der erkannte Text wird angezeigt und als .txt-Datei zum Download angeboten.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Ein Buchhalter führt OCR auf einer gescannten Rechnung durch, um Positionsbeträge ohne erneutes Eintippen in eine Tabellenkalkulation zu kopieren.
Good to know
In dieser Version werden Englisch und Traditionelles Chinesisch unterstützt.

How it works

  1. Wählen Sie ein gescanntes PDF von Ihrem Gerät aus und wählen Sie die Dokumentsprache.
  2. Die Datei wird in den Arbeitsspeicher des Browsers eingelesen – es verlassen keine Daten Ihren Browser.
  3. pdf.js rendert jede Seite in einem Web Worker zu einem Bild.
  4. Tesseract OCR – nach WebAssembly kompiliert und von dieser Website ausgeliefert – erkennt den Text jeder Seite lokal; auch das Sprachmodell wird von dieser Website geladen, nicht von einem Drittanbieter-CDN.
  5. Der erkannte Text wird pro Seite angezeigt und als .txt-Download angeboten.

When to use this tool

  • Ein Buchhalter führt OCR auf einer gescannten Rechnung durch, um Positionsbeträge ohne erneutes Eintippen in eine Tabellenkalkulation zu kopieren.
  • Ein Student führt OCR auf einem gescannten Kurshandout durch, um durchsuchbaren, kopierbaren Text für seine Notizen zu erhalten.
  • Ein Archivar konvertiert gescannte Dokumente in Traditionellem Chinesisch in durchsuchbaren Text für eine digitale Bibliothek.
  • Die OCR-Genauigkeit hängt von der Scanqualität ab — verschwommene, verzerrte oder niedrigauflösende Seiten können Fehler erzeugen; die Ausgabe als bestmöglichen Entwurf betrachten.

Frequently asked questions

Worin unterscheidet sich dieses Tool von anderen Online-PDF-Tools?
Die meisten Online-PDF-Tools senden Ihre Dateien zur Verarbeitung an einen entfernten Server. Dieses Tool verarbeitet alles lokal in Ihrem Browser mit clientseitigem JavaScript. Ihre Dateien werden an keinen Server übertragen, sodass der Inhalt Ihrer Dokumente vollständig unter Ihrer Kontrolle bleibt.
Werden meine PDF-Dateien hochgeladen?
Nein. Ihre Dateien werden direkt von Ihrem Browser eingelesen. Ihre Dateien werden niemals über das Netzwerk übertragen. Das Tool arbeitet ausschließlich im geöffneten Browser-Tab.
Kann ich überprüfen, dass keine Dateien hochgeladen werden?
Ja. Öffnen Sie die Entwicklertools Ihres Browsers (F12), wechseln Sie zum Tab „Netzwerk“ und achten Sie während der Nutzung auf ausgehende Anfragen. Sie werden sehen, dass keine Dateidaten Ihren Browser verlassen. Die Website kann einen anonymen Seitenaufruf-Zähler erfassen, der niemals Ihre Dateien enthält und deaktiviert werden kann.
Funktioniert dieses Tool offline?
Ja. Sobald die Seite geladen ist, verarbeitet das Tool Ihre Dateien vollständig in Ihrem Browser; die Tool-Funktionalität benötigt keine Netzwerkverbindung. Sie können die Internetverbindung trennen und es weiter nutzen.
Was passiert, wenn ich die Seite neu lade?
Da nichts auf einem Server gespeichert wird, setzt das Neuladen der Seite Ihre aktuelle Sitzung zurück. Bereits ausgewählte Dateien müssen erneut ausgewählt werden.
Speichert dieses Tool meine Dateien?
Nein. Dateien werden nur so lange im Arbeitsspeicher des Browsers gehalten, wie die Seite geöffnet ist. Beim Schließen oder Neuladen der Seite werden sie verworfen. Das Tool schreibt nichts auf die Festplatte und sendet nichts an einen Server.
Kann dieses Tool passwortgeschützte PDFs entsperren?
Nein. Dieses Tool versucht nicht, den PDF-Passwortschutz zu entfernen oder zu umgehen. Wenn Sie das Passwort kennen, kann das Tool „PDF entsperren“ auf dieser Website es lokal entfernen; anschließend kann dieses Tool die Datei verarbeiten.
Welche Technologien verwendet dieses Tool?
Dieses Tool verwendet pdf.js, um Seiten zu rendern, sowie die nach WebAssembly kompilierte OCR-Engine Tesseract (tesseract.js), die in einem Web Worker mit gleicher Herkunft läuft – Ihre Dateien verlassen Ihren Browser nicht.
Verwendet dieses Tool WebAssembly?
Ja – dies ist eines der wenigen Tools hier, das es tut. Die Tesseract-OCR-Engine ist nach WebAssembly kompilierter C++-Code und läuft in Ihrem Browser; die .wasm-Binärdatei wird von dieser Website ausgeliefert und es wird nichts irgendwohin gesendet.
Warum ist der erste Durchlauf langsamer als die folgenden?
Bei der ersten Nutzung lädt Ihr Browser die OCR-Engine und das Sprachmodell von dieser Website herunter (einige Megabyte) und kompiliert sie. Anschließend werden sie zwischengespeichert, sodass spätere Durchläufe deutlich schneller starten.
Wie wende ich hier OCR auf ein gescanntes PDF an?
Wählen Sie ein gescanntes PDF von Ihrem Gerät aus, wählen Sie die Dokumentsprache (Englisch oder Traditionelles Chinesisch) und wählen Sie dann „Erkennen“. Jede Seite wird lokal gerendert und ausgelesen, und nach Abschluss können Sie den Text in der Vorschau ansehen und als .txt-Datei speichern.
Warum ist der erkannte Text nur eine .txt-Datei und kein durchsuchbares PDF?
Dieses Tool gibt die erkannten Wörter als reinen Text aus, statt eine unsichtbare Textebene zurück in das PDF zu schreiben, sodass Ihr ursprüngliches gescanntes PDF unverändert bleibt. Wenn Sie die Wörter in der Seite benötigen, kopieren Sie sie aus der gespeicherten .txt-Datei oder der Vorschau auf dem Bildschirm, die den Text Seite für Seite auflistet.
Kann ich zwei Sprachen im selben Dokument verarbeiten, und was passiert, wenn ich die falsche wähle?
Sie wählen vor dem Erkennen eine einzige Sprache für das gesamte Dokument aus, sodass eine Datei, die Englisch und Traditionelles Chinesisch mischt, diejenige Sprache bevorzugt, die Sie gewählt haben. Die Erkennungsqualität hängt zudem vom Scan selbst ab, sodass schief eingescannte, niedrig aufgelöste oder handschriftliche Seiten unabhängig von der Sprache tendenziell schlecht ausfallen.
Kostet das OCR PDF-Tool etwas?
Das OCR PDF-Tool ist völlig kostenlos – kein Konto, keine Registrierung und kein Limit bei der Anzahl der gescannten PDFs, die Sie verarbeiten. Es wird immer kostenlos bleiben. Jede Seite wird direkt in Ihrem Browser mit der Tesseract OCR-Engine erkannt, die zu WebAssembly kompiliert wurde, sodass Ihre gescannten Dokumente – ob Verträge, Ausweise oder Krankenakten – niemals irgendwohin gesendet werden.

Related tools

  • Text extrahieren
  • Wortzählung
  • PDF in Bilder
  • PDF komprimieren
  • PDF-Editor – alles in einem
  • Startseite
  • PDF-Editor – alles in einem
  • PDF zusammenführen
  • PDF aufteilen
  • PDF drehen
  • Wasserzeichen hinzufügen
  • Bilder in PDF
  • PDF in Bilder
  • Seitenzahlen
  • PDF komprimieren
  • Text extrahieren
  • Metadaten bearbeiten
  • Seiten organisieren
  • Leere Seiten einfügen
  • Seiten extrahieren
  • N-up (Seiten pro Blatt)
  • PDF in Graustufen
  • PDF zuschneiden
  • Seiten umkehren
  • Größe ändern (A4/Letter)
  • Kopf- & Fußzeile hinzufügen
  • Formular reduzieren
  • Alle N Seiten aufteilen
  • PDF-Info & Metadaten
  • Bild / Signatur stempeln
  • Seiten entfernen
  • Gekacheltes Wasserzeichen
  • Broschüre
  • Seiten duplizieren
  • Datei anhängen
  • Nach Prozent skalieren
  • Leere Seiten entfernen
  • Verschachteltes Zusammenführen
  • Seitenrahmen hinzufügen
  • Ungerade / gerade Seiten extrahieren
  • PDF in langes Bild
  • Seiten halbieren
  • Ränder hinzufügen
  • PDF signieren
  • PDFs vergleichen
  • Poster-Aufteilung
  • Wortzählung
  • PDF reparieren
  • PDF-Formular ausfüllen
  • Nach Lesezeichen aufteilen
  • Suchen & Hervorheben
  • Bilder extrahieren
  • PDF schwärzen
  • OCR (Scan zu Text)
  • PDF schützen
  • PDF entsperren
  • Über uns
  • Datenschutzerklärung
  • Kontakt
  • Funktionsweise
  • Lokale vs. Online-PDF-Tools
  • Sind Online-PDF-Tools sicher?