Skip to content
DocsAll

PDF-OCR-Erkennung

Kostenlos Lokale Verarbeitung

Kostenloses Online-Tool für PDF-OCR, rendert jede PDF-Seite als Bild und erkennt den Text mit tesseract.js. Unterstützt über 10 Sprachen wie vereinfachtes und traditionelles Chinesisch, Englisch, Japanisch, Koreanisch, Französisch, Deutsch und Spanisch, mit angegebarem Seitenbereich. Dateien werden nicht hochgeladen, die gesamte Verarbeitung erfolgt im Browser, schützt deine Privatsphäre.

Dateien hierher ziehen, oder

max. pro Datei 100.0 MB

Optionen

Anleitung

  1. 1 Wähle eine PDF-Datei
  2. 2 Wähle die Erkennungssprache (unterstützt über 10 Sprachen: vereinfachtes und traditionelles Chinesisch, Englisch, Japanisch, Koreanisch, Französisch, Deutsch, Spanisch, Russisch, Arabisch usw.)
  3. 3 Optional: fülle den Seitenbereich aus (wie 1-3), leer für alle
  4. 4 Klicke auf «PDF-OCR-Erkennung», warte auf Abschluss und sieh/kopiere den Text

FAQ

Q: Warum ist es so langsam?

Die OCR rendert zuerst jede Seite als hochauflösendes Bild und erkennt dann den Text seitenweise, mit hoher Rechenlast. Je mehr Seiten und je höher die Auflösung, desto langsamer. Es wird empfohlen, «Seitenbereich» zu verwenden, um nur die notwendigen zu erkennen, oder andere speicherintensive Tabs zu schließen.

Q: Was tun, wenn die Erkennungsgenauigkeit niedrig ist?

Die Genauigkeit hängt von der Schärfe des PDFs ab. Klare gescannte Dokumente mit regelmäßigen Schriften werden gut erkannt; verschwommene, geneigte oder handgeschriebene haben schlechtere Ergebnisse. Du kannst eine geeignetere Sprache wählen (für rein englischen Text kann «Nur Englisch» genauer sein).

Q: Werden die Dateien auf den Server hochgeladen?

Nein. Das gesamte Rendering und die Erkennung erfolgen in deinem Browser, die Dateien verlassen dein Gerät nicht und schützen vollständig deine Privatsphäre.

Verwandte Tools