OCR PDF online — machen Sie gescannten Text durchsuchbar
Verwandeln Sie ein gescanntes PDF in ein wirklich durchsuchbares Dokument. Der Text wird auswählbar und Strg+F funktioniert — alles wird lokal in Ihrem Browser verarbeitet, nichts wird hochgeladen.
Wie man ein OCR-PDF online erstellt
Ein OCR mit PDFluna zu starten erfordert einen Klick und erfolgt vollständig in Ihrem Browser. Nichts zu installieren, kein Konto zu erstellen, und keine Datei wird an einen Remote-Server gesendet. Hier ist das vollständige Verfahren, Schritt für Schritt:
- Importieren Sie Ihr gescanntes PDF. Ziehen Sie ein gescanntes PDF in den Import-Bereich oder klicken Sie auf Datei auswählen. Dateien bis zu 50 MB und 50 Seiten werden unterstützt.
- PDFluna überprüft jede Seite. Wir analysieren die Datei lokal, um Seiten zu finden, die bereits eine durchsuchbare Textebene haben, im Gegensatz zu Seiten, die nur Bilder sind. Nur reine Bildseiten benötigen OCR.
- OCR in Ihrem Browser ausführen. Klicken Sie auf OCR starten. Das Werkzeug lädt die Tesseract-OCR-Engine herunter (ungefähr 14 MB, nach der ersten Verwendung zwischengespeichert) und erkennt den Text Seite für Seite.
- Laden Sie Ihr durchsuchbares PDF herunter. Die Ausgabe sieht aus wie das Original, aber der Text ist jetzt auswählbar, kopierbar und mit Strg+F durchsuchbar. Ihre Originaldatei wird niemals geändert.
Was ist OCR und warum ist es wichtig?
Wenn Sie ein Papierdokument scannen oder einen Vertrag mit Ihrem Telefon fotografieren, ist das resultierende PDF kein Dokument im üblichen Sinne — es ist ein Stapel Bilder, die in einen PDF-Container eingewickelt sind. Es gibt keinen echten Text darin: Wenn Sie versuchen, ein Wort durch Ziehen auszuwählen, wird nichts hervorgehoben; wenn Sie ein Wort mit Strg+F suchen, wird nichts gefunden; wenn Sie einen Block kopieren, erhalten Sie nichts. OCR (Optische Zeichenerkennung) behebt das, indem es jede Seite betrachtet, die Buchstabenformen identifiziert und den erkannten Text als unsichtbare Ebene hinter dem Bild in die Datei zurückschreibt.
Die sichtbare Seite bleibt genau dieselbe — gleicher Scan, gleiche Qualität, gleiches Layout. Aber jetzt ist das PDF durchsuchbar, kopierbar und für Bildschirmleser zugänglich. Es ist das PDF-Format, das die meisten Menschen tatsächlich per E-Mail senden, archivieren oder in ein Portal hochladen möchten.
Wie PDFluna OCR in Ihrem Browser ausführt
Unter der Haube verwendet PDFluna Tesseract.js, eine WebAssembly-Kompilierung der von Google gepflegten Open-Source-Tesseract-Engine. Die Engine und ihr englisches Erkennungsmodell werden bei der ersten Verwendung des Werkzeugs von einem CDN heruntergeladen (insgesamt ungefähr 14 MB) und dann in Ihrem Browser zwischengespeichert, sodass jede nachfolgende Ausführung in Sekunden startet. Die eigentliche Verarbeitung berührt niemals einen Server:
- Vorab-Scan. Wir öffnen das PDF mit PDF.js und überprüfen jede Seite, um zu sehen, ob sie bereits eine echte Textebene hat. Seiten, die das tun, werden in Ruhe gelassen; kein Vorteil, sie erneut zu OCR-bearbeiten.
- Rasterung. Jede OCR-bedürftige Seite wird in einem
OffscreenCanvasbei 300 DPI gerendert — der Auflösung, auf die Tesseract trainiert ist. Zu niedrig und kleiner Text geht verloren; zu hoch und die Verarbeitung verlangsamt sich ohne Genauigkeitsgewinn. - Erkennung. Tesseract identifiziert jedes Wort und gibt seinen Text, sein Vertrauen und seine Begrenzungsbox in Pixelkoordinaten zurück.
- Überlagerung. Wir verwenden pdf-lib, um eine unsichtbare Textebene auf jeder Seite hinzuzufügen, wobei jedes Wort genau dort positioniert ist, wo es im Bild erscheint. Der Originalinhalt der Seite wird byteweise erhalten.
Ist es sicher, OCR auf einem PDF online auszuführen?
Mit PDFluna ja — weil im Erkennungsschritt nichts wirklich „online" ist. Sobald die Seite in Ihrem Browser geladen ist, wird das PDF über die Standard-File-API in den Speicher gelesen und mit JavaScript und WebAssembly auf Ihrem eigenen Computer verarbeitet. Wir laden es niemals hoch, sehen es niemals und speichern es niemals. Das macht PDFluna zu einer sicheren Wahl für vertrauliche Scans wie Steuererklärungen, Verträge oder medizinische Akten. Wenn Sie es überprüfen möchten, öffnen Sie die Browser-DevTools und beobachten Sie den Netzwerk-Tab — während des OCR selbst wird keine Anfrage gestellt (nur der einmalige Download der Engine, der keine Benutzerdaten lädt).
Tipps für bessere OCR-Genauigkeit
- Scannen Sie bei 300 DPI. Unter 200 DPI verschmelzen kleine Zeichen miteinander und die Genauigkeit fällt stark. 300 DPI ist der Sweet Spot zwischen Geschwindigkeit und Genauigkeit.
- Halten Sie die Seiten gerade. Leicht schief gestellte Scans (wenige Grad) sind in Ordnung; stark gedrehte oder verzerrte Seiten nicht. Drehen Sie das PDF bei Bedarf zuerst.
- Verwenden Sie gleichmäßige Beleuchtung. Telefonfotos von Dokumenten mit starken Schatten oder Reflexionen können die Engine verwirren. Flache, gleichmäßig beleuchtete Scans funktionieren am besten.
- Schwarzer Text auf Weiß ist ideal. Farbige Hintergründe und dekorative Schriften reduzieren die Genauigkeit. Standard-Körperschriften (Times, Helvetica, Arial) sind am einfachsten für OCR.
Häufig gestellte Fragen
Was ist OCR und wann brauche ich es?
OCR steht für Optical Character Recognition (Optische Zeichenerkennung) — es verwandelt die Pixel eines gescannten Dokuments in echten Text. Wenn Sie den Text Ihres PDFs nicht durch Ziehen auswählen können und Strg+F keine Ergebnisse liefert, ist die Datei ein gescanntes Bild und benötigt OCR, bevor Sie darin suchen oder kopieren können.
Wird meine Datei auf Ihre Server hochgeladen?
Nein. Das OCR läuft vollständig in Ihrem Browser dank Tesseract.js (eine WebAssembly-Kompilierung der Open-Source-Tesseract-Engine). Ihr PDF verlässt niemals Ihr Gerät. Sie können es selbst überprüfen, indem Sie den DevTools → Netzwerk-Tab während der Werkzeugausführung öffnen — es wird kein Datei-Upload durchgeführt, nur ein einmaliger Download der Erkennungs-Engine selbst.
Welche Sprachen werden unterstützt?
Die aktuelle Version erkennt Englisch (einschließlich Zahlen, Interpunktion und der meisten gängigen Symbole). Wir haben uns für die erste Version nur für Englisch entschieden, weil jede hinzugefügte Sprache die OCR-Modell-Downloadgröße ungefähr verdoppelt. Mehrsprachige Unterstützung ist in der Roadmap.
Was ist die maximale Dateigröße?
Das Werkzeug akzeptiert PDFs bis zu 50 MB und bis zu 50 Seiten. OCR ist speicher- und CPU-intensiv, und diese Limits halten die Erfahrung auf Mittelklasse-Laptops und Telefonen flüssig. Für größere Scans teilen Sie das Dokument zuerst mit unserem kostenlosen Werkzeug PDF aufteilen und führen Sie OCR auf jedem Teil aus.
Wie genau ist es?
Bei sauberen Scans bei 300 DPI mit Standardschriften liegt die Genauigkeit typischerweise bei 95 bis 99 %. Die Ergebnisse sinken bei Scans mit niedriger Auflösung (unter 200 DPI), Handschrift (Tesseract ist nicht für Schreibschrift konzipiert), stark schief gestellten Seiten oder sehr ungewöhnlichen Schriften. Wenn die Scanqualität schlecht ist, scannen Sie mit höherem DPI neu und versuchen Sie es erneut.
Kann ich das PDF immer noch normal lesen und drucken?
Ja — die Ausgabe sieht genauso aus wie das Original. Wir fügen den erkannten Text als unsichtbare Ebene hinter dem Bild hinzu, sodass die Seite identisch gerendert wird, aber der Text mit der Maus auswählbar und über Strg+F durchsuchbar wird. Nichts im sichtbaren Dokument ändert sich.
Was passiert mit Seiten, die bereits Text haben?
Seiten mit einer vorhandenen Textebene werden standardmäßig in Ruhe gelassen — es macht keinen Sinn, sie erneut zu OCR-bearbeiten. Wenn Ihr PDF eine Mischung aus gescannten und getippten Seiten ist, verarbeiten wir nur die gescannten. Sie können das mit einer Option überschreiben, wenn Sie OCR auf die gesamte Datei erzwingen möchten.
Warum dauert die erste Ausführung länger?
Beim ersten Verwenden von OCR PDF lädt Ihr Browser die Tesseract-Engine (ungefähr 2 MB WebAssembly) und das englische Erkennungsmodell (ungefähr 12 MB) herunter. Sie werden in Ihrem Browser zwischengespeichert, sodass nachfolgende Ausführungen in Sekunden starten.