PDFora
Pricing Alle Werkzeuge
👁️

OCR-PDF

Erkennen Sie Text in gescannten Dokumenten und Bildern – direkt in Ihrem Browser.

🔒 Ihre Dateien werden lokal in Ihrem Browser verarbeitet und niemals hochgeladen.
1

Hochladen

Wählen Sie Ihre Datei aus oder ziehen Sie sie per Drag-and-drop.

2

Anpassen

Wählen Sie Ihre Optionen — alles geschieht in Ihrem Browser.

3

Herunterladen

Speichern Sie die fertige Datei sofort. Keine Wasserzeichen.

Ein gescanntes PDF ist nichts weiter als ein Stapel Fotografien. Sie können darin nicht suchen, keinen Absatz kopieren und keine Vorgangsnummer herausziehen. Das OCR-Werkzeug von PDFora liest den Text in diesen Seitenbildern mit Tesseract aus – derselben quelloffenen Engine, die auch in ernsthaften Dokumenten-Pipelines im Einsatz ist – und übergibt Ihnen das Erkannte als saubere .txt-Datei, die Sie durchsuchen, bearbeiten und weiterverwenden können.

Das ist der entscheidende Unterschied zu anderen Angeboten: Diese Texterkennung läuft vollständig in Ihrem Browser. Nahezu jeder OCR-Dienst im Netz lädt Ihren Scan zur Verarbeitung auf einen Server. Unserer nicht. Die Erkennung findet auf Ihrem eigenen Gerät statt, ein eingescannter Reisepass, ein unterschriebener Mietvertrag oder ein Blatt mit Laborwerten wird also nirgendwohin übertragen. Bei solchen Dokumenten ist das keine nette Zugabe, sondern der ganze Punkt.

Derzeit erkennt das Werkzeug Englisch, Hindi, Spanisch und Französisch; die Sprache wählen Sie vor dem Durchlauf aus. Es ist kostenlos, ohne Registrierung, ohne Wasserzeichen und ohne Seitenkontingent. Die Geschwindigkeit hängt von Ihrem Gerät ab, da Ihr Prozessor die eigentliche Arbeit leistet – eine übliche Seite dauert auf einem modernen Laptop aber nur wenige Sekunden.

So führen Sie OCR für ein PDF online durch

  1. Öffnen Sie das Werkzeug „OCR für PDF“ auf PDFora in einem modernen Browser.
  2. Ziehen Sie Ihr gescanntes PDF auf das Ablagefeld oder wählen Sie es per Klick von Ihrem Gerät aus.
  3. Wählen Sie die Sprache des Dokuments: Englisch, Hindi, Spanisch oder Französisch. Die richtige Sprache verbessert die Genauigkeit erheblich.
  4. Klicken Sie auf „Text erkennen“ und lassen Sie Tesseract jede Seite lokal in Ihrem Browser verarbeiten.
  5. Verfolgen Sie den Fortschritt, während die Seiten abgearbeitet werden; längere Dokumente brauchen entsprechend mehr Zeit.
  6. Laden Sie den erkannten Text als .txt-Datei herunter und durchsuchen, bearbeiten oder kopieren Sie ihn nach Belieben.

When to use this tool

  • Den Text aus einem 60-seitigen gescannten Gerichtsurteil herausziehen, um gezielt nach einer Klausel zu suchen, statt jede Seite zu lesen.
  • Zitate aus abfotografierten Lehrbuchseiten für eine Hausarbeit übernehmen, ohne sie abzutippen.
  • Einen Ordner alter Papierrechnungen digitalisieren, damit Beträge und Rechnungsnummern zu durchsuchbaren Datensätzen werden.
  • Ein gescanntes behördliches Rundschreiben auf Hindi in bearbeitbaren Text verwandeln, um es zu übersetzen oder zusammenzufassen.
  • Den Text eines Dokuments retten, von dem nur noch ein Ausdruck existiert, indem Sie ihn einscannen und durch OCR schicken.
  • Besprechungsunterlagen und gedruckte Berichte in E-Mails zitierfähig machen, indem Sie den Text herauslösen statt Screenshots zu verschicken.

Tips for the best results

  • Geben Sie dem Werkzeug den saubersten Scan, den Sie haben. 300 DPI, gutes Licht und dunkler Text auf hellem Grund liefern eine weit bessere Erkennung als ein dunkles Handyfoto.
  • Richten Sie den Scan zuerst gerade. Schiefe Seiten bringen die Zeichenerkennung durcheinander – schicken Sie ein verkantetes Dokument vor der OCR durch das Entzerren-Werkzeug von PDFora.
  • Stimmen Sie die Spracheinstellung auf das Dokument ab. Ein spanischer Brief durch das englische Modell ergibt Kauderwelsch, und umgekehrt genauso.
  • Rechnen Sie auf Handys und älteren Laptops mit längeren Laufzeiten. Die Engine nutzt den Prozessor Ihres Geräts, ein 100-Seiten-Scan ist also eine Aufgabe für den Rechner und nicht für ein fünf Jahre altes Tablet.
  • Lesen Sie Zahlen gegen. OCR ist sehr gut, aber nicht perfekt, und Ziffern in Kontonummern oder Summen verdienen einen prüfenden Blick, bevor Sie sich darauf verlassen.

Häufig gestellte Fragen

Wird mein gescanntes Dokument zur Verarbeitung hochgeladen?

Nein, und das ist unter Online-OCR-Werkzeugen selten. Die Tesseract-Engine läuft in Ihrem Browser, jede Seite wird also auf Ihrem eigenen Gerät erkannt. Zu keinem Zeitpunkt geht etwas an einen Server, weshalb das Werkzeug für Ausweise, Verträge und medizinische Unterlagen geeignet ist.

Was bekomme ich als Ergebnis?

Das Werkzeug extrahiert den erkannten Text und stellt ihn Ihnen als herunterladbare .txt-Datei bereit. Von dort aus können Sie ihn durchsuchen, in ein Dokument einfügen oder in jeden anderen Arbeitsablauf einspeisen, der reinen Text benötigt.

Welche Sprachen werden unterstützt?

Derzeit stehen Englisch, Hindi, Spanisch und Französisch zur Verfügung. Wählen Sie vor dem Start die Sprache, die zu Ihrem Dokument passt, denn die Engine lädt ein sprachspezifisches Modell und die Genauigkeit hängt an der richtigen Wahl.

Wie genau ist die Texterkennung?

Bei einem sauberen, gut ausgeleuchteten Scan gedruckten Textes ist die Trefferquote in der Regel sehr hoch. Sie sinkt bei unscharfen Fotos, ungewöhnlichen Schriften, Handschrift oder starker Schieflage. Die Eingabequalität ist der mit Abstand größte Hebel – scannen oder entzerren Sie eine schlechte Seite lieber neu, bevor Sie es der Engine anlasten.

Warum ist die OCR auf meinem Gerät langsamer als auf dem meiner Kollegin?

Weil die Verarbeitung lokal läuft, richtet sich das Tempo nach Ihrer Hardware. Ein aktueller Laptop schafft Seiten in Sekunden, ein älteres Handy braucht spürbar länger. Der Gewinn dieser lokalen Verarbeitung ist vollständige Vertraulichkeit.

Gibt es eine Grenze bei Seiten oder Dateien, und kostet es etwas?

Keine Kosten, kein Konto, kein Wasserzeichen und kein Seitenkontingent. Sie dürfen ein ganzes Archiv an Scans durch die Erkennung schicken. Die einzige praktische Schranke ist die Zeit, denn lange Dokumente brauchen auf Ihrem eigenen Rechner entsprechend länger.