PDF-Tool

OCR PDF: Texterkennung für PDF und Bild

OCR PDF: Text aus gescannten PDFs und Bildern erkennen, auf Deutsch, Englisch, Französisch, Spanisch, Arabisch oder Urdu, oder ein durchsuchbares PDF erstellen.

Seitenvorschau

Kein PDF geladen

Wählen Sie ein PDF, um die Seitenvorschau anzuzeigen.

Ihre Datei verlässt nie Ihr Gerät.

In wenigen Schritten

So funktioniert es

  1. 01

    Wählen Sie einen PDF-Scan oder ein JPG-, PNG- oder WebP-Bild und haken Sie die Sprache oder Sprachen des Dokuments an.

  2. 02

    Wählen Sie reinen Text oder durchsuchbares PDF und starten Sie die OCR; die Seiten werden nacheinander verarbeitet.

  3. 03

    Kopieren oder laden Sie den erkannten Text herunter oder laden Sie das durchsuchbare PDF herunter.

Gut zu wissen

Häufige Fragen

Welche Sprachen gibt es?

Englisch, Französisch, Spanisch, Deutsch, Arabisch und Urdu, einzeln oder kombiniert (zum Beispiel Arabisch und Englisch). Die Daten jeder Sprache werden einmalig bei der ersten Nutzung geladen: etwa 2,95 MB für Englisch, 0,71 MB für Französisch, 2,10 MB für Spanisch, 1,33 MB für Deutsch, 1,66 MB für Arabisch und 1,02 MB für Urdu, dazu etwa 1,5 MB für die Engine.

Lädt die OCR mein Dokument hoch?

Nein. Ihr Dokument wird in Ihrem Browser verarbeitet. Die OCR-Engine und die gewählten Sprachdaten werden von dieser Website geladen, und Ihr Dokument ist nie Teil dieser Anfragen.

Was ist ein durchsuchbares PDF?

Es behält das Seitenbild und fügt eine unsichtbare, per OCR erkannte Textebene hinzu, sodass sich Text markieren und durchsuchen lässt. Die Erkennung kann Fehler enthalten.

Warum gibt es einen Hinweis für Smartphones und Tablets?

Engine und Sprachdaten erfordern einen einmaligen Download von etwa 2 bis 5 MB, und die Erkennung braucht Arbeitsspeicher und Akku. Empfohlen werden eine stabile Verbindung und ein Gerät mit freiem Speicher.

Erkennt die OCR Handschrift?

Die gewählten Modelle sind für gedruckten Text gedacht. Handschrift, geringer Kontrast, Schräglage und ungewöhnliche Schriften verringern die Genauigkeit.

Wie genau ist die OCR für Arabisch und Urdu?

Das hängt stark vom Scan ab. Sauberer, gerader, hochauflösender Naskh-Druck liefert gute Ergebnisse; Nastaliq, das die meisten gedruckten Urdu-Texte verwenden, kleine Schrift und schiefe oder niedrig aufgelöste Scans führen zu mehr Fehlern. Prüfen Sie das Ergebnis immer, bevor Sie sich darauf verlassen.