Skip to content
Choose language
Free

OCR PDF

Fügen Sie eine unsichtbare Textebene hinzu, damit ein gescanntes PDF durchsuchbar wird.

Drop a PDF, or click to browse

Free: up to 15 MB · 100 pages

OCR adds an invisible text layer so the PDF becomes searchable. Best on scanned documents — works on regular PDFs too. Free: up to 10 pages. Pro: up to 50 pages.

Über dieses Tool

OCR — Optical Character Recognition — fügt einem gescannten PDF eine unsichtbare Textebene hinzu, sodass das Dokument durchsuchbar wird und Text kopiert und eingefügt werden kann. Die Seitenbilder bleiben unangetastet, das Dokument sieht also identisch mit dem Original aus; nur die zugrunde liegenden Textdaten ändern sich. Wir unterstützen die Erkennung in Englisch, Französisch, Deutsch und Spanisch, ausgewählt beim Upload, damit die Engine das richtige Sprachwörterbuch nutzen kann.

OCR ist am nützlichsten bei gescannten Dokumenten — Kamera-Scans von Verträgen, Kopierer-Scans von Papierkram, Fotos von Textseiten. Es funktioniert auch bei regulären PDFs, bringt dort aber wenig: Ein aus Word oder einem Browser exportiertes PDF enthält bereits echten Text, den das Betriebssystem indizieren kann, also findet die OCR nichts Neues zu tun. Der Free tier verarbeitet bis zu 10 Seiten pro Upload; Pro erhöht das auf 50. Die Seitenlimits existieren, weil OCR deutlich CPU-intensiver ist als andere Operationen auf dieser Website.

So funktioniert es

  1. Gescanntes PDF ablegen

    Ziehen Sie ein gescanntes PDF in den Upload-Bereich oder klicken Sie, um eines auszuwählen. Es wird zur Verarbeitung über HTTPS hochgeladen und nach der Anfrage nicht absichtlich aufbewahrt.

  2. Sprache auswählen

    Wählen Sie die Sprache, die zum Dokument passt — Englisch, Französisch, Deutsch oder Spanisch. Die Wahl der falschen Sprache verringert die Genauigkeit drastisch.

  3. Klicken Sie auf Text extrahieren

    Wir lassen den Erkennungsdurchlauf über jede Seite laufen und fügen den erkannten Text als unsichtbare Ebene unter jedes Bild ein.

  4. Durchsuchbares PDF herunterladen

    Speichern Sie das Ergebnis lokal ab. Die Datei sieht genauso aus wie vorher, aber Sie können nun darin suchen, Text markieren und herauskopieren.

Wann es sinnvoll ist

  • Einen Stapel gescannter Verträge durchsuchbar machen, damit Sie Klauseln nach Schlüsselwort finden können, anstatt jede Seite zu lesen.
  • Gescannte Quittungen und Rechnungen indizieren, damit Buchhaltungstools und Suchleisten Text daraus extrahieren können.
  • Fotografierte Dokumente in ein durchsuchbares Archiv verwandeln — alte Briefe, handschriftliche Notizen (wenn deutlich geschrieben), Altakten.
  • Gescannte PDFs für die Stichwortsuche in Dokumentenmanagementsystemen vorbereiten, die nicht von selbst OCR durchführen.
  • Textpassagen aus gescannten Berichten wiederverwenden, ohne sie von Hand neu einzutippen — kopieren Sie stattdessen aus dem durchsuchbaren PDF.
  • Verbesserung der Barrierefreiheit: Screenreader können Text aus einem mit OCR bearbeiteten PDF vorlesen; reine Scans bieten ihnen nichts zum Lesen.

Häufig gestellte Fragen

Was bedeutet OCR?
OCR steht für Optical Character Recognition (Optische Zeichenerkennung). Es ist der Prozess, ein Bild von Text — wie eine gescannte Seite oder ein Foto eines Dokuments — zu betrachten und in tatsächliche Textzeichen umzuwandeln, die ein Computer lesen kann. Sobald ein PDF durch OCR bearbeitet wurde, können Sie es durchsuchen, Text herauskopieren und Screenreader können es vorlesen.
Wird das PDF nach der OCR anders aussehen?
Nein. Die visuelle Darstellung bleibt exakt erhalten — die Seitenbilder werden nicht angetastet. Wir fügen unter dem Bild eine unsichtbare Textebene hinzu, damit das Dokument durchsuchbar und auswählbar ist, aber jeder Pixel, den Sie sehen, bleibt genau wie beim Originalscan.
Welche Sprachen werden unterstützt?
Englisch, Französisch, Deutsch und Spanisch. Wählen Sie die Sprache, die dem dominierenden Text auf der Seite entspricht, wenn Sie hochladen — die Genauigkeit sinkt drastisch, wenn die Sprache falsch ist, da die Engine sprachspezifische Wörterbücher verwendet, um zwischen ähnlich aussehenden Zeichen zu entscheiden.
Warum liegt das Seitenlimit bei 10 kostenlos / 50 Pro?
OCR ist CPU-intensiv — jedes Zeichen auf jeder Seite zu erkennen, erfordert deutlich mehr Rechenleistung als ein einfaches PDF-Umschreiben. Die Seitenlimits verhindern, dass ein einzelner Upload den Server blockiert und alles für alle anderen verlangsamt. Wenn Sie ein längeres Dokument haben, teilen Sie es zuerst und wenden Sie OCR auf den relevanten Abschnitt an.
Funktioniert OCR bei einem Handy-Screenshot einer Textseite?
Meistens ja, wenn das Foto klar, im Fokus und gut beleuchtet ist. Unscharfe Aufnahmen, starke Schatten oder extreme Winkel liefern spürbar schlechtere Ergebnisse — Buchstaben werden falsch gelesen, Wörter werden verbunden oder getrennt und die Genauigkeit kann unter das nützliche Maß fallen. Für beste Ergebnisse scannen oder fotografieren Sie frontal bei gleichmäßiger Beleuchtung.
Warum scheint OCR bei meinem regulären PDF nicht viel zu bewirken?
Weil ein reguläres PDF — eines, das aus Word, einem Browser oder einem Design-Tool exportiert wurde — den Text bereits als Text enthält. Sie können es bereits durchsuchen und daraus kopieren. OCR ist für Dokumente gedacht, deren Text nur als Bilder existiert, wie ein Scan eines Papiervertrags oder ein Foto einer Quittung. Bei einem normalen PDF ist die Operation im Grunde wirkungslos.