Gescanntes PDF in Word umwandeln

Machen Sie aus einem Scan online per OCR ein bearbeitbares Word-Dokument

Ergebnis senden an:

Machen Sie aus einem gescannten PDF per OCR ein bearbeitbares Word-Dokument

Ein Scan ist ein Foto einer Seite. Die meisten Werkzeuge belassen es dabei: Sie erkennen die Wörter und verstecken sie in einer unsichtbaren Ebene unter dem Bild. Die Datei lässt sich durchsuchen, aber nicht ändern. Diese App baut das Dokument stattdessen neu auf. Die Wörter und ihre Positionen stammen aus der Texterkennung, die Struktur der Seite – Überschriften, Spalten, Tabellen, Bildunterschriften – wird getrennt ermittelt, und die Seite wird als echter Text, echte Tabellen und echte Bilder in einer Word-Datei (.docx) neu geschrieben.

Weil die Struktur vor dem Setzen des Textes gefunden wird, kommt eine Tabelle aus dem Scan als Tabelle mit eigenen Spalten zurück und nicht als Wand loser Zeilen. Ein Formular kommt mit seinen Beschriftungen und Werten zurück, paarweise ausgerichtet, so wie es gedruckt war. Überschriften bleiben Überschriften, und jede Seite des Scans bleibt eine Seite des Dokuments.

Die Sprache des Dokuments wird aus den Seiten selbst ermittelt, ein deutscher oder italienischer Scan braucht also keine Einstellung von Hand. Wörter, bei denen sich die Erkennung unsicher ist, werden erneut aus dem Scan gelesen statt geraten, und Zahlen und Kennnummern werden nie umgeschrieben. Ist die Datei fertig, sagt Ihnen eine Zeile, wie viele Seiten neu aufgebaut, wie viele Wörter korrigiert und wie viele als unsicher belassen wurden.

Heraus kommt eine .docx-Datei, die sich in Word, Google Docs oder Pages öffnen und wie jedes andere Dokument bearbeiten lässt. Bilder aus dem Scan werden mit Alternativtext übernommen, Überschriften sind als Überschriften ausgezeichnet, sodass ein Screenreader dem Dokument folgen kann – was ein Scan mit unsichtbarer Textebene nie erlaubt.

Es gibt Grenzen, die man kennen sollte. Der Text wird in einer einzigen Standardschrift neu gesetzt, die aufgebaute Seite stimmt also nicht Buchstabe für Buchstabe mit dem Scan überein: Das Layout bleibt, die Typografie nicht. Für Handschrift ist die Erkennung nicht gemacht, handschriftliche Notizen können als verstümmelte Wörter zurückkommen. Ein blasser, schiefer oder niedrig aufgelöster Scan kostet bei jedem Schritt Genauigkeit. Prüfen Sie das Ergebnis, bevor Sie sich darauf verlassen, und behalten Sie das Original.

Wenn Sie nichts bearbeiten müssen und die Seite pixelgenau gleich aussehen soll, ist «Durchsuchbares PDF» das richtige Werkzeug: Es behält das Bild und legt eine unsichtbare Textebene darüber. Dieses hier tauscht das exakte Aussehen gegen ein Dokument, das Sie ändern können.

Alles läuft im Browser, auf unseren Servern: ohne Installation, ohne Registrierung, ohne CAPTCHA. Bis zu 10 Dateien auf einmal, je 10 MB. Hochgeladene Dateien und Download-Links werden nach 24 Stunden gelöscht.

So wandeln Sie ein gescanntes PDF online in Word um

Die Texterkennung (OCR) liest die Wörter und ihre Positionen, die Seitenstruktur wird getrennt ermittelt, und das Dokument wird als echter Text, echte Tabellen und Bilder in einer .docx-Datei neu geschrieben.

  1. Laden Sie das gescannte PDF hoch – ziehen Sie es in den Ablagebereich oder klicken Sie dort, um die Datei auf Ihrem Rechner zu wählen.
  2. Prüfen Sie, ob die Seiten aufrecht und lesbar sind: Ein schiefer, blasser oder gering aufgelöster Scan kostet in jedem weiteren Schritt Genauigkeit.
  3. Klicken Sie auf UMWANDELN. Jede Seite wird erkannt, ihre Struktur ermittelt, und zweifelhafte Wörter werden erneut aus dem Scan gelesen.
  4. Lesen Sie die Zusammenfassung: wie viele Seiten neu aufgebaut, wie viele Wörter korrigiert und wie viele als unsicher belassen wurden.
  5. Laden Sie die .docx-Datei herunter und bearbeiten Sie sie in Word, Google Docs oder Pages – prüfen Sie dabei die als unsicher markierten Wörter.

Dateien werden nach 24 Stunden von unseren Servern gelöscht, danach funktionieren die Download-Links nicht mehr.

Fragen und Antworten