PDF zu Word konvertieren

Zurück zur Startseite
Eine PDF-Datei hinzufügen — oder hierher ziehen
PDF

Über diesen PDF-zu-Word-Konverter

Dieses Werkzeug holt den Text aus einem PDF und übergibt ihn Ihnen als bearbeitbares Dokument. Es nutzt PDF.js, um die Textobjekte zu lesen, die die Datei bereits enthält — jedes Zeichen mit seiner Position auf der Seite — und gruppiert sie anhand ihrer senkrechten Koordinaten wieder zu Zeilen. Das Ergebnis wird entweder als Word-kompatible .doc-Datei oder als reine .txt geschrieben.

Es lohnt sich, die Erwartungen genau zu setzen, denn „PDF zu Word" verspricht mehr, als irgendein Konverter halten kann. Ein PDF beschreibt, wo jede Glyphe auf einer Seite sitzt; es hält nicht fest, dass eine Textfolge eine Überschrift, eine Aufzählung, eine Tabellenzelle oder ein zweispaltiges Layout war. Diese Struktur zu rekonstruieren ist Raterei, und dieses Werkzeug versucht es nicht. Sie erhalten den Text in Lesereihenfolge als Absätze — einen sauberen Ausgangspunkt zum Neuschreiben statt einer originalgetreuen Kopie.

Der Text wird in Ihrem Browser extrahiert und das Dokument dort zusammengesetzt. Nichts wird hochgeladen, anders als bei Konvertierungsdiensten, denen Sie die Datei übergeben müssen.

So wandeln Sie ein PDF in ein bearbeitbares Dokument um

  1. PDF laden. Ziehen Sie es in den Bereich. Die Datei braucht eine echte Textebene — siehe unten, falls Ihre ein Scan ist.
  2. Ausgabe wählen. Word-Dokument erzeugt eine .doc, die Word, Google Docs und LibreOffice öffnen. Reiner Text erzeugt eine .txt ganz ohne Formatierung.
  3. Umwandeln. Jede Seite wird der Reihe nach gelesen und ihr Text zu Zeilen und Absätzen gruppiert.
  4. Herunterladen und aufräumen. Öffnen Sie das Ergebnis und rechnen Sie damit, Überschriften, Listen und Tabellen neu zu setzen. Die Wörter und ihre Reihenfolge stimmen.

Was übernommen wird und was nicht

ElementErgebnis
FließtextGenau extrahiert, in Lesereihenfolge
AbsatzumbrücheAus den Zeilenpositionen rekonstruiert
SeitenumbrücheErhalten
Überschriften und FormatvorlagenVerloren — alles wird Fließtext
TabellenZu Textzeilen verflacht
Bilder und DiagrammeNicht enthalten
SpaltenIn der internen Reihenfolge der Datei gelesen, was sich verschränken kann

Wenn Ihr PDF ein Scan ist

Ein gescanntes Dokument enthält Fotografien von Seiten, keine Textobjekte. Für dieses Werkzeug gibt es nichts zu extrahieren, und es meldet, dass kein Text gefunden wurde. Nutzen Sie stattdessen die Texterkennung, die die Zeichen optisch erkennt und eine Textdatei erzeugt, mit der Sie arbeiten können.

Den Unterschied erkennen Sie in jedem PDF-Betrachter: Versuchen Sie, einen Satz mit der Maus zu markieren. Erscheint eine Textmarke und werden Wörter hervorgehoben, funktioniert dieser Konverter. Bekommen Sie nur eine rechteckige Auswahl über die ganze Seite, ist es ein Scan.

Häufige Fragen

Warum sieht mein umgewandeltes Dokument ganz anders aus als das PDF?

Weil ein PDF Glyphenpositionen speichert und keine Dokumentstruktur. Es gibt keinen Vermerk, dass etwas eine Überschrift, eine Tabelle oder eine Aufzählung war, also kann kein Konverter das zuverlässig wiederherstellen. Dieses Werkzeug extrahiert den Text getreu und überlässt Ihnen die Formatierung.

Aus meinem PDF wurde nichts extrahiert. Warum?

Ihre Datei ist mit ziemlicher Sicherheit ein Scan — Seitenbilder ohne Textebene. Nutzen Sie die Texterkennung, die die Zeichen stattdessen optisch erkennt.

Bleiben Tabellen erhalten?

Nein. Tabellenzellen sind in einem PDF nur positionierter Text, sie kommen daher als gewöhnliche Zeilen heraus. Komplexe Tabellen müssen meist von Hand neu aufgebaut werden.

Was unterscheidet die .doc- von der .txt-Ausgabe?

Die .doc behält Absatz- und Seitenumbrüche und öffnet sich in Word, Google Docs und LibreOffice. Die .txt ist reiner Text ganz ohne Struktur — nützlich zur Weitergabe an andere Software.

Sind Bilder aus dem PDF enthalten?

Nein. Nur die Textebene wird extrahiert. Brauchen Sie die Seiten als Bilder, nutzen Sie PDF zu JPG.

Wird mein Dokument hochgeladen?

Nein. PDF.js liest den Text in Ihrem Browser, und die Ausgabedatei wird vor dem Herunterladen lokal zusammengesetzt.

Verwandte Werkzeuge