Zum Werkzeug springen

Kategorien

PDFIn Word

PDF in Word

Holen Sie den Text eines PDFs in eine bearbeitbare .docx Datei. Das PDF wird von dieser Seite gelesen und nie an einen Server gesendet.

Prototyp auf Ihrem Gerät

Was es tut und was nicht

Es holt den Text zurück: die Lesereihenfolge, die Absätze, die Seitenumbrüche und die Überschriften, wo das PDF sie größer setzt. Es baut das Seitenlayout nicht nach: Spalten, Tabellen als echte Tabellen, Bilder und Schriften werden nicht übernommen. Ist Ihr PDF ein Scan oder das Foto eines Blattes, enthält es überhaupt keinen Text, und diese Seite sagt Ihnen das, statt Ihnen ein leeres Dokument zu geben.

Wählen Sie ein PDF von diesem Gerät zum Umwandeln.

Keine Begrenzung der Dateianzahl, kein Tageslimit, keine Warteschlange — die Arbeit passiert auf diesem Rechner. Wählen Sie eine Datei für den üblichen Ablauf, oder mehrere für Stapelergebnisse und ein einzelnes ZIP.

Über diese Umwandlung von PDF in Word

Wählen Sie ein PDF mit bis zu 150 MB und wandeln Sie es um. Die Textebene wird in der Seite gelesen, anhand der Zeichenkoordinaten wieder zu Zeilen und Absätzen gruppiert und in ein .docx geschrieben, das nach Ihrem PDF benannt ist. Das holt die Wörter zurück, nicht die Seite: Es ist eine Textextraktion, und die Seite sagt das über dem Button.

Ein PDF speichert Glyphen an Koordinaten, keine Absätze. Lesereihenfolge, Zeilengruppierung und Absatzgrenzen müssen deshalb aus der Geometrie rekonstruiert werden, und genau diese Rekonstruktion bekommen Sie. Herüber kommen: Lesereihenfolge, Absätze, Seitenumbrüche und in größerem Schriftgrad gesetzte Überschriften. Nicht herüber kommen: Layout, Spalten, Tabellen als Tabellen, Bilder und Schriften — das Ergebnis eine Konvertierung statt eine Extraktion zu nennen wäre übertrieben. Ein PDF ganz ohne Text — ein Scan oder das Foto eines Blattes — wird ausdrücklich abgelehnt, statt Ihnen ein leeres Dokument zu geben.

Läuft in diesem Tab — kein UploadKostenlos, ohne Konto, ohne Wasserzeichen

Schritt für Schritt

  1. 1PDF auswählenBis zu 150 MB. Die Datei wird im Speicher des Tabs geöffnet.
  2. 2UmwandelnDie Textebene wird gelesen und anhand der Zeichenkoordinaten zu Zeilen und Absätzen gruppiert.
  3. 3.docx herunterladenDas Dokument trägt den Namen Ihres PDFs und öffnet sich in Word, LibreOffice oder Google Docs.

Was übersteht und was nicht

Übersteht: die Lesereihenfolge, die Trennung in Absätze, Seitenumbrüche und größer gesetzte Überschriften, die als Überschriftenformat markiert werden.

Übersteht nicht: Seitenlayout, Spalten, Tabellen als Tabellen, Bilder und die Originalschriften. Wenn Sie das Dokument identisch brauchen, liefert das kein kostenloses Werkzeug; hier bekommen Sie die Wörter zurück, um sie bearbeiten zu können.

Wenn Ihr PDF ein Scan ist

Ein gescanntes PDF enthält keinen Text, sondern ein Bild von Text. Das Werkzeug lehnt es mit dieser Begründung ab, statt Ihnen ein leeres .docx zu geben.

Nutzen Sie dafür zuerst die PDF-Texterkennung, die die Zeichen im Browser erkennt, und wandeln Sie danach hier um.

Häufige Fragen

Bleibt die ursprüngliche Formatierung erhalten?
Nein. Erhalten bleiben Wörter, Lesereihenfolge, Absätze und Überschriften. Layout, Spalten und Tabellen nicht: Es ist eine Textextraktion, keine Nachbildung der Seite.
Muss ich mich anmelden oder eine E-Mail-Adresse angeben?
Nein. Kein Konto, keine E-Mail, kein Zusenden des Ergebnisses — die Datei verlässt Ihren Browser nie.
Funktioniert das mit einem gescannten PDF?
Nicht direkt: Ein Scan hat keine Textebene und wird ausdrücklich abgelehnt. Lassen Sie zuerst die Texterkennung laufen und versuchen Sie es dann erneut.