Was der Konverter nicht kann
Er baut den Text eines PDFs als Word Absätze neu auf. Manches, was ein PDF gar nicht wirklich speichert, kommt nicht zurück.
Keine gescannten PDFs
Eine gescannte Seite ist ein Bild ohne Textebene, daher kann das Tool sie nicht lesen. Nutzen Sie zuerst OCR für PDF und Bilder und fügen Sie den erkannten Text dann in ein Dokument ein.
Keine Bilder oder Tabellen
Nur Text kommt heraus. Bilder und echte Word Tabellen werden nicht extrahiert; die Zellen einer Tabelle erscheinen meist als einzelne Textzeilen.
Keine ursprüngliche Formatierung
Schriften, Farben, Fett- und Kursivschrift sowie mehrspaltige Layouts bleiben nicht erhalten, und zwischen den Quellseiten gibt es keinen echten Word Seitenumbruch, nur eine optionale Überschrift „Seite N“.
Der Zeilenumbruch ist eine Schätzung
Absatzumbrüche entstehen aus den gemessenen Abständen zwischen Textzeilen, nicht aus der echten Struktur des PDFs, daher können ungewöhnliche Layouts falsch umfließen. Wechseln Sie zu „jede Zeile als eigenen Absatz behalten“, wenn Absätze falsch zusammengefügt werden.
Nur eine Datei gleichzeitig
Die Warteschlange fasst ein einzelnes PDF, bis zu 100 MB. Für die andere Richtung nutzen Sie DOCX zu PDF.
Verwandte Tools
Häufige Fragen
Der Konverter baut den Text Ihres PDFs als bearbeitbare Word Absätze neu auf. Lesereihenfolge und Absatzumbrüche bleiben erhalten, Spalten, Tabellen, Bilder und die genaue Schriftgestaltung jedoch nicht, weil ein PDF positionierte Zeichen speichert, keine Dokumentstruktur.
Ein gescanntes PDF ist das Bild einer Seite ohne Textebene, daher kann dieses Tool es nicht lesen. Verarbeiten Sie die Datei zuerst mit OCR für PDF und Bilder, um den Text zu erkennen, und fügen Sie ihn dann in ein Dokument ein.
Das Tool kann es nicht öffnen. Entfernen Sie das Passwort in der Anwendung, mit der das PDF erstellt wurde, oder mit einem anderen PDF-Tool, und versuchen Sie es erneut.
Nein. PDF.js öffnet die Datei, und JSZip setzt das .docx Paket zusammen, vollständig in diesem Browser-Tab. Kein Byte Ihres Dokuments verlässt Ihr Gerät.
Ja. Das Tool schreibt ein standardkonformes Office Open XML WordprocessingML Paket, dasselbe .docx Format, in dem Word selbst speichert, sodass es sich in Microsoft Word, Google Docs, LibreOffice Writer, Pages und WPS Office öffnen lässt.
Standardmäßig werden umbrochene Zeilen wieder zu fließenden Absätzen zusammengefügt. Diese Einstellung behält stattdessen die ursprünglichen Zeilenumbrüche des PDFs bei, was sich für Tabellen, Code, Adressen und anderen Inhalt eignet, der nicht neu umfließen soll.
Ihre Datei bleibt auf Ihrem Gerät
PDF.js liest die Datei, und JSZip erstellt die .docx, beides innerhalb dieses Tabs. Ihr Dokument wird nicht hochgeladen oder gespeichert, und das Schließen des Tabs löscht es aus dem Speicher. Nur diese Bibliotheken werden heruntergeladen, vom cdnjs CDN.