PDF in Word umwandeln
Machen Sie aus jedem PDF ein bearbeitbares Word-Dokument – mit Bildern, einem Modus „Exaktes Aussehen“, der die Originalseiten nachbildet, und integrierter OCR für Scans. Es wird nichts gespeichert; Ihre Datei wird nie aufbewahrt.
- Nie gespeichert
- Keine Warteschlange, kein Warten
- Ohne Anmeldung, ohne Wasserzeichen
So funktioniert’s
PDF hinzufügen
Legen Sie ein PDF auf der Seite ab. Das Tool prüft es automatisch und schaltet OCR ein, wenn es einen Scan erkennt.
Modus wählen
„Bearbeitbarer Text“, die Standardeinstellung, liefert ein normales Word-Dokument, Seite für Seite wie das PDF: Absätze, Überschriften, Fett und Kursiv, Links und Bilder, jede Seite in ihrer Originalgröße mit eigenen Rändern und Zeilenabständen, sodass Seite 12 des PDFs auch Seite 12 des Dokuments ist – in einer Datei etwa so groß wie das PDF. „Exaktes Aussehen“ setzt jede Zeile genau an ihre Stelle über ein Bild der Seite – das bildet das PDF für den Druck nach, ist aber schwer zu bearbeiten und um ein Mehrfaches größer. Bei Scans schaltet sich OCR von selbst ein, ermittelt die Sprache anhand der ersten Seite und richtet schief gescannte Seiten gerade aus.
Umwandeln und herunterladen
Klicken Sie auf „In Word umwandeln“ und laden Sie eine saubere .docx mit Überschriften und Absätzen herunter, bereit zum Bearbeiten.
Was sich sauber umwandeln lässt und was nicht
Ein PDF speichert Glyphen an Koordinaten. Es hat keine Absätze und, sofern es nicht jemand bewusst getaggt hat, keine Überschriften – beides wird also erschlossen, nicht gelesen. Wörter auf einer gemeinsamen Grundlinie werden zu einer Zeile, ein größer werdender vertikaler Abstand beginnt einen neuen Absatz, und eine kurze Zeile, die etwa 1,6-mal so groß wie der mittlere Fließtext des Dokuments gesetzt ist, wird zu Überschrift 1, bei 1,3-mal zu Überschrift 2. Diese letzte Regel sollten Sie kennen, bevor Sie mit dem Bearbeiten beginnen: Ein Dokument, dessen Überschriften fett, aber nicht größer als der Fließtext sind, kommt als Fließtext an, und der Navigationsbereich von Word bleibt leer.
Links bleiben erhalten, was viele überrascht. Eine Link-Anmerkung über einem Textstück wird zu einem echten Word-Hyperlink, und ein Inhaltsverzeichniseintrag oder Querverweis, der auf Seite zwölf sprang, wird zu einem internen Link auf ein Lesezeichen am Anfang dieser Seite – ein Inhaltsverzeichnis funktioniert also auch nach der Umwandlung.
Zwei Dinge werden gar nicht gelesen. Die Antworten in einem ausgefüllten PDF-Formular stecken in Feldobjekten statt in der Seite, sind in „Bearbeitbarer Text“ also schlicht nicht vorhanden; „Exaktes Aussehen“ zeigt sie, weil sie Teil des Seitenbilds sind, aber nicht als bearbeitbaren Text. Kommentare und Stempel sind dieselbe Art Objekt und ergeht es genauso. Und in „Exaktes Aussehen“ wird die Grafik einmal mit 144 DPI gerendert und der echte Text darübergelegt, sodass ein Logo oder Diagramm, das im PDF ein Vektor war, in der .docx ein Bild ist – beim Vergrößern sieht man das.
Wenn Sie etwas anderes brauchen
Wenn Sie eher die Wörter als ein Word-Dokument brauchen, ist pdftotext -layout file.pdf aus Poppler schneller und berechenbarer, hält Spalten mit Leerzeichen auseinander und ist der übliche Weg, ein PDF in etwas anderes einzuspeisen. Und wenn das PDF ursprünglich aus einer Word-Datei erstellt wurde, fragen Sie den Ersteller nach der .docx: Jede Rückumwandlung ist eine Rekonstruktion aus Koordinaten, und das Original ist die einzige Fassung, die das nicht ist.
Tabellen sind die Schwachstelle jedes Konverters von PDF in irgendetwas, auch dieses hier. Besteht ein Dokument überwiegend aus Tabellen und kommt es auf die Zahlen an, sind Tabula und Camelot kostenlos, genau für dieses eine Problem gebaut und schlagen dabei jeden allgemeinen Konverter.
Häufig gestellte Fragen
Wird mein PDF beim Umwandeln gespeichert?
Nein. Beide Umwandlungsmodi speichern nichts – Ihre Datei wird nie aufbewahrt. Bei OCR werden die Texterkennung und das Sprachpaket beim ersten Mal von dieser Website geladen; Ihr Dokument selbst wird nirgendwohin gesendet.
Kann es gescannte PDFs und Fotos von Dokumenten umwandeln?
Ja. Schalten Sie OCR ein (das Tool schlägt es automatisch vor, wenn es einen Scan erkennt), und der Text wird aus den Seitenbildern gelesen. Die Sprache wird anhand der Seite erkannt – über 120 werden unterstützt, darunter Englisch, Bengalisch, Hindi, Urdu, Arabisch, Spanisch und Chinesisch –, und Sie können sie selbst wählen, falls die Vermutung falsch ist. Formulare mit Linien werden im Modus „Bearbeitbarer Text“ zu echten Word-Tabellen.
Wie genau ist die OCR?
Bei sauberen Scans von gedrucktem Text ist die Genauigkeit sehr hoch. Die Qualität sinkt bei unscharfen Fotos, Handschrift oder ungewöhnlichen Schriften. Klare, gerade, gut ausgeleuchtete Scans liefern die besten Ergebnisse.
Bleiben Formatierung und Bilder erhalten?
Ja. „Exaktes Aussehen“ behält jede Seite in ihrer Originalgröße und baut sie in zwei Ebenen neu auf: Jedes Foto, Logo, jedes Farbband und jede Vektorgrafik wird genau so wiedergegeben, wie das PDF es zeichnet, und der echte Text liegt darüber an seiner ursprünglichen Position, mit den Originalfarben, Fettdruck und Überschriften. „Bearbeitbarer Text“ baut stattdessen saubere Absätze und Überschriften mit Bildern in Lesereihenfolge auf, Seite für Seite wie das PDF – die bessere Wahl, wenn Sie viel bearbeiten möchten.
Welches Word-Format erhalte ich?
Eine Standard-.docx-Datei, die sich in Microsoft Word, Google Docs, LibreOffice und jedem modernen Editor öffnen lässt.
Gibt es eine Seiten- oder Dateibegrenzung?
Keine feste Grenze. OCR braucht ein paar Sekunden pro Seite, weil Ihr eigenes Gerät das Lesen übernimmt – sehr lange Scans dauern also einfach länger, und eine Fortschrittsanzeige zeigt genau, wo es gerade steht.
Gut zu wissen: Schriften werden durch ähnliche ersetzt, weil PDFs ihre eigenen Schriften einbetten und Word diese nicht verwenden kann – „Exaktes Aussehen“ ist daher nahezu, aber nicht pixelgenau identisch, und eine Zeile kann etwas breiter oder schmaler laufen als im Original. Tabellen in Text-PDFs werden als positionierter Text umgewandelt, nicht als Word-Tabellen; in Scans werden Tabellen mit Linien zu Word-Tabellen, solche ohne Linien bleiben positionierter Text. OCR ignoriert Fotos, Logos und dekorative Grafiken bewusst, damit sie nie zu Zeichensalat werden, belässt Handschrift und Stempel als Bilder und braucht ein paar Sekunden pro Seite.
Dieses Tool auf Ihrer Website einbinden
Kostenlos für jeden Blog, jede Kursseite und jeden Hilfeartikel. Fügen Sie ein einziges Snippet ein, und Ihre Besucher können das Tool direkt auf Ihrer Seite nutzen.
Weitere PDF-Tools
PDF in Text
Nur-Text zum Kopieren und Bearbeiten
PDF in Excel
Tabellen in eine echte Tabellenkalkulation
PDF bearbeiten
Vorhandenen Text ändern, ergänzen, zeichnen und unterschreiben
PDF in PowerPoint
Bearbeitbare Folien aus jedem PDF
PDF in JPG
Jede Seite als JPG-Bild
PDF in PNG
Scharfe, verlustfreie Seitenbilder