Zum Inhalt springen

Dokument-Tools, bei denen die Formatierung erhalten bleibt

Neun Tools für Dokumente, Lebensläufe und E-Books, kostenlos und ohne Anmeldung. Fünf davon senden die Datei an unseren Server, der sie löscht, sobald Ihr Download bereit ist – und jedes sagt das auf seiner eigenen Seite.

9 Tools, ohne Anmeldung, ohne Wasserzeichen

Um etwas als PDF zu versenden, verarbeitet Word in PDF .docx-Dateien, ODT in PDF und RTF in PDF übernehmen, was andere Textverarbeitungen erzeugen, und Markdown in PDF macht aus einer README ein gesetztes Dokument. Für ein Buch, das Ihnen gehört: EPUB in PDF, MOBI in PDF und AZW3 in PDF. In die Gegenrichtung – Text aus einer Word-Datei oder einem PDF holen oder eine Webseite in etwas Bearbeitbares verwandeln – erledigen das DOCX in TXT, PDF in Text und HTML in DOCX, ohne dass die Datei Ihren Browser verlässt. Um einen Lebenslauf von Grund auf zu schreiben, setzt ihn Lebenslauf erstellen in einer von 54 Vorlagen. Die Hinweise unten erklären, was ein Dokument eigentlich alles enthält und was davon welche Umwandlung übersteht.

Dokumente erstellen

1 Tool

Einen Lebenslauf per Formular erstellen, in der Vorlage Ihrer Wahl.

Was ein Dokument enthält – und was jede Umwandlung damit macht

Eine .docx ist ein ZIP-Archiv aus XML-Dateien, und das meiste, was sie zu einem Dokument macht, ist nicht der Text. Es gibt Formatvorlagen – benannte Definitionen wie Überschrift 1, die sich viele Absätze teilen – und es gibt direkte Formatierung, bei der jemand eine Zeile markiert und auf Fett geklickt hat. Beides sieht gleich aus und verhält sich bei der Umwandlung völlig unterschiedlich: Eine Formatvorlage bleibt als Formatvorlage erhalten, direkt formatierter Text nur als die Formatierung, die dabei herauskam. Daneben liegen Nummerierungsdefinitionen, nachverfolgte Änderungen, Kommentare, Fußnoten, Kopf- und Fußzeilen, Textfelder, eingebettete Schriften und Dokumenteigenschaften, jeweils getrennt vom Absatztext gespeichert.

Listennummern sind das deutlichste Beispiel. Word speichert „1.“ nicht als Text, sondern als Verweis auf eine Nummerierungsdefinition und berechnet die Nummer erst beim Zeichnen der Seite. Textextraktoren, die nur das Absatz-XML durchgehen, lassen deshalb jede Nummer weg und liefern Ihnen eine unnummerierte Liste. DOCX in TXT baut sie stattdessen neu auf – „1.“, „1.1“, „a)“, „iii.“ – auch bei Listen, die im Dokument neu beginnen oder fortgesetzt werden.

Nachverfolgte Änderungen und Kommentare sind eine Entscheidung, kein Zufall. Ein Dokument in der Überarbeitung enthält sowohl den gelöschten als auch den eingefügten Text, in derselben Datei, markiert. DOCX in TXT liest es so, als wären alle Änderungen angenommen: Einfügungen bleiben, Löschungen fallen weg. Kommentare werden überhaupt nicht übernommen, was meist genau richtig ist, wenn der Nur-Text an die Öffentlichkeit geht. Fuß- und Endnoten erscheinen als [1]-Markierungen, gesammelt am Ende, Kopf- und Fußzeilen lassen sich einschalten, und Textfelder erscheinen jeweils einmal in Lesereihenfolge, statt wiederholt zu werden oder verloren zu gehen.

Was eine Umwandlung in PDF festschreibt, ist der Seitenumbruch. In einer Textverarbeitung wird bei jedem Öffnen neu berechnet, wo Seite vier endet – mit den Schriften und dem Druckertreiber dessen, der die Datei gerade öffnet. Deshalb kommt ein Dokument beim Empfänger mit einer auf zwei Seiten zerrissenen Tabelle an, bei Ihnen aber nicht. Ein PDF kennt diese Neuberechnung nicht: Die Seitenumbrüche wurden einmal, bei der Umwandlung, festgelegt und sind jetzt eine feste Eigenschaft der Datei. Word in PDF, ODT in PDF und RTF in PDF bekommen diese Umbrüche aus einem vollständigen Textverarbeitungs-Layout, nicht aus einem Browser, der eines nachahmt – deshalb landen Textfelder, Formen, Kopf- und Fußzeilen dort, wo der Autor sie platziert hat.

Was dabei verloren geht, sind Bearbeitbarkeit und Umfluss. Formatvorlagen werden zu sichtbarer Formatierung, die Gliederung wird zu Lesezeichen, und der Text bricht auf einem Smartphone-Bildschirm nicht mehr neu um. Im Dokument eingebettete Schriften werden unverändert verwendet; eine Schrift, die weder eingebettet noch für den Konverter verfügbar ist, wird durch ihr nächstes metrisch kompatibles Gegenstück ersetzt – die Zeilen brechen also an denselben Stellen um, auch wenn die Buchstabenformen anders aussehen.

E-Books haben keine Seiten, die man erhalten könnte. EPUB, MOBI und AZW3 sind umfließend – die Lese-App entscheidet, wo jede Seite endet, bei der Schriftgröße, die Sie gewählt haben –, „Seite 40“ ist also keine Eigenschaft des Buchs, und der Seitenumbruch in Ihrem PDF entsteht bei der Umwandlung aus der Seitengröße und den Rändern, die Sie auswählen. In der Datei stecken die Kapitelstruktur und das Inhaltsverzeichnis, und daraus werden echte PDF-Links und Lesezeichen. AZW3 bringt ein Stylesheet und oft eingebettete Schriften mit und sieht deshalb so aus, wie der Verlag es gestaltet hat; alte MOBI-Dateien haben überhaupt kein Stylesheet, weshalb eine umgewandelte MOBI schlichter aussieht als dasselbe Buch in der Kindle-App – die App hat Typografie hinzugefügt, die in der Datei nie enthalten war.

RTF ist durch und durch Text, weshalb es Jahrzehnte an Software überlebt. Der Haken ist die Zeichenkodierung: RTF ist älter als Unicode und speichert Text in alten Codepages – mitteleuropäisch, kyrillisch, griechisch, japanisch –, und genau daher kommt der Zeichensalat in schlecht umgewandelten RTF-Dateien. Hier wird jede davon korrekt dekodiert, ebenso wie moderner Unicode-Text.

Wo ein Browser wirklich das falsche Werkzeug ist

Einige dieser Tools halten Ihre Datei vollständig privat, andere geben sie an einen Server – und es lohnt sich, genau zu sagen, welche. PDF in Text, TXT in PDF, DOCX in TXT, HTML in DOCX und Markdown in HTML senden nie etwas – die Datei wird direkt hier gelesen, umgewandelt und geschrieben, und nichts verlässt das Gerät. Word in PDF, ODT in PDF, RTF in PDF, HTML in PDF, Markdown in PDF und die drei E-Book-Konverter wandeln auf unserem Server um, weil sich das Seitenlayout einer Textverarbeitung oder der saubere Seitenumbruch eines Buchs mit einer Webseite nicht vortäuschen lässt. Was gesendet wird, unterscheidet sich: Word-, ODT- und RTF-Dokumente gehen unverändert hinaus, während Markdown-Dateien und E-Books zuerst entpackt und zu einer Webseite zusammengesetzt werden – gesendet wird dann diese zusammengesetzte Seite. So oder so läuft die Übertragung über eine verschlüsselte Verbindung, die Datei wird umgewandelt und gelöscht, sobald Ihr Download bereit ist – es wird nichts gespeichert, protokolliert oder weitergegeben. Jedes dieser Tools weicht außerdem auf seinen eigenen Konverter aus, wenn der Server nicht erreichbar ist, und sagt Ihnen, wann das passiert ist und was der Ersatz nicht erhalten konnte.

Formate, die wir nicht öffnen. Alte binäre .doc-Dateien aus Word 97–2003 lassen sich mit Word in PDF problemlos umwandeln, weil der Server sie direkt liest – das browserbasierte DOCX in TXT kann das aber nicht und braucht eine .docx. Bei passwortgeschützten Dokumenten muss das Passwort in dem Programm entfernt werden, in dem es gesetzt wurde. Mit DRM geschützte Kindle-Bücher kann kein Konverter irgendwo öffnen – genau dafür ist der Schutz da –, und ebenso wenig Amazons neueres KFX-Format, das nur die Kindle-App liest.

Arbeit an langen Dokumenten. Zentraldokumente, Querverweisfelder, Stichwortverzeichnisse, automatisch erzeugte Rechtsgrundlagenverzeichnisse, Serienbriefe und Literaturverwaltungen sind Funktionen einer Textverarbeitung, und ein Konverter ist keine Textverarbeitung. Installieren Sie LibreOffice – es ist kostenlos, liest jedes Format auf dieser Seite und ist für diese Aufgaben schlicht das richtige Programm.

Stapelverarbeitung und Automatisierung. Diese Tools laufen, wenn ein Mensch klickt. Tausend Dateien nach Zeitplan umzuwandeln ist eine Aufgabe für die Kommandozeile, und die kostenlosen Werkzeuge dafür sind hervorragend: LibreOffice im Headless-Modus wandelt alles um, was Writer öffnen kann, Pandoc wechselt zwischen Markdown, HTML, DOCX, LaTeX und einem Dutzend weiterer Formate – mit mehr Kontrolle als jedes Webformular –, und Calibre verarbeitet E-Books in großen Mengen und wandelt zwischen allen ungeschützten E-Book-Formaten um, die es gibt.

Originalgetreues Layout in der Gegenrichtung. Ein aufwendig gestaltetes PDF wieder in ein bearbeitbares Dokument zu verwandeln, ist ein Rekonstruktionsproblem, keine Umwandlung, und nichts löst es perfekt – weder wir noch die teuren Desktop-Programme. Wenn das Originaldokument noch existiert, bearbeiten Sie dieses.

Die Wahl zwischen Tools, die ähnlich klingen

Markdown in PDF oder Markdown in HTML. Derselbe Parser, ein anderes Ziel. Markdown in PDF liefert ein Dokument mit Seiten, mit Schrift, Seitengröße und Rändern Ihrer Wahl, Überschriften als PDF-Lesezeichen und einem Inhaltsverzeichnis, das zur richtigen Seite springt – zum Drucken, Anhängen oder Archivieren. Markdown in HTML liefert entweder eine eigenständige, gestaltete Seite oder ein reines Snippet zum Einfügen in ein CMS – zum Veröffentlichen. Wenn Sie Markdown in Word möchten, gehen Sie über Markdown in HTML und dann HTML in DOCX.

Word in PDF oder ODT in PDF oder RTF in PDF. Darunter steckt dieselbe Umwandlung; sie unterscheiden sich nur darin, was Sie hineingeben. Word in PDF für .docx. ODT in PDF für alles aus LibreOffice, OpenOffice oder ein Google-Docs-Download im OpenDocument-Format. RTF in PDF für WordPad, TextEdit und die Briefe und Berichte, die Geschäftssysteme immer noch ausgeben. Die zur Dateiendung passende Seite zu wählen, ist weniger wichtig, als man denkt – wichtig ist nur, dass keines davon TXT in PDF ist, das von vornherein keine Formatierung zu erhalten hat.

TXT in PDF oder Markdown in PDF. TXT in PDF setzt Ihren Text als Text: eine Schrift, Ihre Ränder, keine Interpretation. Markdown in PDF liest # und * als Anweisungen und erzeugt Überschriften, Listen, Tabellen, hervorgehobenen Code und eine Lesezeichen-Gliederung. Geben Sie eine Markdown-Datei in TXT in PDF, bekommen Sie ein PDF voller Sternchen.

EPUB, MOBI und AZW3 in PDF. Alle drei nehmen mehr an, als ihr Name vermuten lässt, jedes davon öffnet also Ihre Datei; die Seiten unterscheiden sich, weil sich die Bücher unterscheiden. EPUB und AZW3 (KF8) bringen Stylesheets und oft eingebettete Schriften mit und sehen gestaltet aus. MOBI ist der ältere Container mit minimaler Formatierung, und das daraus umgewandelte PDF ist bewusst schlicht. Enthält eine Kindle-Datei beide Layouts, wird das neuere verwendet.

HTML in DOCX oder Markdown in HTML. HTML in DOCX setzt das Markup zuerst, sodass das aufgelöste CSS – Schriften, Größen, Farben, Abstände, Rahmen – als echte Word-Formatierung ins Dokument geschrieben wird, mit Word-Überschriftenformatvorlagen, echten Listen und echten Tabellen statt fest platzierter Kästen. Markdown in HTML erzeugt das Markup überhaupt erst. Keines von beiden führt jemals JavaScript aus.

DOCX in TXT oder PDF in Text. Beide liefern Ihnen Nur-Text, lesen dafür aber sehr unterschiedliche Dinge. Eine .docx weiß noch, was ein Absatz, eine Liste und eine Tabelle ist, deshalb kann DOCX in TXT Listennummern neu aufbauen und Tabellenzeilen zusammenhalten. Ein PDF weiß nur, wo jedes Zeichen gezeichnet wurde, deshalb erschließt PDF in Text Zeilen und Absätze aus ihrer Position – gut, aber nie so strukturgetreu. Wenn Sie sowohl das Originaldokument als auch ein PDF davon haben, extrahieren Sie aus dem Dokument.

DOCX in TXT oder in Word als .txt speichern. Der eigene Nur-Text-Export von Word lässt die Listennummerierung weg, verstümmelt Tabellen und hat eigene Vorstellungen von der Kodierung. DOCX in TXT baut die Nummerierung neu auf, schreibt Tabellen entweder als tabulatorgetrennte Zeilen, die sich in eine Tabellenkalkulation einfügen lassen, oder als ausgerichtete Spalten, die selbst bei Chinesisch und Japanisch ausgerichtet bleiben, und speichert UTF-8 mit den Zeilenenden, die Sie wünschen.

Worauf diese Tools aufbauen

Open-Source-Engines, die die eigentliche Arbeit leisten, und die Spezifikationen, die sie umsetzen.

  • LibreOfficeMPL-2.0 — übernimmt die Office-Umwandlungen, headless, auf unserem Server.
  • docxMIT — schreibt Word-Dateien im Browser.
  • markdown-itMIT — wertet Markdown nach der CommonMark-Spezifikation aus.
  • foliate-jsMIT — öffnet EPUB-, MOBI- und KF8-E-Books.
  • pdf-libMIT — setzt die PDFs des Lebenslauf-Tools, mit eingebetteten Schriften und markierbarem Text.
  • Google FontsOFL-1.1 — liefert die dreißig Schriften, in denen die Lebenslauf-Vorlagen gesetzt sind, von Inter bis EB Garamond.
  • LucideISC — zeichnet die Kontakt-Icons in den Lebenslauf-Vorlagen.
  • EPUB 3.3Specification — ist der W3C-Standard, den die E-Book-Tools lesen.

Häufig gestellte Fragen

Werden meine Dokumente irgendwo gespeichert?

Das hängt vom Tool ab, und jedes sagt es auf seiner eigenen Seite. PDF in Text, TXT in PDF, DOCX in TXT, HTML in DOCX und Markdown in HTML senden nie etwas – sie arbeiten in diesem Tab. Die Umwandlungen, die ein gesetztes PDF erzeugen – Word, ODT, RTF, HTML, Markdown und die drei E-Book-Formate –, senden die Datei über eine verschlüsselte Verbindung an unseren Server, weil sie ein echtes Seitenlayout brauchen; dort wird sie umgewandelt und sofort gelöscht, und es wird nichts gespeichert, protokolliert oder weitergegeben.

Warum sieht das PDF nicht genau so aus wie mein Dokument?

Fast immer liegt es an den Schriften. Ist eine Schrift weder in der Datei eingebettet noch für den Konverter verfügbar, wird der nächste metrisch kompatible Ersatz verwendet – gleiche Breiten, sodass nichts neu umbricht, aber andere Buchstabenformen. Betten Sie Ihre Schriften vor dem Umwandeln ein, wenn das Design exakt stimmen muss, oder verwenden Sie weit verbreitete Schriften.

Kann ich ein gekauftes Kindle-Buch umwandeln?

Nur, wenn es nicht DRM-geschützt ist. Bücher aus dem Kindle-Store sind verschlüsselt, und kein Konverter kann sie öffnen; das Tool erkennt eine geschützte Datei und sagt Ihnen das, statt seitenweise Zeichensalat zu erzeugen. DRM-freie Bücher – vom Autor, von Project Gutenberg, von einem Verlag, der sie so verkauft – werden normal umgewandelt.

Gibt es eine Dateigrößen- oder Tagesgrenze?

Es gibt kein Konto und kein Tageslimit. Die browserbasierten Tools sind durch den Arbeitsspeicher Ihres Geräts begrenzt. An unseren Server gesendete Dokumente dürfen höchstens 40 MB groß sein, und die Seite sagt Ihnen klar, wenn Ihre Datei darüber liegt, statt auf halbem Weg abzubrechen.

Gibt es ein Wasserzeichen?

Nein. Nichts hier stempelt einen Testversionshinweis auf Ihr Dokument, begrenzt die Seitenzahl oder verschlechtert das Ergebnis. Die Werbung auf der Seite hält das Angebot kostenlos.

Meine Datei ist eine .doc, keine .docx. Funktioniert das?

Mit Word in PDF ja – der Server liest das alte binäre .doc-Format direkt, ohne erneutes Speichern. Die browserbasierten Tools können das nicht: .doc ist ein völlig anderes Format, keine Variante von .docx, und es in einem Tab zu dekodieren, ist den Download nicht wert. Öffnen Sie die Datei einmal in Word oder LibreOffice, speichern Sie sie als .docx, und alles hier nimmt sie an.