RTF in Markdown umwandeln: Struktur aus einem Format von 1987 herausziehen
Öffnen Sie eine .rtf-Datei in einem Texteditor und Sie sehen so etwas wie
{\rtf1\ansi\deff0{\fonttbl{\f0 Times New Roman;}}\b Heading\b0\par. Das ist der ganze Trick des
Rich Text Format: reines ASCII, durchsetzt mit Steuerwörtern. \b schaltet Fettschrift ein,
\b0 wieder aus, \par beendet einen Absatz, und geschweifte Klammern begrenzen alles.
Microsoft hat es Ende der Achtziger entworfen, damit Textverarbeitungen verschiedener Hersteller Dokumente
austauschen konnten, und am Entwurf hat sich seither kaum etwas geändert.
Damit ist ein RTF-zu-Markdown-Konverter eine ziemlich ehrliche Übersetzungsaufgabe. Beide
Formate zeichnen Text inline aus. Aus fett wird **bold**, aus kursiv *italic*, aus
einer Liste eine Liste und aus einer Tabelle eine Pipe-Tabelle. Werfen Sie oben eine Datei ein und Sie haben
das Markdown in ein paar Sekunden — kostenlos, ohne Anmeldung, 50 MB Limit, nichts wird gespeichert.
Warum Ihnen immer noch RTF-Dateien untergeschoben werden
Niemand wählt 2026 freiwillig RTF. Es kommt trotzdem an, und fast immer aus einer dieser Ecken:
- Justiz und Rechtsverkehr. Portale für den elektronischen Rechtsverkehr, Transkriptionsdienste und Aktenverwaltungssoftware setzen auf RTF, weil es eine offene, stabile, überall lesbare Spezifikation ist, die nicht auseinanderfällt, wenn die Gegenseite sie mit einem Programm von 2009 öffnet.
- Patientenakten. Befunde, Entlassungsbriefe und Diktatausgaben liegen weit häufiger als Außenstehende vermuten als RTF-Blobs in Krankenhausinformationssystemen.
- Austausch in Verwaltung und öffentlichem Sektor. Dieselbe Begründung wie bei den Gerichten — langfristige Lesbarkeit schlägt das neueste Format.
- WordPad. RTF war jahrzehntelang dessen natives Speicherformat, entsprechend viel nebenbei geschriebene Dokumentation steckt darin.
- E-Mail-Anhänge und Rich-Text-Nachrichten. Der Rich-Text-Modus von Outlook erzeugt RTF, und es taucht auf, sobald Sie Inhalte aus MSG-E-Mail-Dateien extrahieren.
- Alte CRM- und Fallnotizfelder. Jede Anwendung, die vor der Zeit brauchbarer Web-Editoren ein Rich-Text-Feld mitbrachte, speichert wahrscheinlich RTF in einer Datenbankspalte.
Steuerwörter gegen echten Inhalt
Die gesamte Aufgabe der Konvertierung besteht darin, die beiden auseinanderzuhalten. Eine RTF-Datei beginnt mit einer Header-Gruppe, die eine Fonttabelle trägt, meist eine Farbtabelle, manchmal ein Stylesheet. Nichts davon ist Inhalt — es ist die Konfiguration des Dokuments selbst, und in einem kurzen Vermerk kann das leicht ein Drittel der Bytes ausmachen.
Nach dem Header folgt der Körper, in dem Steuerwörter und Text sich abwechseln. Einige Steuerwörter bilden sich sauber auf Markdown ab:
- Zeichenformatierung.
\b,\iund\ulwerden zu fett, kursiv und — weil Markdown keine Unterstreichung kennt — meist zu einfacher Hervorhebung oder zu nichts. Das ist ein echter Verlust, wenn ein Dokument definierte Begriffe unterstreicht, was in juristischen Texten oft der Fall ist. - Absätze und Umbrüche.
\parund\linewerden zu Absatz- und Zeilenumbrüchen. Unkompliziert. - Listen.
\pntextund die neuere\listtable-Mechanik werden zu Aufzählungszeichen und Nummerierungen, samt Verschachtelung, sofern die Quelle die Ebenen sauber deklariert hat. - Tabellen.
\trowd,\cellxund\celldefinieren Zeilen und Zellgrenzen explizit, sie lassen sich also zuverlässig zu Markdown-Pipe-Tabellen rekonstruieren. Das ist der Hauptgrund, Markdown gegenüber RTF zu reinem Text zu wählen — machen Sie eine Tabelle platt, ist die Spalte, zu der jeder Wert gehörte, endgültig weg.
Der heikle Fall sind Überschriften. RTF kennt benannte Absatzformate im \stylesheet, und wenn
der Autor sie verwendet hat, wird aus „Überschrift 1“ ein # und Sie bekommen eine echte
Dokumentgliederung. Aber RTF erlaubt auch direkte Formatierung — Zeile auf 18 pt und fett, fertig — und
sehr viele reale Dateien sind genau so entstanden. Wenn ein konvertiertes RTF flach herauskommt, mit fetten
Zeilen dort, wo Überschriften stehen müssten, ist das der Grund. Die Quelle hat nie „Überschrift“ gesagt.
Sie hat nur „groß und fett“ gesagt.
Eingebettete Objekte kommen nicht mit
RTF kann Binärdaten inline transportieren: Bilder als hexkodierte \pict-Gruppen und
OLE-Einbettungen — ein verknüpfter Excel-Bereich, ein Visio-Diagramm, ein Formelobjekt — als
\object-Gruppen. Deshalb kann ein RTF mit drei Screenshots 12 MB von etwas sein, das wie Text
aussieht.
Nichts davon wird zu Wörtern. Es gibt hier keine OCR, ein Screenshot einer Tabelle bleibt also ein Screenshot. Ein eingebettetes Tabellenobjekt hinterlässt allenfalls die einfache Darstellung, die daneben abgelegt wurde, und die kann unvollständig sein — wenn die Zahlen zählen, besorgen Sie sich die Ursprungsmappe und schicken Sie sie durch Excel zu Markdown. Fußnoten und Kommentare überleben meist als Text, landen aber am Ende des Flusses statt dort, wo sie verankert waren — prüfen Sie ihre Position, bevor Sie sich darauf verlassen.
RTF ist tatsächlich berechenbarer als DOCX
DOCX ist ein Zip-Archiv mit einem XML-Dokument plus Relationship-Dateien, einem Styles-Part, Nummerierungsdefinitionen und Content Types. Struktur steckt an mehreren Stellen gleichzeitig, und die verweisen aufeinander. Es konvertiert gut, aber es ist eine Menge.
RTF ist ein linearer Strom, den Sie von oben nach unten lesen können. Nichts ist komprimiert, es gibt keine Zip-Schicht, die kaputtgehen kann, und keinen Beziehungsgraphen. Wenn etwas seltsam konvertiert, öffnen Sie die Datei in einem Texteditor und sehen warum — das gilt für kein modernes Office-Format. Genau dieser Durchblick ist der Grund, warum regulierte Branchen dabeigeblieben sind.
Der Preis dafür: RTFs strukturelles Vokabular ist dünner. Keine semantische Gliederung, schwächere Durchsetzung von Formatvorlagen, keine Metadatenverfolgung, die den Namen verdient. Existiert Ihr Dokument in beiden Formaten, liefert DOCX in der Regel den reicheren Überschriftenbaum — Word zu Markdown ist das nähere moderne Gegenstück und die bessere Wahl, wenn Sie die Wahl haben.
Kodierungs-Eigenheiten in älteren Dateien
RTF ist älter als die Frage, ob Unicode sich durchsetzt, und Dateien von vor etwa Mitte der 2000er sieht man das an. Ein paar Muster, die Sie erkennen sollten:
- Codepage-Deklarationen. Der Header trägt etwas wie
\ansicpg1252für Windows Westeuropäisch. Eine Datei, die auf einem klassischen Mac oder mit einer kyrillischen oder mitteleuropäischen Codepage entstanden ist, deklariert etwas anderes — und ist diese Deklaration falsch oder fehlt sie, kommen akzentuierte Zeichen als völlig andere Buchstaben heraus. - Hex-Escapes. Nicht-ASCII-Zeichen erscheinen als Escapes im Stil
\'92— genau dieses steht in CP1252 für das typografische rechte Apostroph und ist die häufigste Einzelquelle versprengter Zeichen in konvertierten Altdokumenten. - Unicode mit Ersatzzeichen. Neuere Dateien verwenden
\uN?, wobei die Zahl ein Unicode-Codepunkt ist und das nachgestellte Zeichen ein Ersatz für zu alte Leseprogramme. Richtig behandelt bekommen Sie das echte Zeichen; naiv behandelt das Ersatz-Fragezeichen. - Schrottiges RTF. Viele Werkzeuge erzeugen RTF, das die Spezifikation nicht ganz einhält — unausgeglichene Klammern, erfundene Steuerwörter, abgeschnittene Gruppen. Die meisten Konverter fangen das ab, aber eine fehlerhafte Datei kann früh enden und Ihnen ein halbes Dokument hinterlassen. Stoppt die Ausgabe mitten im Satz, verdächtigen Sie die Datei.
Praktischer Rat: Überfliegen Sie das konvertierte Markdown nach Fragezeichen und Kästchen an den Stellen, wo Anführungszeichen, Gedankenstriche und Namen mit Akzenten stehen sollten. Fünf Sekunden — und Sie wissen, ob Sie dem Rest trauen können.
Wo das tatsächlich eingesetzt wird
- Durchsicht juristischer Dokumente. Nummerierte Klauseln bleiben in Markdown nummeriert, Sie können also ein Modell nach einer bestimmten Bestimmung fragen und bekommen eine Antwort, die die echte Klausel zitiert statt einer Umschreibung.
- Migration einer alten Dokumentationssammlung. Ein Ordner mit RTF-Arbeitsanweisungen, nach Markdown konvertiert, landet direkt in einem Git-Repo, wo er zum ersten Mal diff- und reviewbar wird.
- Klinische Befunde. Tabellarische Messwerte überleben als Tabellen, sodass eine Zusammenfassung die Abschnitte respektiert, statt sie zu vermischen.
- Einem Assistenten neben dem Code vorlegen. Konvertieren Sie die alte Spezifikation, kombinieren Sie sie mit Ihrem GitHub-Repository als Text, und das Modell sieht Anforderung und Umsetzung nebeneinander.
- Die Größe prüfen, bevor Sie einfügen. Der Token-Zähler unter der Ausgabe sagt Ihnen, was ein langes Dokument kostet — nützlicher, als es aus einem Abschneide-Fehler zu erfahren.
Der Format-Umschalter oben auf dieser Seite wechselt zwischen Markdown und reinem Text und behält die bereits gewählte Datei, sodass beide zu erzeugen und zu vergleichen einen Klick kostet.
Häufige Fragen
Wie wandle ich eine RTF-Datei in Markdown um?
Laden Sie die .rtf oben hoch, und sie kommt als Markdown zurück, mit erhaltener Formatierung überall dort, wo sie sich sauber abbilden lässt — fett, kursiv, Listen und Tabellen als Pipe-Tabellen. Kostenlos, 50 MB pro Datei, ohne Anmeldung. Als .md herunterladen.
Trägt RTF genug Struktur, damit sich Markdown lohnt?
Weniger als DOCX, mehr als reiner Text. RTF hält Formatierung fest, nicht Semantik: Es weiß, dass eine Zeile 18 pt und fett war, nicht, dass sie eine Überschrift 1 war. Überschriften werden also aus dem Erscheinungsbild erschlossen, und dieser Schluss ist unvollkommen. Fett, kursiv, Listen und Tabellen bilden sich zuverlässig ab; die Dokumentgliederung ist ein Best-Effort-Ergebnis.
Werden meine Überschriften korrekt erkannt?
Manchmal. Ein Dokument mit optisch konsistenten Überschriftengrößen ergibt meist eine vernünftige Gliederung. Eines, in dem der Autor die Größen nach Augenmaß variiert oder mitten im Absatz fetten Fließtext zur Hervorhebung benutzt hat, erzeugt Überschriften, wo keine gemeint waren. Lesen Sie den Anfang der Ausgabe und ziehen Sie die Gliederung von Hand gerade — das geht schneller, als es klingt, und muss nur einmal gemacht werden.
Warum taucht RTF 2026 überhaupt noch auf?
Vor allem wegen Altsystem-Exporten. Aktenverwaltungssysteme, Praxis- und Kliniksoftware, ältere Buchhaltungspakete und behördliche Dokumentenstrecken spucken weiterhin RTF aus, weil es ein dokumentiertes, stabiles, anwendungsneutrales Format ist, das jede Textverarbeitung öffnen kann. Genau deshalb ist es bis heute eine reale Aufgabe, einen ganzen Ordner davon zu konvertieren.
Markdown oder reiner Text für RTF?
Markdown, wenn die Datei ein formatiertes Dokument ist, das lesbar bleiben soll — ein Brief, ein Bericht, eine Vorlage. Reiner Text, wenn Sie viele Dateien verarbeiten und nur die Wörter wollen, was bei RTF angesichts der üblichen Herkunft dieser Dateien der häufigere Fall ist.
Der Rest des Werkzeugkastens
RTF ist eines von dreizehn Formaten, die hier behandelt werden. File2Txt nimmt jedes davon aus einem einzigen Upload. Verwandte Seiten, die man kennen sollte: PDF zu Markdown für Dokumente mit festem Layout, EPUB zu Markdown für E-Books, HTML zu Markdown für gespeicherte Webseiten und ZIP zu Markdown, wenn Sie ein ganzes Archiv alter Dateien auf einmal durchbekommen müssen.
Für Code und das Web gibt es den GitLab-Konverter, einen Konverter für lokale Ordner und Web2Txt für Live-Seiten. Der Leitfaden zur Aufbereitung von Dokumenten für LLMs führt das Argument im Allgemeinen aus.
Repo2Txt wird entwickelt und gepflegt von v12hero, einem unabhängigen Entwickler, der native und Web-Apps mit Fokus auf Datenschutz baut.