ZIP in Markdown umwandeln: ein Upload, das ganze Archiv konvertiert
Dokumente einzeln zu konvertieren ist in Ordnung, bis es zwanzig sind. Dann sind es zwanzig Uploads, zwanzig Wartezeiten, zwanzig Mal Kopieren und Einfügen — und bei Datei vierzehn haben Sie den Überblick verloren, welche schon durch sind. Genau dieses Problem soll diese Seite abschaffen.
Ordner zippen. Das eine Archiv hochladen. Jedes unterstützte Dokument darin wird in einem Durchgang konvertiert und kommt als Markdown zurück, mit erhaltener Struktur je Datei und klar vom nächsten getrennt. Ein Stapelauftrag im Gewand eines Datei-Uploads — und dasselbe kostenlose Werkzeug wie der Rest der Reihe. Ohne Anmeldung, 50 MB Limit, danach bleibt nichts liegen.
Was mit Ihrem Archiv tatsächlich passiert
Das Archiv wird entpackt, der Dateibaum darin von oben nach unten durchlaufen, und jede Datei mit einer unterstützten Endung durchläuft dieselbe Konvertierung, die sie auch auf ihrer eigenen Seite bekommen hätte. Ein PDF in Ihrem ZIP wird genau wie ein direkt hochgeladenes PDF behandelt. Aus einer Tabellenkalkulation werden Tabellen. Aus einer Präsentation Abschnitte Folie für Folie. Anschließend werden die Ergebnisse zu einem Markdown-Dokument zusammengenäht.
Zwei Details wiegen schwerer, als man erwartet. Erstens: Die Ordnerstruktur im Archiv bleibt als
Kontext erhalten — Sie erkennen, dass 2024/q3/board-pack.pdf von woanders kommt als
archive/old/board-pack.pdf, was enorm wichtig wird, sobald sich Dateinamen über Verzeichnisse
hinweg wiederholen, und das tun sie immer. Zweitens: Das Archiv wird an Ort und Stelle entpackt,
nicht zu einem Haufen plattgemacht. Die Hierarchie, die jemand beim Ordnen dieser Dateien angelegt
hat, ist selbst Information, und sie wegzuwerfen macht die Ausgabe schwerer zu durchdringen.
Archive mit gemischten Formaten sind der Normalfall, nicht der Sonderfall. Ein ZIP mit vier PDFs, zwei Word-Dokumenten, einer Tabelle und einer PowerPoint-Präsentation konvertiert in einem Rutsch, jede Datei nach der Logik, die zu ihrem eigenen Format passt.
Was konvertiert wird und was übersprungen wird
Alles, was der Konverter als einzelnen Upload verarbeitet, funktioniert auch im Archiv — PDF, DOCX, PPTX, XLSX und XLS, HTML, CSV, JSON, XML, EPUB, RTF, MSG und Bilder. Wenn Sie genau wissen wollen, wie sich ein bestimmter Typ verhält, gehen die Einzelseiten ins Detail: PDF zu Markdown, Word zu Markdown, PowerPoint zu Markdown und Excel zu Markdown decken die vier häufigsten Dinge ab, die in einem beruflichen Archiv liegen.
Übergangen wird alles, was keinen Text hergibt. Videos, Audio, Schriften, kompilierte Binärdateien, Installer und proprietäre Formate außerhalb der unterstützten Liste tragen nichts bei und bleiben liegen. Bilder sind der Fall, auf den man hinweisen muss, weil er die Leute kalt erwischt. Einzeln hochgeladen werden Bilddateien richtig gelesen — Text in einem Screenshot oder auf einer abfotografierten Seite kommt als Text zurück. Im Archiv nicht. Der Stapeldurchlauf vermerkt, dass die Datei da war, und geht weiter. Ein ZIP voller Screenshots konvertiert also erfolgreich und liefert Ihnen trotzdem Dateinamen statt der Wörter auf den Bildschirmen. Wenn genau diese Wörter der Punkt sind, holen Sie die Bilder heraus und schicken Sie sie direkt durch Bild zu Markdown.
Verschachtelte Archive — ein ZIP in Ihrem ZIP — sind das andere, worauf Sie achten sollten. Kam Ihr Export als Archiv von Archiven, packen Sie eine Ebene selbst aus und zippen den Inhalt vor dem Upload neu. Zwei Minuten Aufräumen, deutlich bessere Ausgabe.
Warum Markdown für einen Stapel die richtige Wahl ist
Bei einem einzelnen Dokument ist Markdown statt flachem Text eine Ermessensfrage. Bei zwanzig Dokumenten in einer Ausgabe ist es keine knappe Entscheidung mehr.
Der Grund sind Grenzen. Wenn mehrere Dateien zu einem Textkörper aneinandergehängt werden, ist das Schwerste — für Sie wie für ein Sprachmodell — zu wissen, wo ein Dokument endet und das nächste beginnt. Markdown-Überschriften liefern das umsonst: Jede Datei meldet sich an, und alles darunter gehört sichtbar zu ihr. Fragen Sie ein Modell „welcher dieser Verträge hat die kürzeste Kündigungsfrist“, kann es pro Dokument antworten, statt Klauseln aus drei Vereinbarungen zu einer selbstsicheren, falschen Antwort zu verrühren.
Auch die Struktur je Datei überlebt. Die Tabellen der Tabellenkalkulation bleiben Tabellen. Die Folien der Präsentation bleiben getrennte Abschnitte. Die Klauselnummerierung des Berichts bleibt intakt. Das ist das ganze Argument dafür, Dokumente stapelweise nach Markdown zu konvertieren statt nach rohem Text: Struktur ist das, was einen Kontext aus vielen Dokumenten navigierbar macht statt bloß groß.
Die Ausnahme ist Massenanalyse — Embeddings, Suchindizierung, Stichwortarbeit über ein Korpus, alles, wo Sie einen flachen Haufen Fließtext wollen und Syntaxzeichen nur Rauschen sind. Dafür gibt es ZIP zu Text, und der Umschalter oben auf dieser Seite wechselt dorthin und behält das bereits gewählte Archiv.
Die Archive, die Leute tatsächlich hochladen
- Bündel von E-Mail-Anhängen. Jemand schickt „alles für die Prüfung“ als ZIP mit neun Anhängen. Konvertieren Sie den ganzen Stapel, lesen Sie die Zusammenfassung und entscheiden Sie, welche zwei Sie wirklich richtig öffnen müssen.
- Datenexporte. Google Takeout, Slack-Workspace-Exporte, Notion-Dumps und Ticketsystem-Exporte kommen alle als Archive voller verschachtelter Ordner. Das macht aus einem Verzeichnisbaum, durch den Sie sich sonst eine Stunde klicken, etwas in einem Durchgang Lesbares.
- Kursmaterialpakete. Ein Modul mit Vorlesungsfolien, Handouts und Literaturlisten in einem Download. Konvertieren, dann einen Lernleitfaden erstellen lassen, der auf den tatsächlichen Materialien beruht und nicht auf dem Allgemeinwissen des Modells.
- Kundenübergaben und Due-Diligence-Pakete. Ein Datenraum-Export, ein Dokumentenbündel eines Lieferanten, ein Projektübergabeordner — das Ganze wird in einem Schritt zu durchsuchbarem Text, und die Ordnerpfade sagen Ihnen, woher jedes Stück stammt.
- Förder- und Ausschreibungsunterlagen. Antworten über mehrere Dokumente mit Anlagen, bei denen Sie die Konsistenz über Dateien hinweg prüfen müssen, die verschiedene Leute geschrieben haben.
- Private Archive. Alte Backup-Ordner, bei denen Sie nicht mehr wissen, was drin ist. Erst konvertieren, dann graben.
Die 50-MB-Grenze und wie Sie darunter bleiben
Das Limit gilt für das hochgeladene Archiv, nicht für die einzelnen Dateien darin. Das ist meist großzügig, denn ZIP komprimiert textlastige Formate gut — ein Ordner aus Word-Dokumenten und Tabellen kann dramatisch schrumpfen, sodass auch Archive mit vielen Dateien oft bequem hineinpassen.
Was die Grenze sprengt, sind Mediendateien. Video, Audio und hochauflösende Bilder komprimieren kaum und verbrauchen das gesamte Budget, ohne zur Ausgabe beizutragen. Liegt Ihr Archiv darüber, werfen Sie diese heraus und zippen neu — Sie verlieren nichts, was Sie ohnehin verwendet hätten. Wirklich große Dokumentenbestände teilen Sie nach Ordnern in zwei oder drei Archive und konvertieren sie nacheinander.
Das andere Budget, das Sie im Auge behalten sollten, ist der Token-Zähler unter der Ausgabe. Fünfzig Dokumente konvertieren einwandfrei und passen trotzdem nicht in das Kontextfenster eines kleinen Modells. Die Zahl vor dem Einfügen zu kennen ist besser, als sie aus einer Fehlermeldung zu erfahren — und sie sagt Ihnen, ob Sie den ganzen Stapel schicken oder ihn in Portionen abarbeiten.
Wenn Ihr ZIP in Wahrheit ein Code-Projekt ist
Das gehört klar gesagt, weil es ständig vorkommt. Wenn Sie ein Repository oder einen Quellordner gezippt
haben, ist das hier das falsche Werkzeug. Nehmen Sie stattdessen den
Konverter für lokale Verzeichnisse — er
liest einen Ordner direkt von Ihrem Rechner, zeigt Ihnen einen Auswahlbaum der Dateistruktur und lässt Sie
genau bestimmen, welche Dateien in die Ausgabe wandern. Damit werfen Sie node_modules,
Build-Artefakte und Lockfiles hinaus, bevor sie Ihr komplettes Kontextfenster auffressen — etwas, das eine
blinde Archivkonvertierung nicht für Sie erledigen kann.
Projekt liegt schon irgendwo gehostet? Dann sparen Sie sich das Zippen ganz — der GitHub-Repository-zu-Text-Konverter holt den Baum direkt von der URL.
Häufige Fragen
Wie wandle ich ein ZIP-Archiv in Markdown um?
Laden Sie es oben hoch, und jede unterstützte Datei darin wird nach Markdown konvertiert und aneinandergehängt, wobei die Ordnerpfade des Archivs als Überschriften erhalten bleiben. Kostenlos, 50 MB pro Archiv, kein Konto. Das Ergebnis ist ein einziges .md-Dokument, in dem Sie weiterhin sehen, welcher Abschnitt aus welcher Datei stammt.
Werden die Dateipfade zu Überschriften?
Ja, und genau deshalb wählt man für ein Archiv Markdown statt flachem Text. Der Inhalt jeder Datei steht unter einer Überschrift, die ihren Pfad im ZIP nennt, die Ausgabe bleibt also navigierbar — und ein Modell, das nach einem bestimmten Dokument gefragt wird, findet es, statt aus dem Kontext zu raten.
Werden verschachtelte Archive verarbeitet?
Ein ZIP in einem ZIP gilt als weitere unterstützte Datei und wird seinerseits entpackt. Praktisch für Exporte, die Monatsarchive in einem Jahresarchiv bündeln. Sehr tiefe Verschachtelung sollten Sie vermeiden — die Ausgabe wird lang, und bei sechs Überschriftenebenen ist Schluss, danach lässt sich Struktur nicht mehr ausdrücken.
In welcher Reihenfolge kommen die Dateien heraus?
In der Reihenfolge des Verzeichnisdurchlaufs, Dateien gruppieren sich also nach Ordner und nicht nach Relevanz. Bei einem Archiv mit sinnvoller Ablage ist das genau richtig. Bei einem flachen Haufen aus zweihundert Dateien mit generierten Namen ist die Reihenfolge willkürlich, und Sie werden die Ausgabe eher durchsuchen als von oben nach unten lesen.
Gibt es eine Obergrenze für die Anzahl der Dateien darin?
Die praktische Schranke ist die 50-MB-Grenze für das Archiv, nicht eine Dateianzahl — behalten Sie aber den Token-Zähler unter der Ausgabe im Blick. Ein paar hundert Dokumente können die Kontextfenster der meisten Modelle um ein Mehrfaches überschreiten, deshalb ist es oft besser, nur die benötigte Teilmenge zu konvertieren, als ein Korpus zu erzeugen, das Sie nirgends einfügen können.
Der Rest des Werkzeugkastens
File2Txt deckt alle dreizehn unterstützten Formate an einer Stelle ab, wenn Sie sich nicht für eine Seite entscheiden wollen. Und der Leitfaden zur Aufbereitung von Dateien für LLMs führt das größere Argument dafür aus, vor dem Prompten zu konvertieren.
Repo2Txt wird entwickelt und gepflegt von v12hero, einem unabhängigen Entwickler, der native und Web-Apps mit Fokus auf Datenschutz baut.