Convertir un ZIP a Markdown: una subida y el archivo entero convertido
Convertir documentos de uno en uno está bien hasta que son veinte. Entonces son veinte subidas, veinte esperas, veinte copiar y pegar, y por el archivo catorce ya has perdido la cuenta de cuáles llevas hechos. Ese es el problema que esta página existe para eliminar.
Comprime la carpeta. Sube ese único archivo. Todos los documentos compatibles de dentro se convierten en una sola pasada y vuelven como Markdown, con la estructura propia de cada archivo intacta y claramente separada de la del siguiente. Es un proceso por lotes disfrazado de subida de archivo, y es la misma herramienta gratuita que el resto del conjunto. Sin registro, límite de 50 MB, sin guardar nada después.
Qué le pasa realmente a tu comprimido
El comprimido se descomprime, se recorre el árbol de archivos de arriba abajo, y cada archivo con extensión compatible pasa por la misma conversión que habría tenido en su propia página dedicada. Un PDF dentro de tu ZIP se trata exactamente como un PDF subido directamente. Una hoja de cálculo se convierte en tablas. Una presentación se convierte en secciones diapositiva a diapositiva. Después los resultados se cosen en un único documento Markdown.
Hay dos detalles que importan más de lo que la gente espera. El primero: la estructura de carpetas
del interior del comprimido se conserva como contexto. Puedes distinguir que
2024/q3/board-pack.pdf vino de un sitio distinto que archive/old/board-pack.pdf,
cosa que importa muchísimo cuando los nombres de archivo se repiten entre directorios, y siempre se repiten.
El segundo: el comprimido se descomprime en su sitio, no se aplana en un montón. La
jerarquía que alguien construyó al organizar esos archivos es información en sí misma, y tirarla hace que la
salida sea más difícil de interpretar.
Los comprimidos con formatos mezclados son el caso normal, no el incómodo. Un ZIP con cuatro PDF, dos documentos de Word, una hoja de cálculo y una presentación de PowerPoint se convierte de una vez, y cada archivo lo gestiona la lógica que corresponde a su propio formato.
Qué se convierte y qué se salta
Todo lo que el conversor maneja como subida individual funciona también dentro de un comprimido: PDF, DOCX, PPTX, XLSX y XLS, HTML, CSV, JSON, XML, EPUB, RTF, MSG e imágenes. Si quieres saber exactamente cómo se comporta un tipo concreto, las páginas individuales entran en detalle: PDF a Markdown, Word a Markdown, PowerPoint a Markdown y Excel a Markdown cubren las cuatro cosas más habituales que se encuentran en un comprimido de trabajo.
Lo que se pasa por alto es todo lo que no tiene texto que dar. Vídeos, audio, tipografías, binarios compilados, instaladores y formatos propietarios fuera de la lista de compatibles no aportan nada y se dejan en paz. Las imágenes son el caso que hay que señalar, y pilla a mucha gente. Subidos por su cuenta, los archivos de imagen se leen bien: el texto de una captura o de una página fotografiada vuelve como texto. Dentro de un comprimido, no. La pasada por lotes registra que el archivo estaba ahí y sigue, así que un ZIP de capturas se convierte correctamente y aun así te entrega nombres de archivo en lugar de las palabras que había en las pantallas. Si esas palabras son lo que importa, saca las imágenes y pásalas directamente por imagen a Markdown.
Los comprimidos anidados — un ZIP dentro de tu ZIP — son la otra cosa que hay que comprobar. Si tu exportación llegó como un comprimido de comprimidos, descomprime un nivel tú mismo y vuelve a comprimir el contenido antes de subirlo. Dos minutos de limpieza y una salida mucho mejor.
Por qué Markdown es la decisión correcta para un lote
Con un solo documento, elegir Markdown en vez de texto plano es una cuestión de criterio. Con veinte documentos en una sola salida, deja de estar reñido.
La razón son los límites. Cuando varios archivos se concatenan en un mismo cuerpo de texto, lo más difícil tanto para ti como para un modelo de lenguaje es saber dónde acaba un documento y empieza el siguiente. Los encabezados de Markdown te dan eso gratis: cada archivo se anuncia y todo lo que cuelga de él pertenece visiblemente a él. Pregúntale a un modelo «cuál de estos contratos tiene el plazo de preaviso más corto» y podrá responder por documento en lugar de mezclar cláusulas de tres acuerdos en una respuesta segura y equivocada.
La estructura de cada archivo también sobrevive. Las tablas de la hoja de cálculo siguen siendo tablas. Las diapositivas de la presentación siguen siendo secciones separadas. La numeración de cláusulas del informe se mantiene. Ese es todo el argumento para convertir documentos por lotes a Markdown en lugar de a texto crudo: la estructura es lo que hace que un contexto multidocumento sea navegable y no solo grande.
La excepción es el análisis masivo — embeddings, indexado de búsqueda, trabajo con palabras clave sobre un corpus, cualquier cosa donde quieras un único montón plano de prosa y los caracteres de sintaxis sean ruido. Para eso está ZIP a texto, y el selector de arriba cambia a esa página conservando el comprimido que ya hayas seleccionado.
Los comprimidos que la gente sube de verdad
- Paquetes de adjuntos de correo. Alguien manda «todo lo de la revisión» como un ZIP con nueve adjuntos. Convierte el conjunto, lee el resumen y decide cuáles dos necesitas abrir de verdad.
- Exportaciones de datos. Google Takeout, las exportaciones de espacios de Slack, los volcados de Notion y las exportaciones de sistemas de tickets llegan todos como comprimidos llenos de carpetas anidadas. Esto convierte un árbol de directorios por el que ibas a pasar una hora clicando en algo legible de una pasada.
- Paquetes de material docente. Las diapositivas, los apuntes y la bibliografía de un módulo entero en una sola descarga. Conviértelo y luego pide una guía de estudio construida a partir de los materiales reales y no del conocimiento general que el modelo tenga del tema.
- Traspasos de clientes y paquetes de due diligence. La exportación de un data room, el paquete documental de un proveedor, una carpeta de traspaso de proyecto: todo se convierte en texto buscable en un paso, con las rutas de carpeta indicándote la procedencia de cada pieza.
- Solicitudes de subvenciones y licitaciones. Respuestas multidocumento con anexos, donde necesitas comprobar la coherencia entre archivos que escribieron personas distintas.
- Archivos personales. Carpetas de copias de seguridad viejas de las que no recuerdas qué contienen. Primero convertir, luego escarbar.
La línea de los 50 MB, y cómo vivir por debajo
El límite se aplica al comprimido que subes, no a los archivos individuales de dentro. Normalmente es generoso, porque el ZIP comprime bien los formatos con mucho texto: una carpeta de documentos de Word y hojas de cálculo puede encoger de forma espectacular, así que los comprimidos con muchos archivos suelen caber con holgura.
Lo que se pasa del límite son los archivos multimedia. El vídeo, el audio y las imágenes de alta resolución apenas comprimen y se comerán todo el presupuesto sin aportar nada a la salida. Si tu comprimido se pasa de la raya, sácalos y vuelve a comprimir: no pierdes nada que fueras a usar. Los conjuntos documentales realmente grandes divídelos en dos o tres comprimidos por carpeta y conviértelos en secuencia.
El otro presupuesto que conviene vigilar es el contador de tokens bajo la salida. Cincuenta documentos se convierten sin problema y aun así no caben en la ventana de contexto de un modelo pequeño. Saber el número antes de pegar es mejor que enterarte por un error, y te dice si mandar el lote entero o trabajarlo por partes.
Si tu ZIP es en realidad un proyecto de código
Conviene decirlo sin rodeos, porque sale constantemente. Si has comprimido un repositorio o una carpeta de
código fuente, esta es la herramienta equivocada. Usa el
conversor de directorios locales: lee una
carpeta directamente de tu máquina, te enseña un árbol de casillas con la estructura de archivos y te deja
elegir exactamente cuáles entran en la salida. Eso significa que puedes tirar node_modules, los
artefactos de build y los lockfiles antes de que se coman tu ventana de contexto entera, algo que una
conversión a ciegas de un comprimido no puede hacer por ti.
¿El proyecto ya está alojado en algún sitio? Sáltate lo de comprimir: el conversor de repositorios de GitHub a texto saca el árbol directamente de la URL.
Preguntas frecuentes
¿Cómo convierto un archivo ZIP a Markdown?
Súbelo aquí arriba y cada archivo compatible de dentro se convierte a Markdown y se concatena, conservando las rutas de carpeta del comprimido como encabezados. Gratis, 50 MB por comprimido, sin cuenta. El resultado es un único documento .md en el que sigues viendo qué sección salió de qué archivo.
¿Las rutas de archivo se convierten en encabezados?
Sí, y esa es la razón para elegir Markdown en vez de texto plano para un comprimido. El contenido de cada archivo va bajo un encabezado que nombra su ruta dentro del ZIP, así que la salida sigue siendo navegable y un modelo al que preguntes por un documento concreto puede localizarlo en lugar de adivinar por el contexto.
¿Se manejan los comprimidos anidados?
Un ZIP dentro de un ZIP se trata como otro archivo compatible y se descomprime a su vez. Útil para exportaciones que agrupan comprimidos mensuales dentro de uno anual. El anidamiento muy profundo conviene evitarlo: la salida se alarga y los niveles de encabezado tocan fondo en seis, a partir de ahí la estructura deja de expresarse.
¿En qué orden salen los archivos?
En orden de recorrido de directorios, lo que significa que los archivos se agrupan por carpeta y no por relevancia. Para un comprimido con una organización con sentido eso es exactamente lo correcto. Para un volcado plano de doscientos archivos con nombres generados, el orden es arbitrario y querrás buscar en la salida en lugar de leerla de arriba abajo.
¿Hay un límite de número de archivos dentro?
La restricción práctica es el tope de 50 MB del comprimido, no un número de archivos, pero no pierdas de vista el contador de tokens bajo la salida. Unos cientos de documentos pueden superar varias veces la ventana de contexto de la mayoría de modelos, así que a menudo es mejor convertir solo el subconjunto que necesitas que producir un corpus que no puedas pegar en ninguna parte.
El resto de la caja de herramientas
File2Txt maneja los trece formatos compatibles desde un solo sitio si prefieres no elegir página. Y la guía para preparar archivos para LLM expone el argumento más amplio a favor de convertir antes de preguntar.
Repo2Txt está desarrollado y mantenido por v12hero, un desarrollador independiente que crea aplicaciones nativas y web centradas en la privacidad.