Convertir Imagen a Texto en línea gratis

Convierta archivos Imagen a Texto en línea de forma gratuita. Cargue su archivo y obtenga una salida limpia y lista para LLM al instante. Sin registro, 50 MB por archivo, nada almacenado.

Extraer texto de una imagen: saca las palabras y sigue con lo tuyo

Falla un build. El error son cuarenta líneas de traza de pila en una terminal desde la que no puedes copiar: una consola remota, una máquina virtual bloqueada, la captura de pantalla de un compañero pegada en el chat. Lo lees perfectamente. Lo que no puedes es seleccionarlo, y volver a teclear a mano la ruta de un paquete de Java es justo la forma en que nacen las erratas.

Para eso está esta página. Sube la captura y el texto que contiene se reconoce y vuelve como texto plano, listo para pegarlo en un buscador, en un asistente o en un issue. OCR de verdad sobre los píxeles, no una descripción del archivo. Lee JPG, JPEG, PNG, GIF, BMP, TIFF, TIF y WebP. Gratis, sin registro, 50 MB por archivo, no se guarda nada después. Es el caso de convertir imagen a texto en línea y gratis en su forma más literal: entra una foto, salen las palabras.

El bucle: captura, convertir imagen a texto y pegar

El motivo más habitual para extraer texto de una captura de pantalla es querer meter ese texto en algún sitio que solo acepta texto. Los buscadores no admiten imágenes. Tampoco el buscador de tu gestor de incidencias, ni tu agregador de logs, ni la caja donde pegarías una excepción para preguntarle a un modelo qué significa.

Así que el bucle es: captura, conversión, pegar. Diez segundos, y la diferencia se nota de verdad: a un asistente al que le das la clase de excepción exacta y los números de línea te responde algo concreto, mientras que a uno al que le das una paráfrasis vaga te devuelve una lista genérica. Lo mismo vale para diálogos de error, salida de CI, mensajes de la base de datos e informes de fallo. Si apareció en una pantalla como caracteres y no pudiste seleccionarlo, este es el atajo.

¿Texto plano o Markdown? La respuesta honesta

Aquí la mayoría de los sitios se inventaría una distinción dramática. La realidad es menos épica. Con una imagen sencilla —la captura de un párrafo, una ventana de terminal, una nota— el texto plano y el Markdown salen prácticamente idénticos. El texto reconocido llega en líneas, y en un bloque de prosa no hay ninguna estructura oculta que el Markdown pueda añadir. Elijas el que elijas, no pierdes nada.

La cosa empieza a contar cuando la imagen muestra algo con forma: una tabla, un formulario, la página de un documento con encabezados. El Markdown puede transportar esa disposición; el texto plano solo puede insinuarla con espacios. Para esos casos, imagen a Markdown es la página adecuada. Para todo lo demás —y «todo lo demás» son la mayoría de las capturas— el texto plano es el resultado más limpio, porque no hay caracteres de sintaxis que quitar antes de meterlo en un script, en un índice o en un diff.

El selector de formato de arriba cambia entre los dos y conserva el archivo que ya elegiste, así que probar ambos te cuesta una subida en vez de dos.

Trabajos cotidianos que esto resuelve sin ruido

  • Salida de terminal y de logs. La salida de un comando de una sesión por la que ya no puedes desplazarte hacia atrás, o una ventana de log capturada antes de que rotara. Pásalo a texto y podrás hacerle grep, compararlo con un diff o preguntar por él.
  • Capturas de chat y de correo. Conversaciones reenviadas como imágenes en lugar de como texto, que son casi todas. Conviértelas una vez y tendrás algo citable y buscable.
  • Carteles, etiquetas y embalajes. La foto de una placa con un número de serie, la etiqueta de un cableado, el panel de especificaciones de un producto. Incómodo de teclear, trivial de convertir.
  • Notas manuscritas. Vale la pena intentarlo, con expectativas realistas: la letra de imprenta cuidada se lee mucho mejor que la cursiva rápida, y conviene contrastar siempre el resultado con el original.
  • Código que solo puedes ver, no copiar. Un fragmento en un fotograma de vídeo, en una diapositiva o en un documento bloqueado. Sácalo como texto y combínalo con tu repositorio de GitHub en texto o con un proyecto de GitLab para que un asistente vea a la vez el fragmento y tu base de código.
  • Cualquier cosa que hayas capturado de una web. Costumbre que conviene abandonar: Web2Txt descarga la página directamente y mantiene los enlaces intactos, y HTML a Markdown se encarga de una página guardada. Volver a la fuente siempre gana a leer píxeles.

Dónde se ejecuta el reconocimiento y dónde no

Hay una sola regla que explica todos los modos de fallo que vale la pena conocer: el OCR trabaja sobre el archivo de imagen que subes, no sobre imágenes enterradas dentro de otros archivos. Una foto que viaja dentro de un contenedor más grande se salta, porque el conversor está leyendo el contenedor.

  • Un PDF escaneado no devuelve nada. Un PDF que solo contiene imágenes no lleva texto dentro, y el OCR no atraviesa la envoltura del PDF hasta los píxeles. Arréglalo en el origen: ábrelo en Acrobat, en Vista Previa de macOS o en casi cualquier lector de PDF moderno y ejecuta «reconocer texto» para convertirlo en un PDF con capa de texto; después usa PDF a texto o PDF a Markdown. Ese es el sitio correcto para los documentos escaneados.
  • Las imágenes dentro de un ZIP se listan, no se leen. La conversión de archivos comprimidos te da el nombre del archivo y poco más. ZIP a texto es la herramienta adecuada para una carpeta de documentos; para las imágenes, extráelas y sube cada una por separado.
  • Las imágenes incrustadas en Word, PowerPoint, RTF, EPUB o correo no se leen. Salen en el resultado como un marcador de posición de imagen. Un DOCX montado a base de capturas se convierte con Word a Markdown en el texto que las rodea, con huecos donde estaban las imágenes. Guarda las imágenes aparte y conviértelas aquí.

Llévate ese modelo mental y no desperdiciarás ni una subida: para leer una imagen, entrega la imagen.

Hacerlo en volumen y alimentar máquinas

El texto plano es el formato que quieres cuando la salida no va destinada a una persona. El texto reconocido de un montón de imágenes se concatena limpio, se trocea de forma predecible y pasa a embeddings sin arrastrar ruido de formato al vector, que es exactamente lo que necesitas cuando montas un índice de búsqueda sobre una pila de capturas o conviertes material de archivo fotografiado en algo recuperable.

La vía práctica es una imagen por subida, ya que los archivos comprimidos se saltan las imágenes: cuenta con un bucle, no con un lote único. El contador de tokens debajo del resultado sirve justo para esto: te dice cuánto cuesta realmente cada conversión antes de empezar a apilar páginas en un mismo prompt o a presupuestar una estrategia de troceado. Para los corpus mixtos —documentos junto a las imágenes—, File2Txt maneja todos los formatos admitidos desde un mismo sitio, y una conversión de directorio local aplana de una pasada toda la parte del proyecto basada en texto.

Pónselo fácil al reconocedor

La precisión sigue tan de cerca a la calidad de la imagen que un par de hábitos cambian tus resultados más que cualquier ajuste:

  • Haz una captura de pantalla en lugar de una foto a una pantalla. Sin reflejos, sin ángulo, sin desenfoque, sin muaré del monitor.
  • Recorta ajustado al texto que te interesa. Más píxeles por carácter es todo el secreto, y además evita que la salida se llene de elementos de interfaz que no pediste.
  • Mantén la imagen derecha y más o menos de frente. Las líneas torcidas cuestan más de leer que las rectas.
  • Evita los casos difíciles cuando puedas: capturas de baja resolución, texto sobre fotografías, tipografías caligráficas o decorativas y cualquier cosa a media sombra. Pueden funcionar, pero ahí es donde se acumulan los errores.
  • Revisa lo que importe. Un dígito mal leído en un número de referencia es silencioso y caro, y una ojeada de cinco segundos al resultado lo caza.

Preguntas frecuentes

¿Cómo extraer texto de una imagen JPG gratis?

Arrastra la imagen al conversor de arriba. El OCR se ejecuta sobre los píxeles reales y las palabras reconocidas vuelven como texto plano que puedes seleccionar, buscar y pegar. Gratis, sin registro, 50 MB por imagen. Es el caso literal de pasar de JPEG a texto: entra una foto, salen las palabras, no hay nada que instalar.

¿Funciona con PNG y con otros formatos de imagen?

Sí: JPG, JPEG, PNG, GIF, BMP, TIFF, TIF y WebP funcionan todos. PNG es el formato en el que llega la mayoría de las capturas y es el mejor escenario posible para el OCR, porque una captura es texto renderizado y no la fotografía de un papel: sin desenfoque de cámara, sin curvatura de página, sin iluminación desigual que compensar.

¿Puede leer notas manuscritas?

Mal, y más te vale asumir que no. Los modelos de OCR se entrenan de forma abrumadora con letra impresa; la cursiva y las mayúsculas hechas con prisa producen una salida que parece plausible y está equivocada justo en los sitios donde no se te ocurriría comprobar. Las mayúsculas de imprenta cuidadas sobre papel pautado a veces salen bien. Cualquier otra cosa hay que contrastarla con el original, y eso suele costar más que teclearla de nuevo.

¿Por qué mi imagen volvió con caracteres equivocados?

Resolución, casi siempre. El OCR necesita el equivalente a unos 300 DPI para separar formas parecidas, y por debajo de eso rn se funde en m, 1 y l se intercambian, y 0 se vuelve O. Una foto de móvil tomada más de cerca, o una captura hecha al tamaño completo de la ventana en vez de reducida, arregla casi todo.

¿Puedo sacar el texto de la foto de la página de un documento?

Sí, y funciona mejor de lo que la gente espera, pero aplana la página primero. Sujeta la cámara paralela al papel en lugar de en ángulo, consigue luz uniforme sin sombras cruzando el texto y llena el encuadre con la página. Las fotos con perspectiva trapezoidal o con sombras pierden líneas enteras, y el OCR no avisa de ningún error cuando ocurre.

¿La imagen se guarda en algún sitio después de la conversión?

No. Se envía para el reconocimiento, se procesa y se descarta en cuanto el texto está devuelto: no se archiva, no se usa para entrenar, no se indexa. No hay ninguna cuenta asociada ni se conserva copia alguna de nuestro lado.

Todo lo demás que hay aquí

Las imágenes conviven con otros doce formatos admitidos, todos accesibles desde File2Txt. Hay un artículo más largo sobre cómo preparar archivos para los LLM si prefieres el razonamiento general en vez del específico de las imágenes.

Repo2Txt está creado y mantenido por v12hero, un desarrollador independiente que crea aplicaciones nativas y web centradas en la privacidad.