Convertir Image en Markdown en ligne gratuitement

Convertissez gratuitement vos fichiers Image en Markdown en ligne. Importez un fichier et obtenez immédiatement un résultat propre, prêt pour les LLM. Sans inscription, 50 Mo par fichier, rien n’est conservé.

Convertir une image en Markdown : quand la forme de ce que vous avez photographié compte

Certaines images sont des images. D'autres sont des documents qui se trouvent piégés dans une image : une facture que quelqu'un a photographiée et envoyée par e-mail, une diapositive capturée dans une présentation qu'on ne vous donnera jamais, un formulaire rempli à la main, la page d'un livre posé sur votre bureau, un tableau blanc couvert d'une décision que personne n'a consignée ailleurs. Ce sont les mots de ces images qui comptent — et leur agencement aussi.

Envoyez-en une ici : le texte est reconnu et vous revient en Markdown. De la vraie reconnaissance optique de caractères, exécutée sur les pixels. Une facture photographiée revient avec son numéro, la société, la date, chaque ligne et son montant, et le total — le contenu réel, pas sa description. JPG, JPEG, PNG, GIF, BMP, TIFF, TIF et WebP fonctionnent tous. Gratuit, sans inscription, 50 Mo par fichier, rien n'est conservé une fois la conversion terminée.

Ce que vous récupérez, précisément

La sortie, c'est le texte reconnu et rien d'autre. Pas de données d'appareil photo, pas de propriétés de fichier, pas de préambule technique à faire défiler avant d'atteindre la partie utile. Vous envoyez la photo d'un document, vous obtenez les mots du document. Si vous attendiez un bloc d'en-tête décrivant l'image elle-même, ce n'est pas le propos : l'outil lit ce qui est dans l'image.

La qualité de reconnaissance suit celle de l'image, disons-le franchement. Une capture nette ou un export propre se lisent très bien. Une photo prise à la va-vite d'un écran de portable, de biais, avec une fenêtre qui s'y reflète, est un problème plus coriace et vous verrez peut-être passer un caractère erroné. L'écriture manuscrite, les polices scriptes ou décoratives, et le texte posé sur un fond chargé sont réellement difficiles. Rien de tout cela ne rend l'outil inutile sur une mauvaise image : cela veut simplement dire qu'il faut lire la sortie plutôt que la supposer.

Markdown ou texte brut ? La vraie différence

Voici ce que la plupart des pages de convertisseur ne vous diront pas. Sur une image simple — capture d'un paragraphe, photo d'une note manuscrite, panneau — Markdown et texte brut donnent en pratique le même résultat. Le texte reconnu arrive en lignes, et un bloc de prose ne contient aucune structure que le Markdown pourrait représenter et que le texte brut perdrait. Si vous choisissez le « mauvais » format pour une image simple, vous n'avez strictement rien perdu.

Le choix commence à compter quand ce qui est sur l'image a une forme. Un tableau, un formulaire avec libellés et valeurs, un ticket avec ses colonnes d'articles et de prix, une page de document avec titres et sections. C'est là que le Markdown gagne sa place, parce que barres verticales et dièses savent porter une grille ou une hiérarchie qu'un déversement plat ne peut que suggérer par l'espacement. Si vous cherchez à convertir une capture d'écran en tableau Markdown, vous êtes sur la bonne page. Si vous voulez juste les mots pour un champ de recherche, image vers texte est la page sœur, et c'est l'outil le plus simple pour la tâche la plus simple.

Le sélecteur de format en haut de page bascule entre les deux en emportant le fichier que vous avez déjà choisi : vous pouvez donc passer la même image dans les deux sens et juger par vous-même plutôt que de me croire sur parole.

Ce qui mérite qu'on pointe un objectif dessus

  • Factures et tickets de caisse. Le cas d'école. Un fournisseur envoie une facture photographiée au lieu d'un fichier, et il vous faut les lignes quelque part où on peut les additionner. Convertissez, vérifiez les totaux contre l'image, collez dans un tableur ou donnez le Markdown à un modèle en lui demandant de détailler.
  • Formulaires et dossiers. Les formulaires imprimés à champs remplis se convertissent en paires libellé-valeur réellement exploitables. Les saisies dactylographiées se lisent bien mieux que les manuscrites — bon à savoir avant d'en numériser deux cents.
  • Des diapositives dont vous n'avez que l'image. Une photo de slide prise en conférence, ou une capture issue d'un talk enregistré. Si vous avez la présentation d'origine, utilisez plutôt PowerPoint vers Markdown : préférez toujours la source. Quand vous ne l'avez pas, voilà comment en sortir le contenu.
  • Pages de livres et d'articles. La photo d'une page que vous voulez citer, résumer ou contester. Titres et sauts de paragraphe survivent au voyage d'une façon qui rend le résultat lisible plutôt que compact.
  • Tableaux blancs et paperboards. De face, avec une lumière correcte et une écriture lisible, vous obtenez un compte rendu de réunion exploitable. Une écriture au feutre tremblante et de biais vous en donnera une version partielle. Toujours plus rapide que de tout retranscrire soi-même.
  • Tableaux de bord et rapports en capture d'écran. Des chiffres dans une grille deviennent un tableau comparable à celui du mois dernier. Si les données sous-jacentes existent sous forme de fichier, Excel vers Markdown ou CSV vers Markdown battront n'importe quelle passe d'OCR, puisqu'il n'y a rien à deviner.

La règle du conteneur, et pourquoi elle vous épargne un envoi raté

C'est la partie à intégrer une fois pour toutes, parce qu'elle explique trois surprises d'un seul coup. Ici, l'OCR s'exécute sur le fichier image que vous envoyez. Elle ne s'exécute pas sur des images emballées dans un autre fichier. Si l'image n'est qu'une passagère dans un conteneur plus gros, c'est le conteneur qui est lu et l'image qui est ignorée.

  • Les PDF scannés reviennent vides. Un PDF qui est en réalité une photographie de papier ne contient aucun texte, et l'OCR ne va pas fouiller à travers l'enveloppe PDF. Lancez d'abord « reconnaître le texte » dessus — Acrobat, Aperçu sur macOS et la plupart des lecteurs PDF récents le proposent — ce qui en fait un PDF interrogeable, puis passez par PDF vers Markdown ou PDF vers texte. Un détour d'une minute, et c'est la bonne route pour les documents scannés.
  • Les images d'un ZIP ne sont pas reconnues. La conversion d'archive liste le nom du fichier image et passe son chemin. ZIP vers Markdown est excellent pour un dossier de documents et de tableurs ; pour des photos de documents, extrayez-les et envoyez chaque image séparément.
  • Les images intégrées dans un Word, un PowerPoint, un RTF, un EPUB ou un e-mail ne le sont pas davantage. Elles arrivent dans la sortie sous forme d'espace réservé, pas de texte. Un DOCX construit à partir de captures d'écran se convertit donc, via Word vers Markdown, en sa prose environnante plus une série de trous. Sortez les images du document et convertissez-les ici en tant que fichiers image.

La version en une phrase : si les mots que vous voulez sont dans une image, c'est l'image qui doit être le fichier envoyé.

Mieux faire lire une image difficile

  • Faites une capture d'écran plutôt que la photo d'un écran chaque fois que vous en avez la possibilité. Une capture offre un contraste parfait, aucun reflet, aucune déformation trapézoïdale et aucun tremblement de main. C'est le plus grand gain de qualité à votre disposition.
  • Recadrez sur le texte. Un tableau qui occupe un cinquième d'une photo large a moins de pixels par caractère que le même tableau remplissant le cadre, et cela se voit dans le résultat.
  • Gardez l'image droite et de face. Photographier une page en biais courbe les lignes de texte, et des lignes courbes sont plus difficiles à segmenter en rangées — ce qui pénalise justement les tableaux pour lesquels vous êtes venu.
  • Éclairez uniformément. Une ombre franche en travers d'un ticket, ou une tache de reflet sur un formulaire plastifié, emportera tout ce qu'elle recouvre.
  • Lisez la sortie avant de vous y fier. C'est sur les nombres que les erreurs font le plus mal : vérifiez les totaux et les codes de référence contre l'image. Le compteur de tokens sous la sortie vous indique ce que vous vous apprêtez à coller dans un modèle, ce qui est pratique quand vous empilez plusieurs pages dans un même prompt.

Questions fréquentes

Comment convertir une image en Markdown ?

Envoyez l'image ci-dessus : le texte reconnu vous est renvoyé avec une structure Markdown appliquée. Prise en charge de JPG, JPEG, PNG, GIF, BMP, TIFF, TIF et WebP, jusqu'à 50 Mo, gratuitement et sans compte. La sortie est du .md que vous pouvez coller dans un README, un site de documentation ou un prompt.

Quand le Markdown vaut-il vraiment mieux que le texte brut pour une image ?

Quand l'image a une forme. La capture d'un paragraphe se convertit à l'identique dans les deux cas : la prose ne recèle aucune structure que le Markdown pourrait baliser. Mais la capture d'un tableau, d'un formulaire, d'une grille tarifaire ou d'une page à titres possède un agencement qui mérite d'être conservé, et seul le Markdown sait le porter. Pour de la prose plate, image vers texte est le choix le plus simple.

Reconnaît-il un tableau dans une capture d'écran ?

Il tente un tableau à barres verticales, et le résultat dépend de la propreté de l'original. Les captures de vrais tableaux, avec filets visibles et espacement de colonnes régulier, se reconstruisent généralement bien. Les tableaux dont les colonnes ne sont séparées que par de larges blancs, ou dont les cellules débordent sur deux lignes, sont ceux où les frontières de colonnes sont mal devinées — vérifiez la ligne d'en-tête avant de faire confiance aux chiffres.

Gère-t-il une capture d'écran de code ?

Les caractères ressortent, mais traitez le résultat comme un brouillon. L'OCR n'a aucune notion de syntaxe : elle ne remarquera pas qu'elle a lu 0 là où la source avait O, ni qu'elle a perdu un niveau d'indentation dans un bloc Python. Très bien pour une pile d'appels que vous voulez rechercher. À ne pas coller dans un fichier pour l'exécuter.

Les images elles-mêmes sont-elles intégrées au Markdown ?

Non : la sortie est le texte trouvé à l'intérieur de l'image, pas une référence ![](...) vers l'image. Rien n'est déposé sur un CDN et aucun lien d'image n'est généré ; le Markdown est donc du texte brut autonome, sans dépendance externe.

Le reste de la boîte à outils

Les images sont l'un des treize formats pris en charge ici. File2Txt les accepte tous si vous préférez ne pas choisir de page à l'avance. Côté code, il y a le convertisseur de dépôt GitHub vers texte et un convertisseur de répertoire local pour un dossier de votre machine, et le guide de préparation des fichiers pour les LLM traite le cas général plus en profondeur.

Repo2Txt est conçu et maintenu par v12hero, un développeur indépendant qui crée des applications natives et web respectueuses de la vie privée.