Конвертировать Изображение в Markdown онлайн бесплатно

Конвертируйте файлы Изображение в Markdown онлайн бесплатно. Загрузите файл и сразу получите чистый результат, готовый для LLM. Без регистрации, до 50 МБ, ничего не сохраняется.

Конвертировать картинку в Markdown: когда важна форма того, что вы сфотографировали

Одни картинки — просто картинки. Другие — документы, застрявшие в картинке: счёт, который кто-то сфотографировал и прислал по почте, слайд, заскриншоченный из презентации, которую вам никогда не отдадут, бланк, заполненный от руки, страница книги на вашем столе, доска, исписанная решением, которое больше нигде не зафиксировано. Слова на таких изображениях — самое главное, и их расположение тоже.

Загрузите такую сюда — текст распознаётся и возвращается вам как Markdown. Настоящее оптическое распознавание символов, работающее по пикселям. Сфотографированный счёт возвращается с номером, компанией, датой, каждой позицией с суммой и итогом — фактическое содержимое, а не его описание. Работают JPG, JPEG, PNG, GIF, BMP, TIFF, TIF и WebP. Бесплатно, без регистрации, 50 МБ на файл, после завершения конвертации ничего не хранится.

Что именно вы получаете обратно

На выходе — распознанный текст и ничего больше. Никаких данных камеры, свойств файла, технической преамбулы, которую надо промотать до полезной части. Вы загружаете фото документа — получаете слова этого документа. Если вы ожидали блок с описанием самого изображения — это не то, что здесь происходит: инструмент читает то, что внутри картинки.

Качество распознавания следует за качеством изображения — это честная формулировка. Чёткий скриншот или аккуратный экспорт читаются очень хорошо. Торопливое фото экрана ноутбука под углом, с отражённым в нём окном, — задача посложнее, и кое-где символ может распознаться неверно. Рукописный текст, рукописные и декоративные шрифты, текст на пёстром фоне — всё это по-настоящему трудно. Ничто из этого не делает инструмент бесполезным на плохой картинке — просто вывод нужно прочитать, а не принять на веру.

Markdown или обычный текст? Настоящая разница

Вот то, о чём большинство страниц-конвертеров вам не расскажет. На простом изображении — скриншоте абзаца, фото рукописной заметки, вывеске — Markdown и обычный текст дают фактически одинаковый результат. Распознанный текст приходит строками, и в куске прозы нет структуры, которую Markdown передал бы, а обычный текст потерял. Выбрали «не тот» вариант для простой картинки — не потеряли ровным счётом ничего.

Выбор начинает значить что-то, когда у изображённого есть форма. Таблица, бланк с подписями и значениями, чек с колонками позиций и цен, страница документа с заголовками и разделами. Вот где Markdown отрабатывает своё место: черты и решётки способны нести сетку или иерархию, на которую плоский дамп может лишь намекнуть пробелами. Если ваша задача — перевести скриншот таблицы в Markdown, вам нужна именно эта страница. Если же слова нужны просто для поисковой строки, картинка в текст — соседняя страница, и для простой задачи это более простой инструмент.

Переключатель формата наверху меняет один режим на другой и переносит уже выбранный файл с собой, так что можно прогнать одно изображение обоими способами и убедиться самим, а не верить мне на слово.

На что стоит наводить камеру

  • Счета и чеки. Классика жанра. Поставщик присылает сфотографированный счёт вместо файла, а вам нужны позиции там, где их можно посчитать. Сконвертируйте, сверьте итоги с картинкой, вставьте в таблицу или отдайте Markdown модели и попросите разложить по пунктам.
  • Бланки и заявления. Печатные бланки с заполненными полями конвертируются в пары «подпись — значение», с которыми реально можно работать. Напечатанные записи читаются куда лучше рукописных — стоит знать до того, как вы отсканируете две сотни таких.
  • Слайды, которые есть только картинками. Фото слайда с конференции или скриншот из записи доклада. Если у вас есть исходная презентация, используйте PowerPoint в Markdown — источник всегда предпочтительнее. Когда его нет, вот способ достать содержимое.
  • Страницы книг и статей. Фото страницы, которую вы хотите процитировать, пересказать или оспорить. Заголовки и границы абзацев переживают путь так, что результат читается, а не стоит стеной.
  • Доски и флипчарты. Съёмка фронтально, при приличном свете и разборчивом почерке даёт пригодную запись встречи. Пляшущий маркерный почерк под углом — частичную. Всё равно быстрее, чем расшифровывать самому.
  • Дашборды и отчёты в виде скриншотов. Числа в сетке становятся таблицей, которую можно сравнить с прошлым месяцем. Если исходные данные существуют файлом, Excel в Markdown или CSV в Markdown обойдут любой прогон OCR — гадать там просто не о чем.

Правило контейнера — и как оно спасает от впустую потраченной загрузки

Вот что стоит усвоить, потому что это объясняет сразу три отдельных сюрприза. OCR здесь работает с файлом изображения, который вы загрузили. Он не работает с картинками, завёрнутыми в какой-то другой файл. Если изображение едет пассажиром внутри большего контейнера, читается контейнер, а картинка пропускается.

  • Отсканированные PDF возвращаются пустыми. PDF, который на самом деле фотография бумаги, не содержит внутри текста, а OCR не пролезает сквозь PDF-обёртку. Сначала прогоните на нём «распознать текст» — он есть в Acrobat, «Просмотре» на macOS и большинстве современных PDF-читалок, — что превратит его в PDF с поисковым слоем, а затем используйте PDF в Markdown или PDF в текст. Это крюк в одну минуту, и для сканов это правильный маршрут.
  • Картинки внутри ZIP не распознаются. Конвертация архива перечисляет имя файла изображения и идёт дальше. ZIP в Markdown отлично подходит для папки документов и таблиц; фотографии документов распакуйте и загружайте каждое изображение по отдельности.
  • Изображения, встроенные в Word, PowerPoint, RTF, EPUB или письмо, тоже не распознаются. В вывод они приходят заглушкой, а не текстом. Поэтому DOCX, собранный из скриншотов, конвертируется через Word в Markdown в окружающую прозу плюс набор дыр. Вытащите картинки из документа и сконвертируйте их здесь как файлы изображений.

Версия в одно предложение: если нужные слова внутри картинки, загружать нужно именно картинку.

Как вытащить больше из трудного изображения

  • Скриншот вместо фотографии экрана — всегда, когда есть выбор. У скриншота идеальный контраст, нет бликов, нет перспективных искажений, нет дрожания рук. Это самая большая доступная вам разница в качестве.
  • Обрезайте до текста. Таблица, занимающая пятую часть широкого кадра, имеет меньше пикселей на символ, чем та же таблица во весь кадр, и на результате это видно.
  • Держите изображение вертикально и фронтально. Съёмка страницы под углом изгибает строки, а изогнутые строки труднее нарезать на ряды — что важнее всего именно для таблиц, ради которых вы сюда пришли.
  • Освещайте равномерно. Жёсткая тень поперёк чека или блик на ламинированном бланке заберут всё, что накроют.
  • Читайте вывод, прежде чем на него полагаться. Больнее всего ошибки в числах, так что сверяйте итоги и номера с картинкой. Счётчик токенов под выводом показывает, сколько вы собираетесь вставить в модель, — удобно, когда складываешь несколько страниц в один промпт.

Частые вопросы

Как перевести изображение в Markdown?

Загрузите картинку выше — распознанный текст вернётся уже со структурой Markdown. Поддерживаются JPG, JPEG, PNG, GIF, BMP, TIFF, TIF и WebP, до 50 МБ, бесплатно и без аккаунта. На выходе .md, который можно вставить в README, на сайт документации или в промпт модели.

Когда Markdown действительно лучше обычного текста для картинки?

Когда у изображённого есть форма. Скриншот абзаца конвертируется одинаково в обоих случаях — в прозе нет скрытой структуры, которую Markdown мог бы разметить. Но у скриншота таблицы, бланка, сетки с ценами или страницы с заголовками есть компоновка, которую стоит сохранить, и пронести её может только Markdown. Для плоской прозы картинка в текст — более простой выбор.

Распознает ли он таблицу на скриншоте?

Он попытается собрать Markdown-таблицу, и результат зависит от чистоты оригинала. Скриншоты настоящих таблиц с видимыми линиями сетки и ровными интервалами между колонками обычно восстанавливаются корректно. Таблицы, где колонки разделены только щедрыми пробелами или где ячейки переносятся на две строки, — вот где границы колонок угадываются неверно: проверьте строку заголовков, прежде чем доверять числам.

Справится ли он со скриншотом кода?

Символы пройдут, но относитесь к результату как к черновику. У OCR нет понятия синтаксиса, поэтому он не заметит, что прочитал 0 там, где в исходнике было O, или потерял уровень отступа в блоке Python. Годится для стектрейса, по которому нужно поискать. Не годится, чтобы вставить в файл и запустить.

А сами изображения встраиваются в Markdown?

Нет — на выходе текст, найденный внутри картинки, а не ссылка ![](...) на неё. Ничего не загружается на CDN и никакие ссылки на изображения не генерируются, так что Markdown — это самодостаточный обычный текст без внешних зависимостей.

Остальной инструментарий

Изображения — один из тринадцати форматов, которые здесь обрабатываются. File2Txt принимает любой из них, если не хочется сначала выбирать страницу. Для кода есть конвертер репозитория GitHub в текст и конвертер локального каталога для папки на вашей машине, а руководство по подготовке файлов для LLM подробнее разбирает общий случай.

Repo2Txt разрабатывает и поддерживает v12hero — независимый разработчик, создающий нативные и веб-приложения с приоритетом приватности.