Afbeelding voor Markdown: Wanneer de vorm van wat je fotografeert er toe doet
Sommige foto's zijn foto's. Anderen zijn documenten die toevallig in een foto gevangen zitten: een factuur voor iemand gefotografeerd en gemaild, een dia waarvan je een screenshot hebt gemaakt uit een kaartspel dat je nooit zult krijgen, een formulier ingevuld door hand, een pagina uit een boek op je bureau, een whiteboard bedekt met een beslissing die niemand anders heeft opgeschreven. De woorden in die beelden zijn waar het om gaat, en dat geldt ook voor de rangschikking ervan.
Upload er hier een en de tekst wordt herkend en aan u teruggestuurd als Markdown. Echt optisch karakter herkenning, draaiend op de pixels. Er komt een gefotografeerde factuur terug met het factuurnummer, het bedrijf, de datum, elk regelitem en het bedrag ervan, en het totaal: de daadwerkelijke inhoud, geen beschrijving ervan. JPG, JPEG, PNG, GIF, BMP, TIFF, TIF en WebP werken allemaal. Gratis, geen aanmelding, 50 MB per bestand, niets bewaard nadat de conversie is voltooid.
Wat u precies terugkrijgt
De uitvoer is de herkende tekst en niets anders. Geen cameradetails, geen bestandseigenschappen, geen technische gegevens inleiding om voorbij te scrollen voordat het nuttige gedeelte begint. U uploadt een foto van een document en u krijgt de woorden van het document. Als je een headerblok verwachtte dat de afbeelding zelf beschrijft, dan is dit niet wat dit is doet - het leest wat is binnen de foto.
Herkenningskwaliteit volgt de beeldkwaliteit, wat de eerlijke manier is om het te zeggen. Een scherpe schermafbeelding of een schone export leest heel goed. Een gehaaste foto van een laptopscherm schuin, met een raam erin weerspiegeld, is een moeilijker probleem en het kan zijn dat u af en toe een verkeerd karakter tegenkomt. Handschrift, script en decoratief lettertypen en tekst op een drukke achtergrond zijn allemaal echt moeilijk. Niets van dat alles maakt de tool nutteloos bij een slecht imago - het betekent alleen dat je de uitvoer moet lezen in plaats van er vanuit te gaan.
Markdown of platte tekst? Het echte verschil
Hier is iets dat de meeste converterpagina's u niet vertellen. Op een eenvoudige afbeelding: een screenshot van een alinea, a een foto van een handgeschreven notitie, een bordje — Markdown en platte tekst geven feitelijk hetzelfde resultaat. Herkende tekst arriveert als regels, en er is geen structuur in een blok proza dat Markdown kan weergeven die platte tekst verliest. Als je voor een eenvoudige afbeelding de "verkeerde" kiest, ben je helemaal niets kwijt.
De keuze begint er toe te doen wanneer het ding op de foto een vorm heeft. Een tabel, een formulier met labels en waarden, een ontvangstbewijs met kolommen met artikelen en prijzen, een documentpagina met kopjes en secties. Dat is waar Markdown verdient zijn plaats, omdat pijpen en hashes een raster of een hiërarchie kunnen dragen die alleen een platte dump kan bevatten impliceren door middel van spatiëring. Als je het probeert converteer een screenshot naar een Markdown tabel, dit is de gewenste pagina. Als u alleen de woorden voor een zoekvak nodig heeft, afbeelding naar tekst is de broer of zus-pagina en het is het eenvoudigere hulpmiddel voor een eenvoudiger klus.
De formaatschakelaar bovenaan schakelt tussen de twee en bevat het bestand dat je al hebt geselecteerd er overheen, zodat u dezelfde afbeelding in beide richtingen kunt weergeven en het zelf kunt zien in plaats van mij op mijn woord te geloven.
De dingen die de moeite waard zijn om een camera op te richten
- Facturen en bonnen. Het klassieke geval. Een leverancier stuurt een gefotografeerde factuur in plaats van een bestand, en u heeft de regelitems ergens telbaar nodig. Converteer, controleer de totalen tegen de afbeelding, plak deze op een blad of geef de Markdown aan een model en vraag hem om deze te specificeren.
- Formulieren en aanvragen. Afgedrukte formulieren met ingevulde velden worden omgezet in label-en-waarde paren waarmee u daadwerkelijk kunt werken. Getypte vermeldingen lezen veel beter dan handgeschreven vermeldingen – het is de moeite waard om te weten voordat je er tweehonderd scant.
- Dia's die u alleen als afbeeldingen heeft. Een conferentiefoto van een dia, of een screenshot van een opgenomen gesprek. Als je het originele kaartspel hebt, gebruik dan PowerPoint naar Markdown geef in plaats daarvan altijd de voorkeur aan de bron. Als u dat niet doet, krijgt u op deze manier de inhoud eruit.
- Boek- en artikelpagina's. Een foto van een pagina die u wilt citeren, samenvatten of bespreken. Kopjes en alinea-einden overleven de reis op een manier die het resultaat leesbaar maakt in plaats van een muur.
- Whiteboards en flip-overs. Met rechttoe rechtaan, fatsoenlijk licht en leesbaar schrijven krijg je een bruikbaar verslag van een vergadering. Een wankel handschrift met een marker in een hoek levert een gedeeltelijk schrijven op. Nog sneller in plaats van het zelf te transcriberen.
- Dashboards en rapporten als screenshots. Getallen in een raster worden een tabel die u kunt vergelijken tegen die van vorige maand. Als de onderliggende gegevens als bestand bestaan, Excel naar Markdown of CSV naar Markdown zal alles verslaan OCR-pas, omdat er niets geraden hoeft te worden.
De containerregel en waarom deze u een mislukte upload bespaart
Dit is het onderdeel dat de moeite waard is om te internaliseren, omdat het drie afzonderlijke verrassingen tegelijk verklaart. OCR draait hier door het afbeeldingsbestand dat u uploadt. Het werkt niet op afbeeldingen die in een ander bestand zijn verpakt. Als de foto is een passagier in een grotere container, de container wordt gelezen en de foto wordt overgeslagen.
- Gescande PDF's komen leeg terug. Een PDF die eigenlijk een foto van papier is, heeft geen tekst erin, en OCR komt niet binnen via de PDF-wrapper. Voer eerst "tekst herkennen" uit - Acrobat, Preview op macOS, en de meeste moderne PDF-lezers hebben het allemaal - waardoor het een doorzoekbare PDF wordt gebruik PDF naar Markdown of PDF naar tekst. Dat is een minuut omweg en het is de juiste route voor gescande documenten.
- Afbeeldingen in een ZIP worden niet herkend. Archiefconversie vermeldt de bestandsnaam van de afbeelding en gaat verder. ZIP naar Markdown is uitstekend geschikt voor een map met documenten en spreadsheets; voor foto's van documenten: pak ze uit en upload ze elk beeld op zichzelf.
- Afbeeldingen die zijn ingesloten in Word, PowerPoint, RTF, EPUB of e-mail worden ook niet herkend. Zij komen in de uitvoer terecht als tijdelijke aanduiding voor een afbeelding, niet als tekst. Dus een DOCX opgebouwd uit screenshots converteert met Woord naar Markdown in de omringend proza plus een reeks hiaten. Trek de afbeeldingen uit het document en converteer ze hier als afbeeldingsbestanden.
Versie met één zin: als de gewenste woorden in een afbeelding staan, moet de afbeelding het bestand zijn dat u uploadt.
Beter lezen van een moeilijk beeld
- Screenshot in plaats van een scherm te fotograferen wanneer je de mogelijkheid hebt. Een screenshot is perfect contrast, geen verblinding, geen trapeziumvervorming en geen handbewegingen. Het is de grootste kwaliteit verschil voor u beschikbaar.
- Bijsnijden tot aan de tekst. Een tabel die een vijfde van een brede foto beslaat, heeft minder pixels per teken dan hetzelfde tabel die het frame vult, en dat wordt weergegeven in het resultaat.
- Houd het beeld rechtop en recht. Als u een pagina onder een hoek opneemt, worden de tekstregels en gebogen lijnen gebogen zijn moeilijker in rijen te segmenteren – wat het belangrijkst is voor precies de tabellen waarvoor u hier kwam.
- Verlicht het gelijkmatig. Een harde schaduw in het midden van een bon, of een verblindende vlek op een gelamineerd formulier, zal dat wel doen haal eruit wat het bedekt.
- Lees de uitvoer voordat u erop vertrouwt. Bij cijfers doen fouten het meeste pijn, dus controleer de totalen en referenties codes tegen de afbeelding. De tokenteller onder de uitvoer vertelt u hoeveel u gaat plakken in een model, wat handig is als u meerdere pagina's in één prompt stapelt.
Veelgestelde vragen
Hoe converteer ik een afbeelding naar Markdown?
Upload de bovenstaande afbeelding en de herkende tekst wordt geretourneerd met de Markdown structuur toegepast. Ondersteunt JPG, JPEG, PNG, GIF, BMP, TIFF, TIF en WebP, tot 50 MB, gratis en zonder account. De uitvoer is .md u kunt het in een README, een doc-site of een modelprompt plakken.
Wanneer is Markdown eigenlijk beter dan gewone tekst voor een afbeelding?
Als de afbeelding een vorm heeft. Een schermafbeelding van een alinea wordt hoe dan ook identiek omgezet: er is geen verborgen structuur in proza die Markdown kan markeren. Maar een screenshot van een tabel, een formulier, een prijsraster of een pagina met koppen heeft een arrangement dat de moeite waard is om te behouden, en alleen Markdown kan dit dragen. Voor plat proza, afbeelding naar tekst is de eenvoudigere keuze.
Herkent het een tabel in een screenshot?
Er wordt een pijptafel geprobeerd en het resultaat houdt bij hoe schoon het origineel is. Schermafbeeldingen van echte tabellen met zichtbare rasterlijnen en consistente kolomafstanden worden doorgaans correct gereconstrueerd. Tabellen waarin kolommen alleen door royale witruimte worden gescheiden, of waar cellen zich op twee regels bevinden, zijn waar kolomgrenzen verkeerd worden geraden - controleer de koprij voordat u de cijfers vertrouwt.
Kan het een screenshot van de code aan?
De karakters komen door, maar behandelen het resultaat als een concept. OCR heeft geen concept van syntaxis, dus het zal niet merken dat het leest 0 waar de bron was O, of een niveau van inspringing in een Python-blok laten vallen. Prima voor een stacktrace die je wilt doorzoeken. Niet iets om in een bestand te plakken en uit te voeren.
Zijn de afbeeldingen zelf ingebed in de Markdown?
Nee: de uitvoer is de tekst in de afbeelding, niet een  verwijzing naar de afbeelding. Er wordt niets naar een CDN geüpload en er worden geen afbeeldingslinks gegenereerd, dus de Markdown is op zichzelf staande platte tekst zonder externe afhankelijkheden.
De rest van de gereedschapskist
Afbeeldingen zijn een van de dertien formaten die hier worden behandeld. File2Txt Neem er een van als je dat zou willen kies liever niet eerst een pagina. Voor code is er de GitHub opslagplaats naar tekstconverter en een lokale mapconverter voor een map op uw eigen machine, en de gids voor het voorbereiden van bestanden voor LLM's gaat dieper in op het algemene geval.
Repo2Txt is gebouwd en onderhouden door v12hero, een onafhankelijke ontwikkelaar die native- en web-apps bouwt die privacy voorop stellen.