Afbeelding naar tekst: haal de woorden eruit en ga ermee aan de slag
Een build mislukt. De fout is veertig regels stacktrace in een terminal op een machine waarvan je niet kunt kopiëren - a externe console, een vergrendelde VM, de schermafbeelding van een collega geplakt in de chat. Je kunt het prima lezen. Je kunt het gewoon niet selecteren, en het handmatig opnieuw typen van een Java-pakketpad is de manier waarop typefouten worden uitgevonden.
Daar is deze pagina voor. Upload de schermafbeelding en de tekst erin wordt herkend en als gewoon weergegeven tekst die u in een zoekopdracht, een assistent of een probleem kunt plakken. Echte OCR op de pixels, geen beschrijving van de bestand. Het leest JPG, JPEG, PNG, GIF, BMP, TIFF, TIF en WebP. Gratis, geen aanmelding, 50 MB per bestand, niets opgeslagen daarna. Het is de afbeelding naar tekst converter online gratis hoofdlettergebruik in zijn meest letterlijke vorm: zet a beeld in, haal de woorden eruit.
De screenshot-naar-zoekvak-lus
De meest voorkomende reden waarom mensen dit nodig hebben extraheer tekst uit een screenshot is dat ze dat willen plaats die tekst ergens waar alleen tekst wordt geaccepteerd. Zoekmachines maken geen afbeeldingen. Jouw probleem ook niet tracker's zoekopdracht, uw logaggregator of het vak waarin u een uitzondering plakt om een model te vragen wat het is betekent.
De lus is dus: screenshot, converteren, plakken. Tien seconden, en het verschil is reëel: een assistent krijgt de exacte uitzonderingsklasse en regelnummers geven een specifiek antwoord, terwijl iemand met een vage parafrase een antwoord geeft generieke checklist. Hetzelfde geldt voor foutdialogen, CI-uitvoer, databaseberichten en crashrapporten. Als het verscheen op een scherm als karakters en je kon het niet selecteren, dit is de manier om dat te doen.
Platte tekst of Markdown? Het eerlijke antwoord
De meeste sites zouden hier een dramatisch onderscheid bedenken. De waarheid is minder dramatisch. Op een eenvoudige afbeelding — a screenshot van een paragraaf, een terminalvenster, een notitie – platte tekst en Markdown komen effectief terug identiek. Herkende tekst arriveert als regels, en er zit geen verborgen structuur in een blok proza Markdown om toe te voegen. Kies een van beide en je verliest niets.
Waar het begint te tellen is wanneer de afbeelding iets met een vorm laat zien: een tabel, een formulier, een documentpagina met kopjes. Markdown kan die regeling dragen; platte tekst kan er alleen maar naar verwijzen met behulp van de spatiëring. Voor degenen, afbeelding naar Markdown is hoe beter pagina. Voor al het andere (en 'al het andere' zijn de meeste schermafbeeldingen) is platte tekst het schonere artefact, omdat er geen syntaxistekens zijn die moeten worden verwijderd voordat deze in een script, een index of een diff terechtkomen.
De indelingsschakelaar bovenaan wisselt tussen de twee en behoudt het bestand dat je al hebt geselecteerd, dus probeer beide kost één upload in plaats van twee.
Alledaagse klusjes die dit stilletjes oplost
- Terminal- en loguitvoer. Commando-uitvoer van een sessie waar u niet doorheen kunt scrollen, of een logvenster dat werd vastgelegd voordat het wegdraaide. Zet het in tekst en je kunt het grep, differentiëren of vragen erover.
- Chat- en e-mailscreenshots. Gesprekken worden doorgestuurd als afbeeldingen in plaats van als tekst zijn de meeste van hen. Converteer één keer en je hebt iets dat kan worden geciteerd en doorzoekbaar.
- Bewegwijzering, labels en verpakkingen. Een foto van een serienummerplaatje, een bedradingslabel, een paneel met productspecificaties. Onhandig om opnieuw te typen, triviaal om te converteren.
- Handgeschreven notities. Het proberen waard, met realistische verwachtingen – netjes gedrukt leest veel beter dan snel cursief, en u moet het resultaat altijd vergelijken met het origineel.
- Code die u alleen kunt zien, niet kopiëren. Een fragment in een videoframe, een dia of een vergrendelde documenteren. Trek het eruit als tekst en koppel het vervolgens aan je GitHub opslagplaats als tekst of een GitLab-project zodat een assistent het kan zien het fragment en uw codebase samen.
- Alles wat u van een website heeft gescreenshot. Gewoonte die het waard is om te doorbreken – Web2Txt haalt de pagina rechtstreeks op en houdt de links intact, en HTML naar Markdown verwerkt een opgeslagen pagina. Teruggaan naar de bron is altijd beter dan het lezen van pixels.
Waar de herkenning plaatsvindt en waar niet
Er is één regel die elke foutmodus verklaart die de moeite waard is om te weten: OCR werkt op het afbeeldingsbestand dat u gebruikt uploaden, niet op afbeeldingen die in andere bestanden zijn verborgen. Een foto die in een grotere container rijdt, wordt overgeslagen, omdat de converter de container leest.
- Een gescande PDF retourneert niets. Een PDF met alleen afbeeldingen bevat geen tekst, en OCR niet reik via de PDF-wrapper naar de pixels. Repareer het bij de bron: open het in Acrobat, Preview op macOS, of bijna elke moderne PDF-lezer en voer "tekst herkennen" uit om er een doorzoekbare PDF van te maken, en gebruik deze vervolgens PDF naar tekst of PDF naar Markdown. Dat is de juiste plek voor gescande documenten.
- Afbeeldingen in een ZIP worden vermeld, niet gelezen. Archiefconversie geeft u de bestandsnaam en niets meer. ZIP naar tekst is de juiste tool voor een map met documenten; voor afbeeldingen: extraheer ze en upload elke afbeelding afzonderlijk.
- Afbeeldingen die zijn ingesloten in Word, PowerPoint, RTF, EPUB of e-mail worden niet gelezen. Ze komen door als tijdelijke aanduiding voor een afbeelding in de uitvoer. Een DOCX samengesteld uit screenshots converteert via Woord naar Markdown in de omringende tekst met gaten waar de afbeeldingen stonden. Sla de afbeeldingen op en converteer ze hier.
Neem dat model mee en je zult nooit meer een upload verspillen: om een foto te lezen, overhandig je de foto.
Doen op volume en voermachines
Platte tekst is het gewenste formaat als de uitvoer niet voor een mens bestemd is. Herkende tekst uit een stapel afbeeldingen worden netjes aaneengeschakeld, voorspelbaar opgedeeld en ingebed zonder opmaakruis in de vector over te brengen — en dat is precies wat u nodig hebt als u een zoekindex aan het opbouwen bent over een stapel schermafbeeldingen, of als u deze omdraait archiefmateriaal gefotografeerd tot iets terugvindbaars.
De praktische route is één afbeelding per upload, aangezien archieven afbeeldingen overslaan, dus plan een lus in plaats van een enkele partij. De tokenteller onder de uitvoer is hier handig: deze vertelt u hoeveel elke conversie bedraagt daadwerkelijk kosten voordat u begint met het stapelen van pagina's in één prompt of het budgetteren van een chunking-strategie. Voor de gemengde corpora — documenten naast de afbeeldingen — File2Txt verwerkt elk ondersteund formaat vanaf één plaats, en a conversie van lokale mappen vlakt de tekstgebaseerde kant van een project in één keer.
Geef de Herkenner een gemakkelijke tijd
De nauwkeurigheid volgt de beeldkwaliteit zo nauwkeurig dat een paar gewoonten uw resultaten meer veranderen dan welke instelling dan ook zou:
- Maak een screenshot in plaats van een foto van een scherm. Geen verblinding, geen hoek, geen onscherpte, geen moirépatroon het scherm.
- Snijd strak bij tot de gewenste tekst. Meer pixels per personage is het hele spel, en het stopt ook de uitvoer vult zich met interface-chroom waar je niet om hebt gevraagd.
- Houd de afbeelding met de juiste kant naar boven en ongeveer vierkant. Scheve lijnen zijn moeilijker te lezen dan rechte lijnen.
- Vermijd de moeilijke gevallen waarin dat wel mogelijk is: opnames met een lage resolutie, tekst over foto's, scripts en decoratieve lettertypen en alles wat half in de schaduw staat. Deze kunnen werken, maar ze clusteren fouten.
- Proeflees alles wat er toe doet. Een verkeerd gelezen cijfer in een referentienummer is stil en duur, en a Een blik van vijf seconden op de uitvoer valt op.
Veelgestelde vragen
Hoe converteer ik een JPG naar tekst?
Zet de afbeelding neer in de bovenstaande converter. OCR draait op de werkelijke pixels en de herkende woorden komen terug als platte tekst die u kunt selecteren, zoeken en plakken. Gratis, geen aanmelding, 50 MB per afbeelding. Dit is het letterlijke geval van jpeg naar tekstconverter: beeld erin, woorden eruit, niets te installeren.
Werkt het met PNG en andere afbeeldingsformaten?
Ja: JPG, JPEG, PNG, GIF, BMP, TIFF, TIF en WebP werken allemaal. PNG is het formaat waarin de meeste schermafbeeldingen binnenkomen en dit is het beste geval voor OCR, omdat een schermafdruk tekst is in plaats van een foto op papier – geen cameraonscherpte, geen paginakrulling, geen ongelijkmatige verlichting om te omzeilen.
Kan het handgeschreven notities lezen?
Slecht, en je moet aannemen van nee. OCR-modellen zijn grotendeels getraind op gedrukte letters; cursieve en gehaaste blokhoofdletters produceren uitvoer die er plausibel uitziet en fout is op de specifieke plaatsen waarvan u niet zou denken dat u ze zou controleren. Netjes gedrukte hoofdletters op gelinieerd papier komen soms door. Al het andere moet worden proefgelezen ten opzichte van het origineel, wat meestal meer kost dan overtypen.
Waarom kwam mijn afbeelding terug met de verkeerde karakters?
Resolutie, bijna altijd. OCR heeft grofweg het equivalent van 300 DPI nodig om vergelijkbare vormen te scheiden, en daaronder rn stort in m, 1 en l ruilen, en 0 wordt O. Een telefoonfoto die dichterbij is genomen, of een screenshot gemaakt op volledige venstergrootte in plaats van verkleind, lost het meeste op.
Kan ik tekst uit een foto van een documentpagina halen?
Ja, en het werkt beter dan mensen verwachten, maar maak eerst de pagina plat. Houd de camera evenwijdig aan het papier in plaats van schuin, zorg voor gelijkmatig licht zonder schaduw over de tekst en vul het kader met de pagina. Keystone- of schaduwfoto's verliezen hele lijnen, en OCR rapporteert geen fouten wanneer dit wel het geval is.
Wordt de afbeelding na de conversie ergens opgeslagen?
Nee. Het wordt ter herkenning verzonden, verwerkt en weggegooid zodra de tekst is teruggestuurd – niet gearchiveerd, niet gebruikt voor training, niet geïndexeerd. Er is geen account aan gekoppeld en er is geen kopie aan onze kant bewaard.
Al het andere hier
Afbeeldingen staan naast twaalf andere ondersteunde formaten, allemaal bereikbaar via File2Txt. Er is een langere artikel over het gereedmaken van bestanden voor LLM's als u het algemene argument wilt in plaats van het beeldspecifieke argument.
Repo2Txt is gebouwd en onderhouden door v12hero, een onafhankelijke ontwikkelaar die native- en web-apps bouwt die privacy voorop stellen.