Tukar Imej kepada Teks Percuma Dalam Talian

Tukar fail Imej kepada Teks dalam talian secara percuma. Muat naik fail anda dan bersihkan, keluaran sedia LLM serta-merta. Tiada pendaftaran, 50 MB setiap fail, tiada apa yang disimpan.

Imej ke Teks: Keluarkan Perkataan dan Teruskan Dengannya

Pembinaan gagal. Ralatnya ialah empat puluh baris surih tindanan dalam terminal pada mesin yang anda tidak boleh salin daripada — a konsol jauh, VM yang dikunci, tangkapan skrin rakan sekerja yang ditampal ke dalam sembang. Anda boleh membacanya dengan sempurna. Anda tidak boleh memilihnya, dan menaip semula laluan pakej Java dengan tangan ialah cara kesilapan menaip dicipta.

Itulah gunanya halaman ini. Muat naik tangkapan skrin dan teks di dalamnya dikenali dan dikembalikan sebagai biasa teks yang anda boleh tampalkan ke dalam carian, pembantu atau isu. OCR sebenar pada piksel, bukan perihalan fail. Ia berbunyi JPG, JPEG, PNG, GIF, BMP, TIFF, TIF dan WebP. Percuma, tiada pendaftaran, 50 MB setiap fail, tiada apa yang disimpan selepas itu. Ia adalah penukar imej ke teks dalam talian percuma kes dalam bentuk yang paling literal: letakkan a gambar masuk, keluarkan perkataan.

Gelung Tangkapan Skrin ke Kotak Carian

Sebab yang paling biasa orang perlu ekstrak teks daripada tangkapan skrin adalah bahawa mereka mahu letakkan teks itu di tempat yang hanya menerima teks. Enjin carian tidak mengambil imej. Begitu juga isu anda carian penjejak, pengagregat log anda atau kotak tempat anda menampal pengecualian untuk bertanya model tentang bermakna.

Jadi gelungnya ialah: tangkapan skrin, tukar, tampal. Sepuluh saat, dan perbezaannya adalah nyata — seorang pembantu diberi kelas pengecualian tepat dan nombor baris memberikan jawapan khusus, manakala satu diberikan parafrasa samar-samar memberikan a senarai semak generik. Perkara yang sama berlaku untuk dialog ralat, output CI, mesej pangkalan data dan laporan ranap. Jika ia muncul pada skrin sebagai aksara dan anda tidak boleh memilihnya, inilah caranya.

Teks Biasa atau Markdown? Jawapan Jujur

Kebanyakan tapak akan mencipta perbezaan dramatik di sini. Kebenaran adalah kurang dramatik. Pada imej mudah - a tangkapan skrin perenggan, tetingkap terminal, nota — teks biasa dan Markdown kembali dengan berkesan serupa. Teks yang dikenali tiba sebagai baris, dan tiada struktur tersembunyi dalam blok prosa untuk Markdown untuk ditambahkan. Pilih salah satu dan anda tidak kehilangan apa-apa.

Di mana ia mula dikira ialah apabila gambar menunjukkan sesuatu dengan bentuk: jadual, borang, halaman dokumen dengan tajuk. Markdown boleh membawa susunan itu; teks rata hanya boleh membayangkannya dengan jarak. Bagi mereka, imej kepada Markdown adalah lebih baik muka surat. Untuk semua yang lain — dan "semua yang lain" ialah kebanyakan tangkapan skrin — teks biasa ialah artifak yang lebih bersih, kerana tiada aksara sintaks untuk dilucutkan sebelum ia masuk ke dalam skrip, indeks atau perbezaan.

Togol format di bahagian atas bertukar antara kedua-duanya dan menyimpan fail yang telah anda pilih, jadi cuba kedua-duanya kos satu muat naik berbanding dua.

Pekerjaan Setiap Hari Ini Selesaikan Dengan Senyap

  • Terminal dan keluaran log. Output arahan daripada sesi yang anda tidak boleh tatal semula, atau tetingkap log ditangkap sebelum ia diputar. Masukkannya ke dalam teks dan anda boleh melihatnya, membezakannya atau bertanya mengenainya.
  • Tangkapan skrin sembang dan e-mel. Perbualan dimajukan sebagai gambar dan bukannya teks, yang adalah sebahagian besar daripada mereka. Tukar sekali dan anda mempunyai sesuatu yang boleh disebut dan boleh dicari.
  • Papan tanda, label dan pembungkusan. Foto plat nombor siri, label pendawaian, a panel spesifikasi produk. Janggal untuk menaip semula, remeh untuk menukar.
  • Nota tulisan tangan. Berbaloi untuk dicuba, dengan jangkaan yang realistik — cetakan yang kemas banyak dibaca lebih baik daripada kursif pantas, dan anda harus sentiasa menyemak keputusan berbanding yang asal.
  • Kod yang anda hanya boleh lihat, bukan salin. Coretan dalam bingkai video, slaid atau berkunci dokumen. Tarik keluar sebagai teks, kemudian pasangkannya dengan anda GitHub repositori sebagai teks atau a GitLab projek jadi pembantu boleh lihat coretan dan pangkalan kod anda bersama-sama.
  • Apa-apa sahaja yang anda tangkap skrin dari tapak web. Tabiat yang patut dihentikan - Web2Txt mengambil halaman secara terus dan memastikan pautan tetap utuh, dan HTML kepada Markdown mengendalikan halaman yang disimpan. Kembali ke sumber sentiasa mengalahkan piksel bacaan.

Di mana Pengiktirafan Berjalan, dan Di Mana Ia Tidak

Terdapat satu peraturan yang menerangkan setiap mod kegagalan yang patut diketahui: OCR berfungsi pada fail imej anda muat naik, bukan pada imej yang terkubur di dalam fail lain. Gambar menunggang di dalam bekas yang lebih besar akan dilangkau, kerana penukar sedang membaca bekas.

  • PDF yang diimbas tidak mengembalikan apa-apa. PDF imej sahaja tidak mempunyai teks di dalamnya dan OCR tidak capai melalui pembungkus PDF ke piksel. Betulkan pada sumber: buka dalam Acrobat, Pratonton pada macOS, atau hampir mana-mana pembaca PDF moden dan jalankan "mengenal teks" untuk menjadikannya PDF yang boleh dicari, kemudian gunakan PDF ke teks atau PDF kepada Markdown. Itulah rumah yang sesuai untuk dokumen yang diimbas.
  • Imej di dalam ZIP disenaraikan, bukan dibaca. Penukaran arkib memberi anda nama fail dan tiada lagi. ZIP ke teks ialah alat yang betul untuk folder dokumen; untuk gambar, ekstrak mereka dan muat naik setiap imej dengan sendirinya.
  • Imej yang dibenamkan dalam Word, PowerPoint, RTF, EPUB atau e-mel tidak dibaca. Mereka datang melalui sebagai pemegang tempat imej dalam output. DOCX yang dipasang daripada tangkapan skrin menukar melalui Perkataan kepada Markdown ke dalam teks sekeliling dengan lubang di mana gambar-gambar itu berada. Simpan imej dan tukarkannya di sini.

Bawa model itu dan anda tidak akan membuang muat naik: untuk membaca gambar, serahkan gambar itu.

Melakukannya mengikut Kelantangan, dan Mesin Penyuapan

Teks biasa ialah format yang anda inginkan apabila output tidak ditujukan untuk manusia. Teks yang dikenali daripada timbunan imej digabungkan dengan bersih, ketulan boleh diramalkan dan dibenamkan tanpa membawa bunyi pemformatan ke dalam vektor — itulah yang anda perlukan apabila anda membina indeks carian di atas timbunan tangkapan skrin atau membelok bahan arkib bergambar menjadi sesuatu yang boleh diperoleh semula.

Laluan praktikal ialah satu imej setiap muat naik, kerana arkib melangkau imej, jadi rancang untuk gelung dan bukannya a kumpulan tunggal. Kaunter token di bawah output berguna di sini: ia memberitahu anda jumlah setiap penukaran sebenarnya kos sebelum anda mula menyusun halaman menjadi satu gesaan atau menganggarkan strategi penggumpalan. Untuk corpora campuran — dokumen bersama gambar — File2Txt mengendalikan setiap format yang disokong dari satu tempat, dan a penukaran direktori tempatan meratakan bahagian berasaskan teks projek dalam satu laluan.

Berikan Masa yang Mudah kepada Pengecam

Ketepatan mengikuti kualiti imej dengan cukup teliti sehingga beberapa tabiat mengubah hasil anda lebih daripada sebarang tetapan akan:

  • Ambil tangkapan skrin dan bukannya foto skrin. Tiada silau, tiada sudut, tiada kabur, tiada corak moiré dari paparan.
  • Pangkas ketat kepada teks yang anda mahu. Lebih banyak piksel bagi setiap aksara ialah keseluruhan permainan, dan ia juga menghentikan output mengisi dengan krom antara muka yang anda tidak minta.
  • Kekalkan imej dengan cara yang betul ke atas dan kira-kira segi empat sama. Garis senget lebih sukar dibaca daripada garis lurus.
  • Elakkan kes sukar di mana anda boleh: tangkapan resolusi rendah, teks atas gambar, skrip dan fon hiasan, dan apa-apa yang separuh dalam bayang-bayang. Ini boleh berfungsi, tetapi ia adalah tempat berkumpulnya ralat.
  • Teliti apa-apa yang penting. Digit salah baca dalam nombor rujukan adalah senyap dan mahal, dan a pandangan lima saat pada output menangkapnya.

Soalan Lazim

Bagaimanakah saya menukar JPG kepada teks?

Jatuhkan imej ke dalam penukar di atas. OCR berjalan pada piksel sebenar dan perkataan yang dikenali kembali sebagai teks biasa yang anda boleh pilih, cari dan tampal. Percuma, tiada pendaftaran, 50 MB setiap imej. Ini ialah kes penukar jpeg ke teks — gambar masuk, keluar perkataan, tiada apa-apa untuk dipasang.

Adakah ia berfungsi dengan PNG dan format imej lain?

Ya: JPG, JPEG, PNG, GIF, BMP, TIFF, TIF dan WebP semuanya berfungsi. PNG ialah format yang diterima oleh kebanyakan tangkapan skrin dan ia merupakan kes terbaik untuk OCR, kerana tangkapan skrin dijadikan teks dan bukannya gambar kertas — tiada kamera kabur, tiada lengkungan halaman, tiada pencahayaan yang tidak rata untuk digunakan.

Bolehkah ia membaca nota tulisan tangan?

Teruk, dan anda harus menganggap tidak. Model OCR dilatih secara meluas pada jenis bercetak; huruf besar blok kursif dan tergesa-gesa menghasilkan output yang kelihatan munasabah dan salah di tempat tertentu yang anda tidak fikir untuk menyemak. Kadang-kadang tercetak huruf besar pada kertas yang diperintah. Perkara lain memerlukan pembacaan pruf terhadap yang asal, yang biasanya kos lebih tinggi daripada menaip semula.

Mengapa imej saya kembali dengan aksara yang salah?

Resolusi, hampir selalu. OCR memerlukan kira-kira 300 DPI bersamaan untuk mengasingkan bentuk yang serupa, dan di bawah itu rn runtuh ke dalam m, 1 dan l bertukar, dan 0 menjadi O. Foto telefon yang diambil lebih dekat, atau tangkapan skrin yang ditangkap pada saiz tetingkap penuh dan bukannya diperkecilkan, membetulkan kebanyakannya.

Bolehkah saya mendapatkan teks daripada foto halaman dokumen?

Ya, dan ia berfungsi lebih baik daripada jangkaan orang — tetapi ratakan halaman terlebih dahulu. Pegang kamera selari dengan kertas dan bukannya pada sudut, dapatkan cahaya sekata tanpa bayang-bayang merentasi teks dan isikan bingkai dengan halaman. Foto berbatu kunci atau berbayang kehilangan keseluruhan baris dan OCR tidak melaporkan ralat apabila berlaku.

Adakah imej disimpan di mana-mana selepas penukaran?

Tidak. Ia dihantar untuk pengiktirafan, diproses dan dibuang sebaik sahaja teks dikembalikan — tidak diarkibkan, tidak digunakan untuk latihan, tidak diindeks. Tiada akaun dilampirkan padanya dan tiada salinan disimpan di pihak kami.

Semua Lain Di Sini

Imej terletak bersama dua belas format lain yang disokong, semuanya boleh dicapai daripada File2Txt. Ada lagi menulis tentang penyediaan fail untuk LLM jika anda mahukan hujah umum dan bukannya yang khusus imej.

Repo2Txt dibina dan diselenggara oleh v12hero, pembangun bebas membina apl asli dan web yang mengutamakan privasi.