CanDoYa
FIL

Image to Text Converter

Tumatakbo nang buo sa iyong browser - walang upload, walang sign-up.

Pumili ng larawan na malinaw ang printed na teksto para magsimula.

Ibahagi ang tool na ito

Paano gumagana ang image to text converter?

Ang image to text converter ay gumagamit ng optical character recognition (OCR) para kilalanin ang mga nakalimbag na letra sa larawan o scan at gawing nae-edit na teksto. Pinapatakbo nito ang Tesseract WebAssembly sa mismong browser mo, sumusuporta sa mga wikang ginagamit sa lahat ng 40 CanDoYa locales, at puwede mong kopyahin o i-download ang resulta nang hindi ina-upload ang source image.

Paano gamitin

  1. 1Pumili ng malinaw na larawan. I-drop ang JPEG, PNG, WebP, BMP, o non-animated GIF na hanggang 15 MB at 24 megapixels, o gamitin ang built-in na halimbawa.
  2. 2Piliin ang wika ng teksto. Piliin ang wikang aktwal na nakalimbag sa larawan. Ida-download ang tamang Tesseract language data kapag sinimulan ang extraction.
  3. 3I-extract at suriin. Paandarin ang OCR, i-verify ang mga pangalan at numero sa source, itama ang anumang mali, tapos kopyahin o i-download bilang UTF-8 TXT file.

Para kanino ito

Gumagamit ang converter na ito ng Tesseract.js 7, isang browser port ng open-source na Tesseract OCR engine. Ang code, WebAssembly core, at napiling language data ay ida-download lang kapag sinimulan mo ang extraction. Ginagawa ng Tesseract ang pagkilala sa sarili nitong background process, kaya nananatiling responsive ang page habang pinoproseso ng device mo ang larawan.

Mas nakakaapekto sa OCR accuracy ang kalidad ng source image kaysa sa file format. Pinakamainam ang tuwid na printed text, pantay at maliwanag na ilaw, malinaw na focus, malakas na contrast, at sapat na detalye ng pixels. Ang maliliit na screenshot ay puwedeng gumanda ang resulta kapag in-upscale. Ang mga pahinang nakatagilid, decorative na font, columns, sulat kamay, glare, at malabong kuha ay mas nangangailangan ng manu-manong pagwawasto.

FAQ

Ina-upload ba ang larawan ko sa server?

Hindi. Sa device mo lang nadi-decode at kinikilala ang napili mong larawan ng Tesseract background process. Nagda-download ang browser ng public OCR runtime at language files mula sa external hosts, pero hindi kasama ang larawan mo sa mga request na iyon. Hindi natatanggap o natsi-check ng CanDoYa ang source image o extracted text.

Libre ba ang image to text converter na ito?

Oo. Walang account, bayad, watermark, page credits, o bayad sa pag-download ng resulta. Ang device mo ang nagpoproseso. Kailangan pa rin ng internet para sa unang download ng OCR engine at language data, kaya mahalaga ito kung metered ang connection mo.

Ano ang mga limit at format ng image na puwedeng gamitin?

Isang JPEG, PNG, WebP, BMP, o non-animated GIF lang ang puwedeng iproseso kada extraction, hanggang 15 MB at 24 megapixels. Ang mga limit na ito ay para maiwasan ang memory errors sa phone at laptop. Para sa buong PDF page, gumamit ng OCR tool na para talaga sa scanned PDF.

Gaano ka-accurate ang OCR mula image to text?

Malinaw na printed text ay kadalasang nababasa nang maayos, pero walang garantisadong resulta. Mas tumataas ang accuracy kung matalas ang kuha, malaki ang letra, mataas ang contrast, tuwid ang page, at tama ang napiling wika. Ang sulat kamay, kakaibang font, glare, blur, tables, columns, at magkahalong direksyon ng teksto ay puwedeng magdulot ng maling pagkilala o magulong pagkakasunod-sunod.

Puwede bang mag-extract ng handwritten notes?

Minsan puwedeng makuha ang sobrang linaw at block letter na sulat kamay, pero ang tool na ito ay para talaga sa printed text. Ang cursive o hindi pantay-pantay na letra ay madalas hindi tama ang resulta. Ituring ang handwriting output bilang draft at i-double check ang bawat mahalagang salita, petsa, at numero sa original na larawan.

Anong wika ang dapat piliin?

Piliin ang wikang ginagamit ng mga letra sa larawan, hindi ang wika ng browser mo. Saklaw ng listahan ang mga wikang ginagamit sa lahat ng 40 CanDoYa locales, kabilang ang simplified at traditional Chinese bilang magkaiba. Kung halo-halo ang wika sa page, piliin ang pinaka-dominante; isang language model lang ang ginagamit kada extraction.

Bakit mas matagal ang unang extraction?

Kailangan munang i-download ng browser ang Tesseract.js code, compatible na WebAssembly core, at trained data para sa napiling wika. Puwedeng bumilis ang susunod na extraction kapag naka-cache na, pero kapag naka-private mode, naglinis ng storage, pumili ng bagong wika, o na-clear ang cache, magda-download ulit.

Puwede ko bang gamitin agad ang nakuha kong teksto?

Suriin muna, lalo na ang pangalan, halaga, petsa, punctuation, at magkamukhang character gaya ng O at 0 o l at 1. Ang confidence na ipinapakita ay estimate lang ng Tesseract. Hindi nito tinitiyak ang bawat salita o sinusunod ang eksaktong layout ng source.