CanDoYa
HR

Pretvarač slike u tekst

Radi u cijelosti u pregledniku - bez slanja podataka i bez registracije.

Odaberite sliku s jasnim tiskanim tekstom za početak.

Podijelite ovaj alat

Kako radi pretvarač slike u tekst?

Pretvarač slike u tekst koristi optičko prepoznavanje znakova (OCR) za pronalaženje tiskanih znakova na fotografiji ili skenu i vraća ih kao uređiv tekst. Ovaj alat pokreće Tesseract WebAssembly izravno u vašem pregledniku, pokriva jezike koji se koriste u svim 40 CanDoYa lokalizacijama i omogućuje kopiranje ili preuzimanje rezultata bez slanja izvorne slike.

Kako se koristi

  1. 1Odaberite jasnu sliku. Dodajte JPEG, PNG, WebP, BMP ili neanimirani GIF do 15 MB i 24 megapiksela ili učitajte ugrađeni primjer.
  2. 2Odaberite jezik teksta. Izaberite jezik koji je stvarno otisnut na slici. Odgovarajući Tesseract jezični podaci preuzimaju se kad pokrenete izdvajanje.
  3. 3Izdvojite i provjerite tekst. Pokrenite OCR, usporedite imena i brojeve s izvornikom, ispravite eventualne pogreške pa kopirajte tekst ili ga preuzmite kao UTF-8 TXT datoteku.

Za koga je

Ovaj pretvarač koristi Tesseract.js 7, pregledničku verziju otvorenog Tesseract OCR sustava. Kod, WebAssembly jezgra i odabrani jezični podaci učitavaju se tek kad pokrenete izdvajanje teksta. Tesseract radi u vlastitom pozadinskom procesu, pa stranica ostaje responzivna dok vaš uređaj obrađuje sliku.

Točnost OCR-a više ovisi o kvaliteti izvora nego o formatu datoteke. Ravno otisnut tekst, ravnomjerno osvjetljenje, oštar fokus, jak kontrast i dovoljna razlučivost najviše pomažu. Mali screenshotovi mogu biti čitljiviji nakon povećanja, dok nagnute stranice, ukrasni fontovi, stupci, rukopis, odsjaji i mutne fotografije češće zahtijevaju ručnu provjeru.

Česta pitanja

Prenosi li se moja slika na server?

Ne. Odabrana slika se dekodira i prepoznaje lokalno na vašem uređaju putem Tesseract pozadinskog procesa. Preglednik preuzima javni OCR sustav i jezične datoteke s vanjskih poslužitelja, ali vaša slika nije dio tih zahtjeva. CanDoYa ne prima niti pohranjuje izvorni sadržaj ili izdvojeni tekst.

Je li ovaj pretvarač slike u tekst besplatan?

Da. Nema računa, plaćanja, vodenog žiga, ograničenja stranica niti naknade za preuzimanje. Vaš uređaj obavlja svu obradu. Početno preuzimanje OCR sustava i jezičnih podataka koristi vašu internetsku vezu, a veći jezični modeli mogu biti značajni na ograničenim tarifama.

Koje su podržane veličine i formati slika?

Možete obraditi jedan JPEG, PNG, WebP, BMP ili neanimirani GIF do 15 MB i 24 megapiksela. Ti limiti smanjuju rizik od pada sustava na mobitelima i prijenosnicima. Alat radi samo sa slikama; za skenirane PDF-ove koristite namjenski OCR za PDF.

Koliko je točno prepoznavanje slike u tekst?

Čist otisnut tekst može se dobro prepoznati, ali nijedan OCR ne jamči potpunu točnost. Oštar fokus, veliki znakovi, jak kontrast, ravna stranica i ispravan jezik poboljšavaju rezultat. Rukopis, neobični fontovi, odsjaj, mutne slike, tablice, stupci i miješani smjerovi čitanja mogu dovesti do zamjena ili promjene redoslijeda.

Može li izdvojiti rukom pisan tekst?

Može prepoznati vrlo uredan tiskani rukopis, ali ovaj alat temeljen na Tesseractu prvenstveno je namijenjen tiskanom tekstu. Pisani tekst i neujednačena slova daju puno nesigurnije rezultate. Rukopis tretirajte kao nacrt i provjerite svaku važnu riječ, datum i broj s izvornom slikom.

Koji jezik trebam odabrati?

Odaberite jezik koji se koristi na slici, a ne jezik preglednika. Popis pokriva jezike korištene u svih 40 CanDoYa lokalizacija, uključujući posebno pojednostavljeni i tradicionalni kineski. Ako je na slici više jezika, izaberite glavni; ovaj alat koristi jedan model po izdvajanu.

Zašto prvo izdvajanje traje dulje?

Preglednik prvo mora učitati Tesseract.js kod, odgovarajuću WebAssembly jezgru i podatke za odabrani jezik. Kasnija pokretanja mogu biti brža zbog predmemorije, ali privatni način, čišćenje podataka, novi jezik ili brisanje predmemorije mogu zahtijevati novo preuzimanje.

Mogu li koristiti izdvojeni tekst bez provjere?

Uvijek ga provjerite, osobito imena, iznose, datume, interpunkciju i slične znakove poput O i 0 ili l i 1. Prikazana sigurnost je opća procjena. Ne jamči svaku riječ niti čuva izvorni raspored teksta.