CanDoYa
RO

Convertor Imagine în Text

Rulează integral în browserul tău - fără încărcare, fără cont.

Alege o imagine clară cu text pentru a începe.

Distribuie acest instrument

Cum funcționează un convertor imagine în text?

Un convertor imagine în text folosește recunoașterea optică a caracterelor (OCR) pentru a identifica textul tipărit dintr-o fotografie sau scanare și a-l transforma în text editabil. Acest instrument rulează Tesseract WebAssembly direct în browser, acoperă limbile folosite în toate cele 40 de versiuni CanDoYa și îți permite să copiezi sau să descarci rezultatul fără ca imaginea sursă să fie încărcată.

Cum se folosește

  1. 1Alege o imagine clară. Adaugă un fișier JPEG, PNG, WebP, BMP sau GIF static de până la 15 MB și 24 megapixeli sau folosește exemplul inclus.
  2. 2Selectează limba textului. Alege limba în care este tipărit textul din imagine. Datele lingvistice Tesseract pentru limba respectivă se descarcă la pornirea extragerii.
  3. 3Extrage și verifică. Rulează OCR, compară numele și cifrele cu sursa, corectează eventualele erori, apoi copiază textul sau descarcă un fișier TXT în UTF-8.

Pentru cine este

Acest convertor folosește Tesseract.js 7, portarea pentru browser a motorului open-source Tesseract OCR. Codul, nucleul WebAssembly și datele lingvistice selectate se descarcă doar când începi extragerea. Recunoașterea se face într-un proces de fundal separat, astfel încât pagina rămâne rapidă cât timp dispozitivul tău procesează imaginea.

Precizia OCR depinde mai ales de calitatea sursei, nu de formatul fișierului. Textul tipărit drept, iluminarea uniformă, claritatea, contrastul puternic și detaliul suficient de pixeli ajută mult. Capturile de ecran mici pot fi îmbunătățite prin mărire, iar paginile înclinate, fonturile decorative, coloanele, scrisul de mână, reflexiile sau pozele neclare pot necesita corectare manuală.

Întrebări frecvente

Imaginea mea este încărcată pe un server?

Nu. Fișierul selectat este decodat și recunoscut local, de un proces Tesseract din browserul tău. Browserul descarcă public codul OCR și datele lingvistice de pe surse externe, dar aceste cereri nu includ imaginea ta. CanDoYa nu primește și nu stochează imaginea sursă sau textul extras.

Acest convertor imagine în text este gratuit?

Da. Nu este nevoie de cont, plată, watermark, credite sau taxă la descărcare. Procesarea se face pe dispozitivul tău. Descărcarea inițială a motorului OCR și a datelor lingvistice folosește conexiunea ta la internet, iar modelele lingvistice mai mari pot conta dacă ai trafic limitat.

Ce limite și formate de imagine sunt acceptate?

Poți procesa un singur fișier JPEG, PNG, WebP, BMP sau GIF static de până la 15 MB și 24 megapixeli. Aceste limite reduc riscul de blocare a memoriei pe telefoane și laptopuri. Instrumentul funcționează doar cu imagini - pentru pagini PDF, folosește un OCR specializat pentru PDF-uri scanate.

Cât de precisă este conversia imagine în text prin OCR?

Textul tipărit clar poate fi recunoscut bine, dar niciun rezultat OCR nu este garantat. Claritatea, literele mari, contrastul puternic, pagina dreaptă și limba corectă cresc precizia. Scrisul de mână, fonturile neobișnuite, reflexiile, blurul, tabelele, coloanele sau direcțiile de citire mixte pot duce la substituiri sau linii reordonate.

Poate extrage notițe scrise de mână?

Poate recunoaște scrisul de mână de tipar foarte clar, dar acest instrument bazat pe Tesseract este conceput în principal pentru text tipărit. Scrisul cursiv sau cu forme neregulate este mult mai puțin fiabil. Tratează rezultatul ca o schiță și verifică fiecare cuvânt, dată și număr important cu imaginea originală.

Ce limbă trebuie să aleg?

Alege limba folosită de caracterele din imagine, nu limba browserului. Lista acoperă limbile folosite în toate cele 40 de versiuni CanDoYa, inclusiv chineză simplificată și tradițională separat. Dacă pagina conține mai multe limbi, selectează limba dominantă; această versiune folosește un singur model de recunoaștere per extragere.

De ce prima extragere durează mai mult?

Browserul trebuie să încarce mai întâi codul Tesseract.js, nucleul WebAssembly și datele antrenate pentru limba selectată. Cache-ul browserului poate accelera extragerile ulterioare, dar modul privat, curățarea stocării, schimbarea limbii sau ștergerea cache-ului pot necesita o nouă descărcare.

Pot folosi textul extras fără să-l verific?

Verifică-l înainte, mai ales nume, sume, date, semne de punctuație și caractere similare precum O și 0 sau l și 1. Scorul afișat este o estimare generală Tesseract. Nu garantează fiecare cuvânt și nu păstrează exact aspectul vizual al sursei.