Acest convertor folosește Tesseract.js 7, portarea pentru browser a motorului open-source Tesseract OCR. Codul, nucleul WebAssembly și datele lingvistice selectate se descarcă doar când începi extragerea. Recunoașterea se face într-un proces de fundal separat, astfel încât pagina rămâne rapidă cât timp dispozitivul tău procesează imaginea.
Precizia OCR depinde mai ales de calitatea sursei, nu de formatul fișierului. Textul tipărit drept, iluminarea uniformă, claritatea, contrastul puternic și detaliul suficient de pixeli ajută mult. Capturile de ecran mici pot fi îmbunătățite prin mărire, iar paginile înclinate, fonturile decorative, coloanele, scrisul de mână, reflexiile sau pozele neclare pot necesita corectare manuală.