Questo convertitore utilizza Tesseract.js 7, una versione per browser del motore OCR open-source Tesseract. Il codice, il core WebAssembly e i dati della lingua selezionata vengono caricati solo quando avvii l’estrazione. Il riconoscimento avviene in un processo in background Tesseract, così la pagina resta reattiva mentre il dispositivo elabora l’immagine.
L’accuratezza dell’OCR dipende più dalla qualità dell’immagine che dal formato file. Testo stampato dritto, illuminazione uniforme, immagine nitida, buon contrasto e sufficiente dettaglio in pixel aiutano il risultato. Screenshot piccoli possono migliorare se ingranditi; pagine storte, font decorativi, colonne, scrittura a mano, riflessi e foto sfocate richiedono spesso correzioni manuali.