Gumagamit ang converter na ito ng Tesseract.js 7, isang browser port ng open-source na Tesseract OCR engine. Ang code, WebAssembly core, at napiling language data ay ida-download lang kapag sinimulan mo ang extraction. Ginagawa ng Tesseract ang pagkilala sa sarili nitong background process, kaya nananatiling responsive ang page habang pinoproseso ng device mo ang larawan.
Mas nakakaapekto sa OCR accuracy ang kalidad ng source image kaysa sa file format. Pinakamainam ang tuwid na printed text, pantay at maliwanag na ilaw, malinaw na focus, malakas na contrast, at sapat na detalye ng pixels. Ang maliliit na screenshot ay puwedeng gumanda ang resulta kapag in-upscale. Ang mga pahinang nakatagilid, decorative na font, columns, sulat kamay, glare, at malabong kuha ay mas nangangailangan ng manu-manong pagwawasto.