Deze converter gebruikt Tesseract.js 7, een browserport van de open-source Tesseract OCR-engine. De code, WebAssembly-kern en de gekozen taaldata worden pas geladen zodra je extractie start. Tesseract voert de herkenning uit in een eigen achtergrondproces, zodat de pagina snel blijft terwijl je apparaat de afbeelding verwerkt.
De nauwkeurigheid hangt vooral af van de bronafbeelding. Recht gedrukte tekst, gelijkmatige belichting, scherpe focus, sterk contrast en voldoende details helpen het meest. Kleine screenshots worden vaak beter na opschalen, terwijl scheve pagina’s, sierletters, kolommen, handschrift, reflecties en vage foto’s vaker handmatige correctie vragen.