यह कन्वर्टर Tesseract.js 7 का उपयोग करता है, जो ओपन-सोर्स Tesseract OCR इंजन का ब्राउज़र पोर्ट है। कोड, WebAssembly कोर और चुनी गई भाषा का डाटा तभी लोड होता है जब आप एक्सट्रैक्शन शुरू करते हैं। Tesseract अपनी वर्कर प्रक्रिया में पहचान करता है, जिससे पेज चलते हुए भी आपके डिवाइस पर इमेज प्रोसेस होती है।
OCR की सटीकता मुख्य रूप से इमेज की क्वालिटी पर निर्भर करती है, फाइल फॉर्मेट पर नहीं। सीधे छपा टेक्स्ट, समान रोशनी, स्पष्ट फोकस, अच्छा कंट्रास्ट और पर्याप्त पिक्सल डिटेल मदद करते हैं। छोटे स्क्रीनशॉट को अपस्केल करने से रिजल्ट बेहतर हो सकता है, जबकि तिरछी इमेज, सजावटी फॉन्ट, कॉलम, हस्तलिखित नोट, चमक या धुंधली फोटो में मैन्युअल सुधार की जरूरत पड़ सकती है।