Този конвертор използва Tesseract.js 7 - браузърна версия на отворения Tesseract OCR engine. Кодът, WebAssembly ядрото и избраните езикови данни се зареждат само когато стартирате извличането. Tesseract извършва разпознаването в отделен фонов процес, така че страницата остава бърза, докато устройството ви обработва изображението.
Точността на OCR зависи основно от качеството на източника, а не от файловия формат. Прав, ясен печатен текст, равномерна светлина, остър фокус, силен контраст и достатъчно пикселни детайли са от значение. Малките скрийншоти често се подобряват след увеличаване, докато наклонени страници, декоративни шрифтове, колони, ръкопис, отблясъци и размазани снимки по-често изискват ръчна корекция.