Тут використовується Tesseract.js 7 - браузерна версія відкритого OCR-двигуна Tesseract. Код, ядро WebAssembly та вибрані мовні дані завантажуються лише під час запуску розпізнавання. Tesseract виконує розпізнавання у власному фоновому процесі, тому сторінка залишається чутливою, поки ваш пристрій обробляє зображення.
Точність OCR найбільше залежить від якості вихідного зображення, а не від формату файлу. Найкраще розпізнаються рівно розташований друкований текст, рівномірне освітлення, чіткий фокус, контрастність і достатня деталізація. Маленькі скріншоти можна покращити збільшенням масштабу, а перекошені сторінки, декоративні шрифти, стовпці, рукопис, відблиски чи розмиті фото частіше потребують ручної перевірки.