Este conversor utiliza o Tesseract.js 7, uma versão para navegador do motor OCR open-source Tesseract. O código, o núcleo WebAssembly e os dados do idioma escolhido são carregados apenas quando você inicia a extração. O Tesseract faz o reconhecimento em um processo em segundo plano, mantendo a página responsiva enquanto seu dispositivo processa a imagem.
A precisão do OCR depende mais da qualidade da imagem do que do formato do arquivo. Texto impresso reto, iluminação uniforme, foco nítido, contraste forte e boa resolução ajudam bastante. Capturas pequenas podem melhorar após serem ampliadas, enquanto páginas tortas, fontes decorativas, colunas, manuscritos, reflexos ou fotos borradas geralmente exigem correção manual.