Este conversor utiliza o Tesseract.js 7, uma versão para navegador do motor open-source Tesseract OCR. O código, o núcleo WebAssembly e os dados do idioma escolhido só são carregados quando inicias a extração. O reconhecimento é feito num processo em segundo plano, mantendo a página responsiva enquanto o teu dispositivo processa a imagem.
A precisão do OCR depende mais da qualidade da imagem do que do formato do ficheiro. Texto impresso na vertical, iluminação uniforme, foco nítido, contraste forte e boa resolução ajudam a obter melhores resultados. Capturas pequenas podem beneficiar de ampliação, enquanto páginas inclinadas, fontes decorativas, colunas, manuscritos, reflexos ou fotos desfocadas podem exigir correção manual.