Dieser Konverter verwendet Tesseract.js 7, eine Browser-Umsetzung der quelloffenen Tesseract-OCR-Engine. Der Code, der WebAssembly-Kern und die gewählten Sprachdaten werden erst geladen, wenn Sie die Texterkennung starten. Die Erkennung läuft in einem eigenen Hintergrundprozess, sodass die Seite währenddessen reaktionsfähig bleibt.
Die OCR-Genauigkeit hängt stärker von der Bildqualität als vom Dateiformat ab. Senkrecht gedruckter Text, gleichmäßige Ausleuchtung, scharfer Fokus, starker Kontrast und ausreichend viele Bildpunkte helfen. Kleine Screenshots können durch Hochskalieren lesbarer werden. Schiefe Seiten, verspielte Schriften, Spalten, Handschrift, Spiegelungen und unscharfe Fotos erfordern oft manuelle Korrekturen.