Den här konverteraren använder Tesseract.js 7, en webbläsarversion av den öppna Tesseract OCR-motorn. Kod, WebAssembly-kärna och vald språkdata laddas först när du startar extraktionen. Tesseract körs i en egen bakgrundsprocess så att sidan förblir responsiv medan din enhet behandlar bilden.
OCR:ns noggrannhet beror mest på källbilden, inte filformatet. Upprätt tryckt text, jämn belysning, skarp fokus, tydlig kontrast och tillräcklig upplösning ger bäst resultat. Små skärmklipp kan bli tydligare om du förstorar dem, medan sneda sidor, dekorativa typsnitt, spalter, handskrift, blänk och suddiga foton ofta kräver manuell rättning.