Konverter ini menggunakan Tesseract.js 7, port browser dari mesin OCR open source Tesseract. Kode, inti WebAssembly, dan data bahasa yang dipilih baru dimuat setelah Anda memulai ekstraksi. Tesseract melakukan pengenalan di proses latar belakang sendiri, sehingga halaman tetap responsif saat perangkat Anda memproses gambar.
Akurasi OCR lebih dipengaruhi oleh kualitas gambar sumber daripada format file. Teks cetak yang tegak lurus, pencahayaan merata, fokus tajam, kontras jelas, dan detail piksel yang cukup sangat membantu. Screenshot kecil bisa lebih baik setelah diperbesar, sedangkan halaman miring, font dekoratif, kolom, tulisan tangan, silau, atau foto buram biasanya perlu koreksi manual.