この変換ツールは、オープンソースOCRエンジン「Tesseract.js 7」のブラウザ版を利用しています。 コード・WebAssembly本体・選択した言語データは、抽出開始時にのみ読み込まれます。Tesseractはバックグラウンド処理(ワーカー)で動作するため、画像処理中もページの操作性は保たれます。
OCRの精度はファイル形式よりも元画像の状態に左右されます。まっすぐ印刷された文字、均一な明るさ、ピントが合った画像、高コントラスト、十分な解像度があると認識しやすくなります。小さなスクリーンショットは拡大で精度が上がる場合もあります。傾き、装飾フォント、列組み、手書き、照り返し、ぼやけた写真は手直しが必要になることがあります。