CanDoYa
MS

Penukar Gambar ke Teks

Berjalan sepenuhnya dalam pelayar anda - tanpa muat naik, tanpa pendaftaran.

Pilih gambar bercetak yang jelas untuk mula.

Kongsi alat ini

Bagaimana penukar gambar ke teks berfungsi?

Penukar gambar ke teks menggunakan pengecaman aksara optik (OCR) untuk mengenal pasti aksara bercetak dalam foto atau imbasan dan menukarnya kepada teks boleh sunting. Alat ini menjalankan Tesseract WebAssembly terus dalam pelayar anda, meliputi bahasa yang digunakan di semua 40 lokal CanDoYa, dan membolehkan anda salin atau muat turun hasil tanpa memuat naik gambar asal.

Cara guna

  1. 1Pilih gambar yang jelas. Seret masuk JPEG, PNG, WebP, BMP, atau GIF (bukan animasi) sehingga 15 MB dan 24 megapiksel, atau gunakan contoh sedia ada.
  2. 2Pilih bahasa teks. Pilih bahasa sebenar yang tertera pada gambar. Data bahasa Tesseract akan dimuat turun apabila anda mula mengekstrak.
  3. 3Ekstrak dan semak. Jalankan OCR, bandingkan nama dan nombor dengan gambar asal, edit sebarang kesilapan, kemudian salin atau muat turun fail TXT UTF-8.

Untuk siapa

Penukar ini menggunakan Tesseract.js 7, iaitu port pelayar bagi enjin OCR sumber terbuka Tesseract. Kod, teras WebAssembly, dan data bahasa hanya dimuatkan selepas anda memulakan ekstraksi. Tesseract menjalankan pengecaman dalam proses latar belakang sendiri, jadi halaman kekal responsif semasa peranti anda memproses gambar.

Ketepatan OCR lebih bergantung pada kualiti gambar asal berbanding format fail. Teks bercetak yang tegak, pencahayaan sekata, fokus tajam, kontras jelas, dan butiran piksel mencukupi akan membantu. Tangkapan skrin kecil boleh diperbaiki dengan pembesaran, manakala halaman senget, fon hiasan, lajur, tulisan tangan, silauan, dan gambar kabur mungkin memerlukan semakan manual.

Soalan lazim

Adakah gambar saya dimuat naik ke pelayan?

Tidak. Fail yang dipilih diproses dan dikenali pada peranti anda oleh proses latar belakang Tesseract. Pelayar hanya memuat turun fail enjin OCR dan data bahasa dari hos awam, tanpa menghantar gambar anda. CanDoYa tidak menerima atau menyimpan gambar asal atau teks yang diekstrak.

Adakah penukar gambar ke teks ini percuma?

Ya. Tiada akaun, bayaran, tera air, kredit halaman, atau yuran muat turun hasil. Peranti anda menjalankan semua pemprosesan. Muat turun enjin OCR dan data bahasa tetap menggunakan sambungan internet anda, dan model bahasa yang lebih besar boleh memberi kesan jika sambungan anda terhad.

Apakah had dan format gambar yang disokong?

Anda boleh proses satu gambar JPEG, PNG, WebP, BMP, atau GIF (bukan animasi) sehingga 15 MB dan 24 megapiksel. Had ini membantu mengelakkan kegagalan memori pada telefon dan komputer riba. Alat ini hanya untuk gambar; gunakan alat OCR PDF khusus jika anda perlu kenal pasti teks pada halaman PDF penuh.

Sejauh mana ketepatan penukaran OCR gambar ke teks?

Teks bercetak yang bersih biasanya boleh dikenali dengan baik, tetapi tiada jaminan hasil tepat sepenuhnya. Fokus tajam, huruf besar, kontras tinggi, halaman lurus, dan pemilihan bahasa yang betul meningkatkan ketepatan. Tulisan tangan, fon luar biasa, silauan, kabur, jadual, lajur, dan arah bacaan bercampur boleh menyebabkan kesilapan atau susunan baris berubah.

Bolehkah ia mengekstrak tulisan tangan?

Ia mungkin dapat membaca tulisan tangan blok yang sangat kemas, tetapi alat berasaskan Tesseract ini direka terutamanya untuk teks bercetak. Tulisan sambung dan bentuk aksara tidak konsisten jauh kurang boleh dipercayai. Anggap hasil tulisan tangan sebagai draf kasar dan semak setiap perkataan, tarikh, dan nombor penting dengan gambar asal.

Bahasa teks mana perlu saya pilih?

Pilih bahasa yang digunakan oleh aksara dalam gambar, bukan bahasa pelayar anda. Senarai ini meliputi bahasa yang digunakan di semua 40 lokal CanDoYa, termasuk Cina ringkas dan tradisional secara berasingan. Jika halaman bercampur bahasa, pilih yang paling dominan; setiap ekstraksi hanya menggunakan satu model bahasa.

Mengapa ekstraksi pertama mengambil masa lebih lama?

Pelayar perlu memuat turun kod Tesseract.js, teras WebAssembly yang serasi, dan data terlatih untuk bahasa yang dipilih. Cache pelayar boleh mempercepatkan proses seterusnya, tetapi mod peribadi, pembersihan storan, bahasa baru, atau cache dipadam akan menyebabkan muat turun semula.

Bolehkah saya guna teks yang diekstrak tanpa semakan?

Semak dahulu, terutamanya nama, jumlah, tarikh, tanda baca, dan aksara yang serupa seperti O dan 0 atau l dan 1. Keyakinan yang dipaparkan ialah anggaran umum Tesseract. Ia tidak mengesahkan setiap perkataan atau mengekalkan susun atur visual asal.