CanDoYa
ZH-TW

圖片轉文字轉換器

全程在瀏覽器裡執行,免上傳、免註冊。

請選擇含清楚印刷文字的圖片開始。

分享這個工具

圖片轉文字是怎麼運作的?

圖片轉文字工具會利用光學字元辨識(OCR),從照片或掃描檔中擷取印刷文字,轉為可編輯內容。本工具於瀏覽器內以 Tesseract WebAssembly 執行,涵蓋所有 40 個 CanDoYa 地區所用語言,無需上傳原始圖片即可複製或下載結果。

使用方式

  1. 1選擇清晰圖片. 拖曳 JPEG、PNG、WebP、BMP 或靜態 GIF,檔案上限 15 MB、24 百萬像素,或載入內建範例。
  2. 2選擇文字語言. 請選擇圖片實際印刷的語言。開始擷取時會下載對應 Tesseract 語言資料。
  3. 3擷取並檢查內容. 執行 OCR,對照原圖檢查人名、數字等重點,修正錯誤後可複製或下載為 UTF-8 TXT 檔。

適合誰用

本工具採用 Tesseract.js 7,為開源 Tesseract OCR 引擎的瀏覽器移植版。 程式碼、WebAssembly 核心及所選語言資料僅於開始擷取時載入。Tesseract 會在獨立背景處理程序中執行,讓頁面保持流暢,圖片處理全在你的裝置完成。

OCR 準確度主要取決於原圖品質。直立印刷字、光線均勻、對比明顯、像素細緻都能提升效果。小截圖放大後通常更易辨識;斜拍、裝飾字體、分欄、手寫、反光或模糊照片則需多加校對。

常見問題

我的圖片會上傳到伺服器嗎?

不會。檔案解碼與辨識全在你的裝置,由 Tesseract 背景處理程序執行。瀏覽器僅會向外部主機下載公開 OCR 執行檔與語言資料,這些請求不包含你的圖片。CanDoYa 不會接收或儲存原始圖片或擷取結果。

這個圖片轉文字服務需要付費嗎?

不用。無需帳號、付款、浮水印,也不會收取下載費用。運算由你的裝置負責。首次下載 OCR 引擎與語言資料會用到網路流量,若語言模型較大,請留意流量使用。

支援哪些圖片格式與限制?

可處理單一 JPEG、PNG、WebP、BMP 或靜態 GIF,檔案上限 15 MB、24 百萬像素。這些限制可避免手機或筆電記憶體不足。僅支援圖片,若需辨識 PDF 請使用專門的 PDF OCR 工具。

OCR 圖片轉文字的準確度如何?

清晰印刷體通常辨識效果佳,但任何 OCR 結果都需複查。對焦清楚、字體大、對比強、頁面端正、語言選對都能提升準確率。手寫、特殊字型、反光、模糊、表格、分欄或混合語言可能導致錯字或行序錯亂。

可以擷取手寫內容嗎?

僅對非常工整的手寫體有機會辨識,本工具主要針對印刷文字。草寫或字形不一時準確度低。手寫結果僅供參考,請逐字核對重要資訊。

應該怎麼選擇語言?

請選擇圖片中文字實際所用語言,不要選瀏覽器語系。語言選單涵蓋所有 40 個 CanDoYa 地區所用語言,簡體與繁體中文分開。如果圖片有多種語言,請選擇主要語言;每次僅載入一種語言模型。

為什麼第一次擷取會比較慢?

首次執行時,瀏覽器需下載 Tesseract.js 程式碼、WebAssembly 核心及所選語言資料。之後若有快取會加快速度,但隱私模式、清除快取、切換語言或新裝置時會再次下載。

擷取的文字可以直接用嗎?

建議先檢查人名、金額、日期、標點及易混字元(如 O 與 0,l 與 1)。顯示的信心度僅供參考,無法保證每個字都正確,也不會保留原始版面。