CanDoYa
VI

Chuyển đổi hình ảnh sang văn bản

Chạy hoàn toàn trên trình duyệt của bạn - không tải lên, không cần đăng ký.

Chọn ảnh in chữ rõ để bắt đầu.

Chia sẻ công cụ này

Cách hoạt động của công cụ chuyển hình ảnh sang văn bản?

Công cụ chuyển hình ảnh sang văn bản sử dụng công nghệ nhận diện ký tự quang học (OCR) để tìm chữ in trên ảnh hoặc bản quét và trả về văn bản có thể chỉnh sửa. Công cụ này chạy Tesseract WebAssembly trực tiếp trên trình duyệt, hỗ trợ các ngôn ngữ dùng trên toàn bộ 40 phiên bản CanDoYa, cho phép bạn sao chép hoặc tải kết quả mà không cần tải ảnh gốc lên mạng.

Cách dùng

  1. 1Chọn ảnh rõ nét. Kéo thả file JPEG, PNG, WebP, BMP hoặc GIF tĩnh (tối đa 15 MB, 24 megapixel), hoặc dùng ảnh mẫu có sẵn.
  2. 2Chọn ngôn ngữ văn bản. Chọn đúng ngôn ngữ xuất hiện trên ảnh. Dữ liệu ngôn ngữ Tesseract sẽ được tải về khi bạn bắt đầu nhận diện.
  3. 3Nhận diện và kiểm tra. Chạy OCR, so sánh tên và số với ảnh gốc, chỉnh lại lỗi nếu có rồi sao chép hoặc tải về file TXT UTF-8.

Dành cho ai

Công cụ này sử dụng Tesseract.js 7, phiên bản chạy trên trình duyệt của bộ máy OCR mã nguồn mở Tesseract. Mã nguồn, lõi WebAssembly và dữ liệu ngôn ngữ chỉ được tải về khi bạn bắt đầu nhận diện. Quá trình nhận diện chạy trong một tiến trình nền riêng, giúp trang web luôn mượt mà khi thiết bị của bạn xử lý ảnh.

Độ chính xác của OCR phụ thuộc nhiều vào chất lượng ảnh gốc hơn là định dạng file. Chữ in ngay ngắn, ánh sáng đều, nét rõ, tương phản mạnh và đủ chi tiết điểm ảnh sẽ cho kết quả tốt hơn. Ảnh chụp màn hình nhỏ có thể cải thiện sau khi phóng to, còn trang bị lệch, font trang trí, nhiều cột, chữ viết tay, bóng lóa hoặc ảnh mờ thường cần chỉnh sửa lại thủ công.

Câu hỏi thường gặp

Ảnh của tôi có bị tải lên máy chủ không?

Không. File bạn chọn được giải mã và nhận diện ngay trên thiết bị của bạn bởi tiến trình nền Tesseract. Trình duyệt chỉ tải các tệp OCR và dữ liệu ngôn ngữ từ máy chủ công khai, các yêu cầu này không chứa ảnh của bạn. CanDoYa không nhận hoặc lưu ảnh nguồn hay văn bản trích xuất.

Công cụ chuyển hình ảnh sang văn bản này có miễn phí không?

Có. Không cần tài khoản, thanh toán, watermark, giới hạn lượt hay phí tải kết quả. Thiết bị của bạn thực hiện xử lý. Việc tải công cụ OCR và dữ liệu ngôn ngữ ban đầu vẫn dùng kết nối Internet, và mô hình ngôn ngữ lớn có thể ảnh hưởng nếu bạn dùng mạng giới hạn dung lượng.

Hỗ trợ định dạng và kích thước ảnh nào?

Bạn có thể xử lý một file JPEG, PNG, WebP, BMP hoặc GIF tĩnh tối đa 15 MB và 24 megapixel. Giới hạn này giúp tránh lỗi bộ nhớ trên điện thoại hoặc laptop. Công cụ chỉ xử lý ảnh; nếu cần nhận diện PDF, hãy dùng công cụ OCR PDF chuyên dụng.

Độ chính xác khi chuyển hình ảnh sang văn bản thế nào?

Chữ in rõ ràng thường nhận diện tốt, nhưng không có kết quả OCR nào đảm bảo tuyệt đối. Ảnh nét, chữ lớn, tương phản mạnh, trang thẳng và chọn đúng ngôn ngữ sẽ tăng độ chính xác. Chữ viết tay, font lạ, bóng, mờ, bảng biểu, nhiều cột hoặc nhiều hướng đọc có thể gây nhầm lẫn hoặc đảo thứ tự dòng.

Có thể trích xuất chữ viết tay không?

Có thể nhận diện chữ viết tay in rõ nét, nhưng công cụ này chủ yếu dành cho chữ in. Chữ viết tay liền nét hoặc nét không đều sẽ kém chính xác. Hãy coi kết quả chữ viết tay là bản nháp và soát lại từng từ, ngày tháng, số liệu với ảnh gốc.

Nên chọn ngôn ngữ văn bản nào?

Hãy chọn ngôn ngữ đúng với chữ xuất hiện trên ảnh, không phải ngôn ngữ trình duyệt. Danh sách bao gồm các ngôn ngữ dùng trên toàn bộ 40 phiên bản CanDoYa, gồm cả tiếng Trung giản thể và phồn thể. Nếu trang có nhiều ngôn ngữ, hãy chọn ngôn ngữ chính; mỗi lần chỉ dùng một mô hình nhận diện.

Vì sao lần đầu nhận diện lại lâu hơn?

Trình duyệt cần tải mã Tesseract.js, lõi WebAssembly và dữ liệu ngôn ngữ bạn chọn. Các lần sau có thể nhanh hơn nhờ bộ nhớ đệm, nhưng duyệt ẩn danh, dọn bộ nhớ, đổi ngôn ngữ hoặc xóa cache sẽ phải tải lại.

Có thể dùng ngay văn bản trích xuất mà không kiểm tra không?

Nên kiểm tra lại, nhất là tên, tổng số, ngày tháng, dấu câu và các ký tự dễ nhầm như O với 0, l với 1. Mức tin cậy chỉ là ước lượng chung, không xác thực từng từ hay giữ đúng bố cục như ảnh gốc.