CanDoYa
EL

Εικόνα σε Κείμενο

Λειτουργεί εξ ολοκλήρου στον browser σας - χωρίς μεταφόρτωση, χωρίς εγγραφή.

Για να ξεκινήσετε, επιλέξτε μια εικόνα με καθαρό τυπωμένο κείμενο.

Κοινοποιήστε αυτό το εργαλείο

Πώς λειτουργεί ο μετατροπέας εικόνας σε κείμενο;

Ο μετατροπέας εικόνας σε κείμενο χρησιμοποιεί οπτική αναγνώριση χαρακτήρων (OCR) για να εντοπίσει τυπωμένους χαρακτήρες σε φωτογραφία ή σάρωση και να επιστρέψει επεξεργάσιμο κείμενο. Αυτό το εργαλείο τρέχει το Tesseract WebAssembly στον browser σας, καλύπτει τις γλώσσες που χρησιμοποιούνται σε όλες τις 40 τοπικές εκδόσεις του CanDoYa και σας επιτρέπει να αντιγράψετε ή να κατεβάσετε το αποτέλεσμα χωρίς να ανεβάσετε την αρχική εικόνα.

Πώς λειτουργεί

  1. 1Επιλέξτε καθαρή εικόνα. Σύρετε ένα αρχείο JPEG, PNG, WebP, BMP ή μη κινούμενο GIF έως 15 MB και 24 megapixel ή φορτώστε το ενσωματωμένο παράδειγμα.
  2. 2Ορίστε τη γλώσσα του κειμένου. Επιλέξτε τη γλώσσα που είναι τυπωμένη στην εικόνα. Τα αντίστοιχα δεδομένα γλώσσας Tesseract θα ληφθούν όταν ξεκινήσετε την εξαγωγή.
  3. 3Εξαγωγή και έλεγχος. Τρέξτε OCR, συγκρίνετε ονόματα και αριθμούς με την εικόνα, διορθώστε τυχόν λάθη και στη συνέχεια αντιγράψτε το κείμενο ή κατεβάστε το ως UTF-8 TXT.

Σε ποιους απευθύνεται

Αυτός ο μετατροπέας χρησιμοποιεί το Tesseract.js 7, μια έκδοση για browser της ανοιχτού κώδικα μηχανής OCR Tesseract. Ο κώδικας, ο πυρήνας WebAssembly και τα δεδομένα της επιλεγμένης γλώσσας φορτώνονται μόνο όταν ξεκινάτε την εξαγωγή. Η αναγνώριση γίνεται σε ξεχωριστή διεργασία, ώστε η σελίδα να παραμένει γρήγορη όσο η συσκευή σας επεξεργάζεται την εικόνα.

Η ακρίβεια του OCR εξαρτάται κυρίως από την ποιότητα της εικόνας και όχι από τον τύπο αρχείου. Ευθύ τυπωμένο κείμενο, ομοιόμορφος φωτισμός, καθαρή εστίαση, έντονη αντίθεση και αρκετή ανάλυση βοηθούν σημαντικά. Μικρά screenshots συχνά βελτιώνονται με μεγέθυνση, ενώ κεκλιμένες σελίδες, διακοσμητικές γραμματοσειρές, στήλες, χειρόγραφα, αντανακλάσεις ή θολές φωτογραφίες μπορεί να χρειαστούν χειροκίνητη διόρθωση.

Συχνές ερωτήσεις

Η εικόνα μου ανεβαίνει σε κάποιον διακομιστή;

Όχι. Το επιλεγμένο αρχείο αποκωδικοποιείται και αναγνωρίζεται τοπικά στη συσκευή σας από διεργασία Tesseract. Ο browser κατεβάζει δημόσια αρχεία OCR και γλώσσας από εξωτερικούς διακομιστές, αλλά αυτά τα αιτήματα δεν περιέχουν την εικόνα σας. Η CanDoYa δεν λαμβάνει ούτε αποθηκεύει την αρχική εικόνα ή το εξαγόμενο κείμενο.

Είναι δωρεάν ο μετατροπέας εικόνας σε κείμενο;

Ναι. Δεν απαιτεί λογαριασμό, πληρωμή, υδατογράφημα, credits ή χρέωση για το αποτέλεσμα. Η συσκευή σας κάνει όλη την επεξεργασία. Η αρχική λήψη της μηχανής OCR και των γλωσσικών δεδομένων χρησιμοποιεί τη σύνδεσή σας στο internet και τα μεγαλύτερα μοντέλα γλώσσας μπορεί να έχουν σημασία σε συνδέσεις με όριο δεδομένων.

Ποια όρια και τύποι εικόνας υποστηρίζονται;

Μπορείτε να επεξεργαστείτε ένα αρχείο JPEG, PNG, WebP, BMP ή μη κινούμενο GIF έως 15 MB και 24 megapixel. Αυτά τα όρια μειώνουν σφάλματα μνήμης σε κινητά και φορητούς υπολογιστές. Το εργαλείο λειτουργεί μόνο με εικόνες - για αναγνώριση σε PDF χρησιμοποιήστε εξειδικευμένο εργαλείο OCR για PDF.

Πόσο ακριβής είναι η μετατροπή εικόνας σε κείμενο με OCR;

Καθαρό τυπωμένο κείμενο αναγνωρίζεται συνήθως καλά, αλλά δεν υπάρχει εγγύηση. Καλή εστίαση, μεγάλα γράμματα, έντονη αντίθεση, ευθεία σελίδα και σωστή γλώσσα βελτιώνουν την ακρίβεια. Χειρόγραφα, ασυνήθιστες γραμματοσειρές, αντανακλάσεις, θολούρα, πίνακες, στήλες ή μικτές κατευθύνσεις ανάγνωσης μπορεί να προκαλέσουν λάθη ή αλλαγές στη σειρά.

Μπορεί να εξάγει χειρόγραφες σημειώσεις;

Μπορεί να αναγνωρίσει πολύ καθαρό, μπλοκ χειρόγραφο, αλλά το εργαλείο με βάση το Tesseract προορίζεται κυρίως για τυπωμένο κείμενο. Συνδεδεμένη γραφή και ασταθή σχήματα γραμμάτων είναι πολύ λιγότερο αξιόπιστα. Χειριστείτε το χειρόγραφο ως πρόχειρο και συγκρίνετε κάθε σημαντική λέξη, ημερομηνία και αριθμό με την αρχική εικόνα.

Ποια γλώσσα κειμένου να επιλέξω;

Επιλέξτε τη γλώσσα που χρησιμοποιούν οι χαρακτήρες στην εικόνα, όχι τη γλώσσα του browser. Η λίστα καλύπτει τις γλώσσες που χρησιμοποιούνται σε όλες τις 40 τοπικές εκδόσεις του CanDoYa, συμπεριλαμβανομένων των απλοποιημένων και παραδοσιακών κινεζικών ξεχωριστά. Αν η σελίδα έχει πολλές γλώσσες, επιλέξτε την κυρίαρχη - κάθε εξαγωγή χρησιμοποιεί ένα μοντέλο αναγνώρισης.

Γιατί η πρώτη εξαγωγή αργεί περισσότερο;

Ο browser πρέπει πρώτα να κατεβάσει τον κώδικα Tesseract.js, τον πυρήνα WebAssembly και τα εκπαιδευμένα δεδομένα για την επιλεγμένη γλώσσα. Η προσωρινή μνήμη του browser επιταχύνει τις επόμενες χρήσεις, αλλά ιδιωτική περιήγηση, καθαρισμός αποθηκευτικού χώρου, νέα γλώσσα ή διαγραφή cache μπορεί να απαιτήσουν ξανά λήψη.

Μπορώ να χρησιμοποιήσω το εξαγόμενο κείμενο χωρίς έλεγχο;

Ελέγξτε το πρώτα, ειδικά ονόματα, ποσά, ημερομηνίες, σημεία στίξης και παρόμοιους χαρακτήρες όπως O και 0 ή l και 1. Η εμφανιζόμενη εμπιστοσύνη είναι συνολική εκτίμηση του Tesseract. Δεν πιστοποιεί κάθε λέξη ούτε διατηρεί τη διάταξη της αρχικής εικόνας.