CanDoYa
PL

Obraz na tekst - Konwerter OCR w przeglądarce

Działa w całości w przeglądarce - bez wysyłania plików i bez rejestracji.

Aby rozpocząć, wybierz obraz z wyraźnym drukowanym tekstem.

Udostępnij to narzędzie

Jak działa konwerter obrazu na tekst?

Konwerter obrazu na tekst wykorzystuje optyczne rozpoznawanie znaków (OCR), aby wykryć drukowany tekst na zdjęciu lub skanie i zwrócić edytowalny wynik. To narzędzie uruchamia Tesseract WebAssembly bezpośrednio w Twojej przeglądarce, obsługuje języki używane we wszystkich 40 wersjach językowych CanDoYa i pozwala skopiować lub pobrać tekst bez przesyłania obrazu.

Jak korzystać

  1. 1Wybierz wyraźny obraz. Dodaj plik JPEG, PNG, WebP, BMP lub statyczny GIF do 15 MB i 24 megapikseli albo skorzystaj z wbudowanego przykładu.
  2. 2Wskaż język tekstu. Wybierz język faktycznie widoczny na obrazie. Odpowiedni model językowy Tesseract zostanie pobrany przy rozpoczęciu rozpoznawania.
  3. 3Rozpoznaj i sprawdź tekst. Uruchom OCR, porównaj nazwy i liczby z oryginałem, popraw ewentualne błędy, a następnie skopiuj tekst lub pobierz plik TXT w UTF-8.

Dla kogo

Ten konwerter korzysta z Tesseract.js 7, przeglądarkowej wersji otwartego silnika OCR Tesseract. Kod, rdzeń WebAssembly i wybrany model językowy są ładowane dopiero po uruchomieniu rozpoznawania. Tesseract działa w osobnym procesie w tle, więc strona pozostaje responsywna podczas przetwarzania obrazu przez Twoje urządzenie.

Dokładność OCR zależy głównie od jakości obrazu, a nie od formatu pliku. Najlepsze efekty daje prosty, wyraźny druk, równomierne oświetlenie, ostry obraz, mocny kontrast i odpowiednia liczba pikseli. Małe zrzuty ekranu mogą dać lepszy wynik po powiększeniu, natomiast krzywe strony, ozdobne czcionki, kolumny, pismo odręczne, odblaski i rozmazane zdjęcia mogą wymagać ręcznej korekty.

Najczęstsze pytania

Czy mój obraz jest wysyłany na serwer?

Nie. Wybrany plik jest dekodowany i rozpoznawany lokalnie przez proces Tesseract w Twojej przeglądarce. Przeglądarka pobiera publiczne pliki silnika OCR i językowe z zewnętrznych serwerów, ale te żądania nie zawierają Twojego obrazu. CanDoYa nie otrzymuje ani nie przechowuje źródłowego obrazu ani rozpoznanego tekstu.

Czy konwerter obraz na tekst jest darmowy?

Tak. Nie wymaga konta, płatności, znaku wodnego, limitów pobrań ani opłat za wynik. Przetwarzanie odbywa się na Twoim urządzeniu. Pobranie silnika OCR i danych językowych wymaga połączenia z internetem, a większe modele mogą mieć znaczenie przy ograniczonym transferze.

Jakie formaty i limity obrazu są obsługiwane?

Możesz przetworzyć jeden plik JPEG, PNG, WebP, BMP lub statyczny GIF do 15 MB i 24 megapikseli. Te limity zmniejszają ryzyko błędów pamięci na telefonach i laptopach. Narzędzie obsługuje tylko obrazy - do pełnych stron PDF użyj dedykowanego narzędzia OCR do PDF.

Jaka jest dokładność rozpoznawania tekstu z obrazu?

Czysty, wyraźny druk jest rozpoznawany dobrze, ale żaden wynik OCR nie jest gwarantowany. Ostry obraz, duże litery, wysoki kontrast, prosta strona i poprawnie wybrany język zwiększają dokładność. Pismo odręczne, nietypowe czcionki, odblaski, rozmazania, tabele, kolumny lub mieszane kierunki tekstu mogą powodować błędy lub zmianę kolejności linii.

Czy można wyodrębnić tekst odręczny?

Może rozpoznać bardzo staranne pismo drukowane, ale to narzędzie Tesseract jest przeznaczone głównie do tekstu drukowanego. Kursywa i nieregularne kształty liter są znacznie mniej skuteczne. Traktuj wynik z pisma ręcznego jako szkic i porównaj każde ważne słowo, datę i liczbę z oryginałem.

Jaki język tekstu wybrać?

Wybierz język, w którym zapisane są znaki na obrazie, a nie język przeglądarki. Lista obejmuje języki używane we wszystkich 40 wersjach CanDoYa, w tym chiński uproszczony i tradycyjny osobno. Jeśli na stronie są różne języki, wybierz dominujący - w jednym rozpoznaniu ładowany jest tylko jeden model.

Dlaczego pierwsze rozpoznanie trwa dłużej?

Przeglądarka musi najpierw pobrać kod Tesseract.js, zgodny rdzeń WebAssembly oraz wybrany model językowy. Kolejne uruchomienia mogą być szybsze dzięki pamięci podręcznej, ale tryb prywatny, czyszczenie pamięci, wybór nowego języka lub usunięcie cache może wymusić ponowne pobranie.

Czy można użyć rozpoznanego tekstu bez sprawdzania?

Zawsze sprawdź wynik, zwłaszcza nazwy, sumy, daty, interpunkcję i podobne znaki, np. O i 0 lub l i 1. Pokazana pewność to ogólna ocena Tesseract, nie potwierdzenie każdego znaku ani zachowania oryginalnego układu.