CanDoYa
UK

Розпізнавання тексту з зображення

Працює повністю у вашому браузері - без завантаження на сервер і без реєстрації.

Оберіть зображення з чітким друкованим текстом, щоб почати.

Поділитися інструментом

Як працює розпізнавання тексту з зображення?

Розпізнавання тексту з зображення використовує оптичне розпізнавання символів (OCR), щоб знаходити друковані символи на фото чи скані та повертати редагований текст. Цей інструмент запускає Tesseract WebAssembly у вашому браузері, охоплює мови, які використовуються у всіх 40 локалях CanDoYa, і дозволяє копіювати або завантажувати результат без передачі вихідного зображення.

Як користуватися

  1. 1Оберіть якісне зображення. Додайте JPEG, PNG, WebP, BMP або статичний GIF до 15 МБ і 24 мегапікселів, або скористайтеся вбудованим прикладом.
  2. 2Вкажіть мову тексту. Оберіть мову, якою надруковано текст на зображенні. Відповідні мовні дані Tesseract завантажаться під час запуску розпізнавання.
  3. 3Запустіть розпізнавання і перевірте результат. Запустіть OCR, звірте імена та числа з оригіналом, виправте помилки, потім скопіюйте текст або завантажте файл UTF-8 TXT.

Кому це знадобиться

Тут використовується Tesseract.js 7 - браузерна версія відкритого OCR-двигуна Tesseract. Код, ядро WebAssembly та вибрані мовні дані завантажуються лише під час запуску розпізнавання. Tesseract виконує розпізнавання у власному фоновому процесі, тому сторінка залишається чутливою, поки ваш пристрій обробляє зображення.

Точність OCR найбільше залежить від якості вихідного зображення, а не від формату файлу. Найкраще розпізнаються рівно розташований друкований текст, рівномірне освітлення, чіткий фокус, контрастність і достатня деталізація. Маленькі скріншоти можна покращити збільшенням масштабу, а перекошені сторінки, декоративні шрифти, стовпці, рукопис, відблиски чи розмиті фото частіше потребують ручної перевірки.

Часті запитання

Чи завантажується моє зображення на сервер?

Ні. Вибраний файл декодується і розпізнається на вашому пристрої у фоновому процесі Tesseract. Браузер завантажує публічні файли OCR-рушія та мов із зовнішніх джерел, але ці запити не містять вашого зображення. CanDoYa не отримує і не зберігає вихідне зображення чи розпізнаний текст.

Чи безкоштовний цей конвертер?

Так. Не потрібні акаунт, оплата, водяні знаки, кредити чи плата за завантаження результату. Для обробки використовується ваш пристрій. Початкове завантаження OCR-рушія і мовних даних використовує ваш інтернет, і великі мовні моделі можуть впливати на трафік при обмеженому підключенні.

Які обмеження та формати зображень підтримуються?

Можна обробити одне зображення JPEG, PNG, WebP, BMP або статичний GIF до 15 МБ і 24 мегапікселів. Такі обмеження зменшують ризик помилок пам’яті на телефонах і ноутбуках. Інструмент працює лише з зображеннями; для розпізнавання повних PDF-сторінок скористайтеся окремим OCR для PDF.

Наскільки точне розпізнавання тексту з зображення?

Чіткий друкований текст розпізнається добре, але жоден результат OCR не гарантований. Чіткий фокус, великі літери, високий контраст, рівна сторінка і правильна мова підвищують точність. Рукопис, незвичні шрифти, відблиски, розмиття, таблиці, стовпці чи змішані напрямки читання можуть призвести до замін або перестановки рядків.

Чи можна розпізнати рукописний текст?

Можливо, якщо рукопис дуже акуратний друкованим почерком, але цей інструмент на основі Tesseract призначений насамперед для друкованого тексту. Курсив і нерівні літери розпізнаються значно гірше. Результат для рукопису варто сприймати як чорновик і звіряти кожне важливе слово, дату та число з оригіналом.

Яку мову вибрати для розпізнавання?

Оберіть мову, якою надруковано текст на зображенні, а не мову браузера. Список охоплює всі мови, що використовуються у 40 локалях CanDoYa, включаючи окремо спрощену й традиційну китайську. Якщо на сторінці кілька мов, виберіть основну - ця версія використовує одну модель розпізнавання за раз.

Чому перше розпізнавання триває довше?

Браузер спочатку завантажує код Tesseract.js, сумісне ядро WebAssembly і навчальні дані для вибраної мови. Кеш браузера може прискорити наступні запуски, але приватний режим, очищення сховища, нова мова чи видалення кешу можуть знову вимагати завантаження.

Чи можна використовувати розпізнаний текст без перевірки?

Перед використанням перевірте імена, суми, дати, розділові знаки та схожі символи, наприклад O і 0 або l і 1. Показник впевненості - це лише загальна оцінка Tesseract. Він не гарантує правильність кожного слова і не зберігає точне візуальне розташування тексту.