CanDoYa
RU

Распознавание текста с изображения

Работает прямо в браузере - без загрузки файлов и регистрации.

Выберите изображение с четким напечатанным текстом, чтобы начать.

Поделиться инструментом

Как работает распознавание текста с изображения?

Распознавание текста с изображения использует оптическое распознавание символов (OCR), чтобы находить напечатанные буквы на фото или скане и возвращать редактируемый текст. Этот инструмент запускает Tesseract WebAssembly прямо в вашем браузере, поддерживает языки, используемые во всех 40 локалях CanDoYa, и позволяет скопировать или скачать результат без загрузки исходного изображения.

Как пользоваться

  1. 1Выберите четкое изображение. Загрузите или перетащите JPEG, PNG, WebP, BMP или неанимированный GIF до 15 МБ и 24 мегапикселей, либо используйте встроенный пример.
  2. 2Укажите язык текста. Выберите язык, на котором напечатан текст на изображении. Необходимые языковые данные Tesseract будут загружены при запуске распознавания.
  3. 3Извлеките и проверьте. Запустите OCR, сравните имена и числа с оригиналом, исправьте возможные ошибки, затем скопируйте текст или скачайте файл в формате UTF-8 TXT.

Кому пригодится

В основе - Tesseract.js 7, браузерная версия открытого движка Tesseract OCR. Код, WebAssembly-ядро и выбранные языковые данные загружаются только при запуске распознавания. Tesseract выполняет обработку в отдельном фоновом процессе, поэтому страница остается отзывчивой, пока ваше устройство распознаёт текст на изображении.

Точность OCR больше зависит от качества исходника, чем от формата файла. Прямой напечатанный текст, равномерное освещение, четкий фокус, высокий контраст и достаточное разрешение - всё это помогает получить лучший результат. Маленькие скриншоты можно улучшить увеличением, а косые страницы, декоративные шрифты, колонки, рукописный текст, блики и размытые фото чаще требуют ручной проверки и исправлений.

Вопросы и ответы

Моё изображение загружается на сервер?

Нет. Выбранный файл обрабатывается на вашем устройстве в фоновом процессе Tesseract. Браузер скачивает открытые файлы движка и языковые данные с внешних серверов, но эти запросы не содержат ваше изображение. CanDoYa не получает и не хранит исходное изображение или распознанный текст.

Это действительно бесплатно?

Да. Нет регистрации, оплаты, водяных знаков, лимитов на скачивание или скрытых платежей - обработка происходит на вашем устройстве. Для загрузки движка и языковых данных потребуется интернет, и крупные языковые модели могут быть заметны на ограниченном трафике.

Какие форматы и ограничения поддерживаются?

Можно обработать одно изображение JPEG, PNG, WebP, BMP или неанимированный GIF до 15 МБ и 24 мегапикселей. Эти ограничения помогают избежать сбоев на телефонах и ноутбуках. Инструмент работает только с изображениями; для PDF используйте отдельный OCR для сканированных PDF-файлов.

Насколько точен перевод изображения в текст?

Чистый напечатанный текст обычно распознаётся хорошо, но стопроцентной гарантии нет. Четкий фокус, крупные буквы, высокий контраст, ровная страница и правильный язык повышают точность. Рукопись, необычные шрифты, блики, размытость, таблицы, колонки и смешанные направления текста могут привести к ошибкам или перестановке строк.

Можно ли извлечь рукописные заметки?

Иногда удаётся распознать очень аккуратный печатный почерк, но этот инструмент на базе Tesseract рассчитан прежде всего на печатный текст. Курсив и нестандартные буквы распознаются значительно хуже. Результат с рукописи стоит воспринимать как черновик и обязательно сверять каждое важное слово, дату и число с оригиналом.

Какой язык текста нужно выбрать?

Выбирайте язык, на котором напечатан текст на изображении, а не язык браузера. Список покрывает языки всех 40 локалей CanDoYa, включая отдельные модели для упрощённого и традиционного китайского. Если на странице встречаются несколько языков, выберите основной - за одну обработку используется только одна языковая модель.

Почему первое распознавание занимает больше времени?

Браузеру нужно загрузить код Tesseract.js, совместимое WebAssembly-ядро и обученные данные для выбранного языка. Кэш ускоряет последующие запуски, но приватный режим, очистка памяти, смена языка или удаление кэша могут потребовать повторной загрузки.

Можно ли использовать полученный текст без проверки?

Рекомендуется обязательно проверить результат, особенно имена, суммы, даты, знаки препинания и похожие символы, например O и 0 или l и 1. Отображаемый уровень уверенности - это общая оценка Tesseract. Он не гарантирует точность каждой буквы и не сохраняет исходное оформление.