CanDoYa
PT-BR

Conversor de imagem para texto

Funciona inteiramente no seu navegador - sem upload, sem cadastro.

Escolha uma imagem com texto impresso e legível para começar.

Compartilhe esta ferramenta

Como funciona um conversor de imagem para texto?

Um conversor de imagem para texto usa reconhecimento óptico de caracteres (OCR) para identificar caracteres impressos em uma foto ou digitalização e gerar texto editável. Aqui, o Tesseract WebAssembly roda no seu navegador, cobre os idiomas usados nos 40 locais CanDoYa e permite copiar ou baixar o resultado sem enviar a imagem de origem.

Como usar

  1. 1Escolha uma imagem nítida. Arraste um arquivo JPEG, PNG, WebP, BMP ou GIF estático de até 15 MB e 24 megapixels, ou use o exemplo disponível.
  2. 2Selecione o idioma do texto. Escolha o idioma realmente impresso na imagem. Os dados do idioma Tesseract são baixados ao iniciar a extração.
  3. 3Extraia e confira. Execute o OCR, compare nomes e números com a imagem original, corrija eventuais erros e então copie ou baixe em arquivo TXT UTF-8.

Para quem é

Este conversor utiliza o Tesseract.js 7, uma versão para navegador do motor OCR open-source Tesseract. O código, o núcleo WebAssembly e os dados do idioma escolhido são carregados apenas quando você inicia a extração. O Tesseract faz o reconhecimento em um processo em segundo plano, mantendo a página responsiva enquanto seu dispositivo processa a imagem.

A precisão do OCR depende mais da qualidade da imagem do que do formato do arquivo. Texto impresso reto, iluminação uniforme, foco nítido, contraste forte e boa resolução ajudam bastante. Capturas pequenas podem melhorar após serem ampliadas, enquanto páginas tortas, fontes decorativas, colunas, manuscritos, reflexos ou fotos borradas geralmente exigem correção manual.

Perguntas frequentes

Minha imagem é enviada para algum servidor?

Não. O arquivo selecionado é processado no seu dispositivo por um worker Tesseract. O navegador baixa os arquivos públicos do mecanismo OCR e do idioma, mas sua imagem não é incluída nesses pedidos. O CanDoYa não recebe nem armazena a imagem de origem ou o texto extraído.

Este conversor de imagem para texto é gratuito?

Sim. Não exige conta, pagamento, marca d'água, créditos de página ou taxa para baixar o resultado. O processamento é feito no seu dispositivo. O download inicial do mecanismo OCR e dos dados de idioma usa sua conexão, e modelos de idioma maiores podem impactar franquias limitadas.

Quais formatos e limites de imagem são aceitos?

Você pode processar um arquivo JPEG, PNG, WebP, BMP ou GIF estático de até 15 MB e 24 megapixels. Esses limites ajudam a evitar falhas de memória em celulares e notebooks. O serviço aceita apenas imagens; para reconhecer páginas inteiras de PDF, use uma ferramenta OCR específica para PDF.

Quão precisa é a conversão de imagem para texto via OCR?

Textos impressos e nítidos costumam ser reconhecidos com boa precisão, mas nenhum resultado de OCR é garantido. Foco nítido, letras grandes, contraste alto, página reta e idioma correto melhoram o resultado. Manuscritos, fontes incomuns, reflexos, borrões, tabelas, colunas ou direções de leitura mistas podem causar trocas de caracteres ou linhas fora de ordem.

O sistema reconhece texto manuscrito?

Pode funcionar com letra de forma bem legível, mas esta ferramenta baseada em Tesseract foi feita principalmente para texto impresso. Escrita cursiva e letras irregulares são muito menos confiáveis. Considere o resultado de manuscritos apenas como rascunho e confira cada palavra, data e número importantes na imagem original.

Qual idioma devo selecionar?

Escolha o idioma dos caracteres presentes na imagem, não o idioma do navegador. A lista cobre os idiomas usados nos 40 locais CanDoYa, incluindo chinês simplificado e tradicional separadamente. Se a página tiver mais de um idioma, selecione o principal; esta versão carrega um modelo de reconhecimento por vez.

Por que a primeira extração pode demorar mais?

O navegador precisa carregar o código do Tesseract.js, o núcleo WebAssembly e os dados treinados do idioma escolhido. O cache do navegador pode acelerar execuções seguintes, mas modo privado, limpeza de dados, novo idioma ou limpeza de cache podem exigir novo download.

Posso usar o texto extraído sem revisar?

Revise antes, especialmente nomes, totais, datas, pontuação e caracteres parecidos, como O e 0 ou l e 1. A confiança exibida é uma estimativa geral do Tesseract. Ela não certifica cada palavra nem preserva o layout visual do original.