CanDoYa
ES

Convertidor de imagen a texto

Funciona del todo en tu navegador: sin subir nada y sin registro.

Elige una imagen con texto impreso y claro para comenzar.

Comparte esta herramienta

¿Cómo funciona un convertidor de imagen a texto?

Un convertidor de imagen a texto utiliza reconocimiento óptico de caracteres (OCR) para identificar texto impreso en una foto o escaneo y devolverlo como texto editable. Esta herramienta ejecuta Tesseract WebAssembly directamente en tu navegador, cubre los idiomas usados en los 40 idiomas de CanDoYa y permite copiar o descargar el resultado sin subir la imagen original.

Cómo se usa

  1. 1Elige una imagen clara. Arrastra un archivo JPEG, PNG, WebP, BMP o GIF (sin animación) de hasta 15 MB y 24 megapíxeles, o carga el ejemplo incluido.
  2. 2Selecciona el idioma del texto. Elige el idioma que aparece impreso en la imagen. Los datos de idioma de Tesseract se descargan al iniciar la extracción.
  3. 3Extrae y revisa. Ejecuta el OCR, compara nombres y números con la imagen original, corrige lo necesario y luego copia el texto o descárgalo como archivo TXT en UTF-8.

Para quién es

Este convertidor utiliza Tesseract.js 7, la versión para navegador del motor OCR Tesseract de código abierto. El código, el núcleo WebAssembly y los datos del idioma seleccionado se descargan solo al iniciar la extracción. Tesseract realiza el reconocimiento en un proceso en segundo plano, por lo que la página sigue respondiendo mientras tu dispositivo procesa la imagen.

La precisión del OCR depende más de la calidad de la imagen que del formato del archivo. El texto impreso, recto, bien enfocado, con buen contraste y suficiente resolución mejora los resultados. Las capturas pequeñas pueden mejorar al ampliarlas, mientras que las páginas torcidas, fuentes decorativas, columnas, escritura a mano, reflejos y fotos borrosas suelen requerir corrección manual.

Preguntas frecuentes

¿Mi imagen se sube a un servidor?

No. El archivo se decodifica y reconoce en tu dispositivo mediante un proceso de Tesseract. El navegador descarga el motor OCR y los archivos de idioma desde servidores públicos, pero esas solicitudes no incluyen tu imagen. CanDoYa no recibe ni almacena la imagen original ni el texto extraído.

¿Este convertidor de imagen a texto es gratuito?

Sí. No requiere cuenta, pago, marcas de agua ni cobra por descargar el resultado. El procesamiento lo realiza tu propio dispositivo. La descarga inicial del motor y los datos de idioma usa tu conexión, y los modelos de idioma más grandes pueden consumir más datos si tienes una tarifa limitada.

¿Qué límites y formatos de imagen admite?

Puedes procesar un archivo JPEG, PNG, WebP, BMP o GIF sin animación de hasta 15 MB y 24 megapíxeles. Estos límites ayudan a evitar errores de memoria en móviles y portátiles. Solo se admiten imágenes; si necesitas reconocer páginas PDF completas, utiliza una herramienta OCR específica para PDF escaneados.

¿Qué precisión tiene la conversión de imagen a texto con OCR?

El texto impreso y claro se reconoce bien, pero ningún resultado de OCR es garantizado. Un buen enfoque, letras grandes, alto contraste, página recta y el idioma correcto mejoran la precisión. La escritura a mano, fuentes poco comunes, reflejos, desenfoque, tablas, columnas o direcciones de lectura mixtas pueden provocar errores o líneas desordenadas.

¿Puede extraer notas manuscritas?

Puede recuperar letra manuscrita muy clara y en mayúsculas, pero esta herramienta basada en Tesseract está pensada principalmente para texto impreso. La escritura cursiva y las letras irregulares son mucho menos fiables. Considera el texto manuscrito como un borrador y revisa cada palabra, fecha y número importante con la imagen original.

¿Qué idioma de texto debo elegir?

Elige el idioma que aparece en la imagen, no el de tu navegador. La lista cubre los idiomas usados en los 40 idiomas de CanDoYa, incluyendo chino simplificado y tradicional por separado. Si la página mezcla idiomas, selecciona el principal; en cada extracción se usa un solo modelo de reconocimiento.

¿Por qué la primera extracción tarda más?

El navegador debe descargar primero el código de Tesseract.js, el núcleo WebAssembly y los datos entrenados para el idioma seleccionado. La caché del navegador puede acelerar las siguientes veces, pero el modo privado, limpiar almacenamiento, elegir un idioma nuevo o vaciar la caché puede requerir otra descarga.

¿Puedo usar el texto extraído sin revisarlo?

Revisa antes nombres, totales, fechas, signos de puntuación y caracteres similares, como O y 0 o l y 1. La confianza mostrada es una estimación general de Tesseract. No certifica cada palabra ni conserva el diseño visual exacto del original.