CanDoYa
CA

Convertidor d'imatge a text

Funciona del tot al navegador: sense pujar res ni registrar-te.

Tria una imatge amb text clar per començar.

Comparteix aquesta eina

Com funciona un convertidor d’imatge a text?

Un convertidor d’imatge a text utilitza el reconeixement òptic de caràcters (OCR) per detectar caràcters impresos en una foto o escaneig i retornar text editable. Aquesta eina executa Tesseract WebAssembly al teu navegador, cobreix les llengües utilitzades a tots els 40 entorns CanDoYa, i et permet copiar o descarregar el resultat sense pujar la imatge d’origen.

Com s’utilitza

  1. 1Tria una imatge clara. Arrossega un fitxer JPEG, PNG, WebP, BMP o GIF no animat de fins a 15 MB i 24 megapíxels, o carrega l’exemple integrat.
  2. 2Selecciona la llengua del text. Tria la llengua realment impresa a la imatge. Les dades corresponents de Tesseract es descarreguen quan inicies l’extracció.
  3. 3Extreu i revisa. Executa l’OCR, compara noms i números amb la imatge original, corregeix possibles errors i després copia el text o descarrega’l com a fitxer TXT en UTF-8.

Per a qui és

Aquest convertidor fa servir Tesseract.js 7, una adaptació al navegador del motor OCR de codi obert Tesseract. El codi, el nucli WebAssembly i les dades de llengua només es descarreguen quan inicies l’extracció. Tesseract fa el reconeixement en un procés en segon pla, així la pàgina segueix fluida mentre el teu dispositiu processa la imatge.

L’exactitud de l’OCR depèn més de la qualitat de la imatge que no pas del format. El text imprès recte, amb bona il·luminació, enfocament nítid, contrast fort i prou detall de píxels sol donar millors resultats. Les captures petites poden millorar si s’escalen, mentre que pàgines tortes, tipografies decoratives, columnes, manuscrits, reflexos i fotos borroses solen requerir més correcció manual.

Preguntes freqüents

La meva imatge es puja a algun servidor?

No. El fitxer seleccionat es descodifica i es reconeix al teu dispositiu per un procés de Tesseract. El navegador descarrega els arxius públics del motor OCR i de llengua des d’host externs, però aquestes sol·licituds no inclouen la teva imatge. CanDoYa no rep ni desa la imatge d’origen ni el text extret.

Aquest convertidor d’imatge a text és gratuït?

Sí. No cal cap compte, pagament, marca d’aigua, crèdits de pàgina ni cap cost per descarregar el resultat. El teu dispositiu fa el processament. La descàrrega inicial del motor OCR i de les dades de llengua utilitza la teva connexió, i els models grans poden afectar si tens dades limitades.

Quins formats i límits d’imatge s’admeten?

Pots processar un fitxer JPEG, PNG, WebP, BMP o GIF no animat de fins a 15 MB i 24 megapíxels. Aquests límits redueixen errors de memòria en mòbils i portàtils. Només s’admeten imatges; per reconèixer pàgines PDF completes, utilitza una eina d’OCR específica per a PDF escanejats.

Com d’exacte és l’OCR d’imatge a text?

El text imprès net es pot reconèixer bé, però cap resultat d’OCR està garantit. Un bon enfocament, lletres grans, contrast alt, pàgina recta i la llengua correcta milloren l’exactitud. Lletres manuscrites, fonts poc habituals, reflexos, borrositat, taules, columnes i direccions de lectura barrejades poden provocar errors o línies desordenades.

Pot extreure notes manuscrites?

Pot recuperar lletra de pal molt clara, però aquesta eina basada en Tesseract està pensada principalment per a text imprès. L’escriptura cursiva o les formes de lletra irregulars són molt menys fiables. Considera la sortida manuscrita com un esborrany i compara cada paraula, data i número important amb la imatge original.

Quina llengua de text he de triar?

Tria la llengua que apareix als caràcters de la imatge, no la del teu navegador. La llista cobreix les llengües utilitzades als 40 entorns CanDoYa, incloent xinès simplificat i tradicional per separat. Si la pàgina barreja llengües, selecciona la dominant; aquesta versió carrega un sol model de reconeixement per extracció.

Per què la primera extracció triga més?

El navegador ha de descarregar primer el codi Tesseract.js, un nucli WebAssembly compatible i les dades entrenades per a la llengua seleccionada. La memòria cau del navegador pot fer que les següents extraccions siguin més ràpides, però el mode privat, la neteja d’emmagatzematge, un canvi d’idioma o l’eliminació de la memòria cau poden requerir una nova descàrrega.

Puc utilitzar el text extret sense revisar-lo?

Revisa’l primer, especialment noms, totals, dates, signes de puntuació i caràcters semblants com la O i el 0 o la l i l’1. La confiança mostrada és una estimació general de Tesseract. No certifica cada paraula ni conserva l’aspecte visual exacte de la font.