CanDoYa
IT

Immagine in testo - OCR privato

Funziona interamente nel browser: nessun caricamento, nessuna registrazione.

Scegli un’immagine con testo stampato chiaro per iniziare.

Condividi questo strumento

Come funziona un convertitore immagine in testo?

Un convertitore immagine in testo utilizza l’OCR (riconoscimento ottico dei caratteri) per individuare il testo stampato in una foto o scansione e restituirlo come testo modificabile. Questo strumento esegue Tesseract WebAssembly nel browser, supporta le lingue usate in tutte le 40 versioni locali CanDoYa e permette di copiare o scaricare il risultato senza caricare l’immagine originale.

Come si usa

  1. 1Scegli un’immagine chiara. Carica un file JPEG, PNG, WebP, BMP o GIF statico fino a 15 MB e 24 megapixel, oppure prova l’esempio incluso.
  2. 2Seleziona la lingua del testo. Scegli la lingua effettivamente stampata nell’immagine. I dati lingua Tesseract verranno scaricati quando avvii l’estrazione.
  3. 3Estrai e verifica. Avvia l’OCR, confronta nomi e numeri con l’originale, correggi eventuali errori, poi copia il testo o scarica un file TXT UTF-8.

A chi serve

Questo convertitore utilizza Tesseract.js 7, una versione per browser del motore OCR open-source Tesseract. Il codice, il core WebAssembly e i dati della lingua selezionata vengono caricati solo quando avvii l’estrazione. Il riconoscimento avviene in un processo in background Tesseract, così la pagina resta reattiva mentre il dispositivo elabora l’immagine.

L’accuratezza dell’OCR dipende più dalla qualità dell’immagine che dal formato file. Testo stampato dritto, illuminazione uniforme, immagine nitida, buon contrasto e sufficiente dettaglio in pixel aiutano il risultato. Screenshot piccoli possono migliorare se ingranditi; pagine storte, font decorativi, colonne, scrittura a mano, riflessi e foto sfocate richiedono spesso correzioni manuali.

Domande frequenti

La mia immagine viene caricata su un server?

No. Il file selezionato viene decodificato e riconosciuto sul tuo dispositivo da un processo in background Tesseract. Il browser scarica i file pubblici del motore OCR e dei dati lingua da host esterni, ma queste richieste non includono la tua immagine. CanDoYa non riceve né conserva l’immagine sorgente o il testo estratto.

Questo convertitore immagine in testo è gratuito?

Sì. Non richiede account, pagamenti, watermark, crediti o costi di download. L’elaborazione avviene sul tuo dispositivo. Il download iniziale del motore OCR e dei dati lingua utilizza la tua connessione Internet, e modelli lingua più grandi possono incidere su connessioni a traffico limitato.

Quali formati e limiti di immagine sono supportati?

Puoi elaborare un file JPEG, PNG, WebP, BMP o GIF statico fino a 15 MB e 24 megapixel. Questi limiti riducono errori di memoria su smartphone e laptop. Funziona solo con immagini; per riconoscere pagine PDF usa uno strumento OCR PDF dedicato.

Quanto è accurata la conversione immagine in testo tramite OCR?

Testo stampato e pulito può essere riconosciuto bene, ma nessun risultato OCR è garantito. Nitidezza, lettere grandi, buon contrasto, pagina dritta e lingua corretta migliorano l’accuratezza. Scrittura a mano, font insoliti, riflessi, sfocature, tabelle, colonne e direzioni di lettura miste possono produrre errori o righe fuori ordine.

Si possono estrarre appunti scritti a mano?

Può recuperare solo una scrittura a mano molto chiara e stampatello, ma questo strumento basato su Tesseract è pensato principalmente per testo stampato. Scrittura corsiva e lettere irregolari sono molto meno affidabili. Considera il risultato della scrittura a mano come una bozza e confronta ogni parola, data e numero importante con l’immagine originale.

Quale lingua del testo devo selezionare?

Scegli la lingua usata dai caratteri nell’immagine, non quella del browser. L’elenco copre le lingue usate in tutte le 40 versioni locali CanDoYa, includendo cinese semplificato e tradizionale separatamente. Se la pagina contiene più lingue, seleziona quella principale: viene caricato un solo modello di riconoscimento per ogni estrazione.

Perché la prima estrazione è più lenta?

Il browser deve prima caricare il codice Tesseract.js, il core WebAssembly e i dati della lingua selezionata. Le estrazioni successive possono essere più rapide grazie alla cache, ma modalità privata, pulizia della memoria, una nuova lingua o la cancellazione della cache possono richiedere un nuovo download.

Posso usare il testo estratto senza controllarlo?

Controllalo sempre prima, soprattutto nomi, totali, date, punteggiatura e caratteri simili come O e 0 o l e 1. L’affidabilità mostrata è una stima generale di Tesseract. Non certifica ogni parola né preserva la disposizione visiva originale.