CanDoYa
NB

Bilde til tekst-konvertering

Kjører helt i nettleseren - ingen opplasting, ingen registrering.

Velg et bilde med tydelig trykt tekst for å starte.

Del dette verktøyet

Hvordan fungerer bilde til tekst-konvertering?

En bilde til tekst-konverterer bruker optisk tegngjenkjenning (OCR) for å finne trykte tegn i et bilde eller en skanning og gjøre dem til redigerbar tekst. Dette verktøyet kjører Tesseract WebAssembly i nettleseren, støtter språkene som brukes i alle de 40 CanDoYa-lokalene, og lar deg kopiere eller laste ned resultatet uten at bildefilen lastes opp.

Slik bruker du verktøyet

  1. 1Velg et tydelig bilde. Dra inn en JPEG, PNG, WebP, BMP eller ikke-animerte GIF på opptil 15 MB og 24 megapiksler, eller bruk det innebygde eksempelet.
  2. 2Velg tekstspråk. Velg språket som faktisk er brukt i bildet. Tilsvarende Tesseract-språkdata lastes ned når du starter utlesningen.
  3. 3Les ut og kontroller. Kjør OCR, sammenlign navn og tall med originalbildet, rett eventuelle feil, og kopier teksten eller last ned som en UTF-8 TXT-fil.

Hvem passer det for

Denne konvertereren bruker Tesseract.js 7, en nettleserversjon av den åpne Tesseract OCR-motoren. Kode, WebAssembly-kjerne og valgt språkdata lastes først når du starter utlesningen. Tesseract kjører i en egen bakgrunnsprosess, slik at nettsiden forblir responsiv mens enheten din behandler bildet.

OCR-nøyaktighet avhenger mest av bildekvaliteten, ikke filformatet. Rett trykt tekst, jevnt lys, skarpt fokus, tydelig kontrast og tilstrekkelig oppløsning gir best resultat. Små skjermbilder kan bli tydeligere etter oppskalering, mens skjeve sider, dekorative fonter, kolonner, håndskrift, gjenskinn og uklare bilder ofte krever manuell gjennomgang.

Vanlige spørsmål

Lastes bildet mitt opp til en server?

Nei. Den valgte filen dekodes og gjenkjennes lokalt på enheten din av en Tesseract-bakgrunnsprosess. Nettleseren laster offentlige OCR- og språkfiler fra eksterne kilder, men disse forespørslene inneholder ikke bildet ditt. CanDoYa mottar eller lagrer verken bildefilen eller uttrukket tekst.

Er denne bilde til tekst-konvertereren gratis?

Ja. Du trenger ikke konto, betaling, vannmerke, sidekreditter eller å betale for å laste ned resultatet. Det er enheten din som gjør jobben. Nedlasting av OCR-motor og språkdata bruker fortsatt internett, og store språkmodeller kan ha betydning på begrensede nettlinjer.

Hvilke bildefiler og grenser støttes?

Du kan bruke én JPEG, PNG, WebP, BMP eller ikke-animerte GIF på opptil 15 MB og 24 megapiksler. Disse grensene reduserer minnefeil på mobil og bærbar. Verktøyet støtter kun bilder; bruk et dedikert PDF-OCR-verktøy for å tolke hele PDF-sider.

Hvor nøyaktig er bilde til tekst-konvertering?

Ren trykt tekst kan gjenkjennes godt, men ingen OCR garanterer feilfri resultat. Skarpt fokus, store bokstaver, høy kontrast, rett side og riktig språkvalg gir bedre nøyaktighet. Håndskrift, spesialfonter, gjenskinn, uskarphet, tabeller, kolonner og blandet leseretning kan føre til feil eller omstokking av linjer.

Kan den lese håndskrevne notater?

Den kan noen ganger tolke svært ryddig blokkbokstav-håndskrift, men dette Tesseract-baserte verktøyet er laget hovedsakelig for trykt tekst. Løkkeskrift og ujevne bokstaver gir langt dårligere resultat. Behandle håndskrift som et utkast og sammenlign alle viktige ord, datoer og tall med originalbildet.

Hvilket tekstspråk bør jeg velge?

Velg språket som brukes i bildet, ikke språket i nettleseren. Listen dekker språkene brukt på tvers av alle 40 CanDoYa-lokaler, inkludert både forenklet og tradisjonell kinesisk. Hvis bildet har flere språk, velg det dominerende; denne versjonen bruker én språkmodell per utlesning.

Hvorfor tar første utlesning lengre tid?

Nettleseren må først laste Tesseract.js-koden, en kompatibel WebAssembly-kjerne og treningsdata for valgt språk. Nettleserens cache kan gjøre senere bruk raskere, men privat modus, opprydding, nytt språk eller tømt cache kan kreve ny nedlasting.

Kan jeg bruke teksten uten å sjekke den?

Se alltid over resultatet, spesielt navn, summer, datoer, tegnsetting og tegn som ligner, som O og 0 eller l og 1. Påliteligheten som vises er et grovt Tesseract-anslag. Den garanterer ikke hvert ord og bevarer ikke nøyaktig oppsett fra originalbildet.