CanDoYa
DA

Billede til tekst konverter

Kører helt i din browser - ingen upload, ingen tilmelding.

Vælg et billede med tydelig trykt tekst for at begynde.

Del dette værktøj

Hvordan fungerer billede til tekst-konvertering?

En billede til tekst-konverter bruger optisk tegngenkendelse (OCR) til at finde trykte tegn på et foto eller en scanning og returnerer redigerbar tekst. Denne løsning kører Tesseract WebAssembly direkte i din browser, dækker de sprog der bruges på tværs af alle 40 CanDoYa-lokaler, og lader dig kopiere eller downloade resultatet uden at billedet forlader din enhed.

Sådan gør du

  1. 1Vælg et tydeligt billede. Brug et JPEG, PNG, WebP, BMP eller ikke-animeret GIF op til 15 MB og 24 megapixels, eller indlæs det indbyggede eksempel.
  2. 2Vælg tekstens sprog. Vælg det sprog, teksten i billedet er skrevet på. Den relevante Tesseract-sprogmodel hentes, når du starter udtrækningen.
  3. 3Udtræk og tjek. Kør OCR, sammenlign navne og tal med originalen, ret eventuelle fejl, og kopier teksten eller download den som en UTF-8 TXT-fil.

Hvem er det til

Denne konverter bruger Tesseract.js 7, en browserbaseret version af den åbne Tesseract OCR-motor. Kode, WebAssembly-kerne og det valgte sprogdata hentes først, når du starter udtrækningen. Tesseract kører i sin egen baggrundsproces, så siden forbliver responsiv, mens din enhed behandler billedet.

OCR-præcision afhænger mest af billedkvaliteten og mindre af filformatet. Lige, trykt tekst, jævn belysning, skarpt fokus, tydelig kontrast og tilstrækkelig opløsning hjælper. Små screenshots kan blive bedre efter opskalering, mens skæve sider, dekorative fonte, kolonner, håndskrift, genskin og slørede billeder ofte kræver manuel rettelse.

Ofte stillede spørgsmål

Bliver mit billede uploadet til en server?

Nej. Den valgte fil behandles lokalt på din enhed af en Tesseract-baggrundsproces. Browseren henter offentlige OCR-motor- og sprogfiler fra eksterne værter, men disse forespørgsler indeholder ikke dit billede. CanDoYa modtager eller gemmer hverken kildebillede eller udtrukket tekst.

Er denne billede til tekst-konverter gratis?

Ja. Der kræves hverken konto, betaling, vandmærke, sidekreditter eller downloadgebyr. Din enhed udfører arbejdet. OCR-motor og sprogdata kræver dog internet, og store sprogmodeller kan fylde, hvis du har begrænset data.

Hvilke billedformater og grænser gælder?

Du kan bruge ét JPEG, PNG, WebP, BMP eller ikke-animeret GIF op til 15 MB og 24 megapixels. Disse grænser mindsker risikoen for hukommelsesfejl på telefoner og bærbare. Værktøjet understøtter kun billeder - brug et dedikeret PDF OCR-værktøj, hvis du skal genkende hele PDF-sider.

Hvor præcis er billede til tekst-konvertering?

Ren trykt tekst kan ofte genkendes godt, men ingen OCR er fejlfri. Skarpt fokus, store bogstaver, høj kontrast, en lige side og korrekt sprogvalg forbedrer resultatet. Håndskrift, specielle fonte, genskin, slør, tabeller, kolonner og blandede læseretninger kan give forvekslinger eller ændret linjeorden.

Kan teksten på håndskrevne noter også udtrækkes?

Meget pæn blokbogstav-håndskrift kan nogle gange genkendes, men dette Tesseract-baserede værktøj er primært til trykt tekst. Løkkeskrift og varierende bogstavformer er langt mindre pålidelige. Behandl håndskrift som et udkast og sammenlign alle vigtige ord, datoer og tal med originalbilledet.

Hvilket tekstsprog skal jeg vælge?

Vælg det sprog, der bruges i billedets tekst, ikke sproget i din browser. Listen dækker de sprog, der bruges på tværs af alle 40 CanDoYa-lokaler, inklusive både forenklet og traditionelt kinesisk. Hvis billedet indeholder flere sprog, vælg det dominerende; der bruges én sprogmodel pr. udtrækning.

Hvorfor tager første udtrækning længere tid?

Browseren skal først hente Tesseract.js-koden, en kompatibel WebAssembly-kerne og sprogdata for det valgte sprog. Browserens cache kan gøre senere kørsel hurtigere, men privat tilstand, oprydning, et nyt sprog eller renset cache kan kræve nyt download.

Kan jeg bruge udtrukket tekst uden at tjekke den?

Gennemgå altid resultatet først, især navne, beløb, datoer, tegnsætning og tegn der ligner hinanden, som O og 0 eller l og 1. Den viste pålidelighed er et overordnet Tesseract-skøn. Den garanterer ikke hvert ord og bevarer ikke nødvendigvis dokumentets layout.