CanDoYa
SV

Bild till text-konverterare

Körs helt i din webbläsare - inget laddas upp, ingen registrering.

Välj en bild med tydlig tryckt text för att börja.

Dela det här verktyget

Hur fungerar en bild till text-konverterare?

En bild till text-konverterare använder optisk teckenigenkänning (OCR) för att hitta tryckta tecken i ett foto eller en skanning och omvandla dem till redigerbar text. Det här verktyget kör Tesseract WebAssembly i din webbläsare, täcker de språk som används i alla 40 CanDoYa-lokaler, och låter dig kopiera eller ladda ner resultatet utan att källbilden laddas upp.

Så använder du verktyget

  1. 1Välj en tydlig bild. Släpp en JPEG, PNG, WebP, BMP eller icke-animerad GIF på upp till 15 MB och 24 megapixlar, eller testa det inbyggda exemplet.
  2. 2Välj textspråk. Välj det språk som faktiskt är tryckt i bilden. Rätt Tesseract-språkdata hämtas när du startar extraktionen.
  3. 3Extrahera och kontrollera. Kör OCR, jämför namn och siffror med originalet, rätta eventuella fel och kopiera texten eller ladda ner en UTF-8 TXT-fil.

Vem passar det för

Den här konverteraren använder Tesseract.js 7, en webbläsarversion av den öppna Tesseract OCR-motorn. Kod, WebAssembly-kärna och vald språkdata laddas först när du startar extraktionen. Tesseract körs i en egen bakgrundsprocess så att sidan förblir responsiv medan din enhet behandlar bilden.

OCR:ns noggrannhet beror mest på källbilden, inte filformatet. Upprätt tryckt text, jämn belysning, skarp fokus, tydlig kontrast och tillräcklig upplösning ger bäst resultat. Små skärmklipp kan bli tydligare om du förstorar dem, medan sneda sidor, dekorativa typsnitt, spalter, handskrift, blänk och suddiga foton ofta kräver manuell rättning.

Vanliga frågor

Laddas min bild upp till en server?

Nej. Den valda filen avkodas och tolkas lokalt på din enhet av en Tesseract-bakgrundsprocess. Webbläsaren hämtar publika OCR-motor- och språkfiler från externa servrar, men dessa förfrågningar innehåller inte din bild. CanDoYa tar inte emot eller sparar källbild eller utdragen text.

Är denna bild till text-konverterare gratis?

Ja. Ingen registrering, betalning, vattenstämpel, sidkrediter eller avgift för att ladda ner resultatet. Din enhet står för beräkningarna. Den första nedladdningen av OCR-motorn och språkdata använder dock din internetanslutning, och större språkmodeller kan påverka om du har begränsad datamängd.

Vilka bildgränser och format stöds?

Du kan behandla en JPEG, PNG, WebP, BMP eller icke-animerad GIF på upp till 15 MB och 24 megapixlar. Dessa gränser minskar risken för minnesproblem på mobiler och bärbara datorer. Verktyget hanterar endast bilder - använd ett särskilt PDF-OCR-verktyg om du behöver tolka hela PDF-sidor.

Hur noggrann är bild till text med OCR?

Ren tryckt text kan kännas igen väl, men inget OCR-resultat är garanterat. Skarp fokus, stora bokstäver, hög kontrast, rak sida och rätt språk förbättrar noggrannheten. Handskrift, ovanliga typsnitt, blänk, sudd, tabeller, spalter och blandade läsriktningar kan ge felaktiga tecken eller omkastade rader.

Kan den extrahera handskrivna anteckningar?

Den kan ibland tolka mycket tydlig blockskrift, men detta Tesseract-baserade verktyg är främst avsett för tryckt text. Skrivstil och varierande bokstavsformer är betydligt svårare. Behandla handskriftsresultat som ett utkast och jämför varje viktig detalj med originalbilden.

Vilket textspråk ska jag välja?

Välj det språk som används av tecknen i bilden, inte språket i din webbläsare. Listan täcker de språk som används i alla 40 CanDoYa-lokaler, inklusive förenklad och traditionell kinesiska separat. Om sidan blandar språk, välj det dominerande; denna version laddar ett språkpaket per körning.

Varför tar första extraktionen längre tid?

Webbläsaren måste först ladda Tesseract.js-koden, en kompatibel WebAssembly-kärna och tränad data för valt språk. Webbläsarens cache kan göra senare körningar snabbare, men privat läge, rensad lagring, nytt språk eller tömd cache kan innebära ny nedladdning.

Kan jag använda den extraherade texten utan att kontrollera den?

Granska alltid resultatet först, särskilt namn, summor, datum, skiljetecken och tecken som liknar varandra, som O och 0 eller l och 1. Det visade förtroendet är en generell Tesseract-uppskattning. Det garanterar inte varje ord och återskapar inte exakt originalets layout.