CanDoYa
CS

Obrázek na text

Běží celé ve vašem prohlížeči - nic se nenahrává, žádná registrace.

Vyberte obrázek s jasně čitelným tištěným textem pro začátek.

Sdílet tento nástroj

Jak funguje převod obrázku na text?

Převod obrázku na text využívá optické rozpoznávání znaků (OCR) k nalezení tištěných znaků na fotografii nebo skenu a vrácení editovatelného textu. Tento nástroj spouští Tesseract WebAssembly přímo ve vašem prohlížeči, pokrývá jazyky používané ve všech 40 lokalizacích CanDoYa a umožňuje výsledek zkopírovat nebo stáhnout bez odesílání zdrojového obrázku.

Jak na to

  1. 1Vyberte kvalitní obrázek. Vložte JPEG, PNG, WebP, BMP nebo neanimovaný GIF do 15 MB a 24 megapixelů, nebo použijte vestavěný příklad.
  2. 2Zvolte jazyk textu. Vyberte jazyk, který je skutečně vytištěný na obrázku. Odpovídající jazyková data Tesseract se stáhnou při spuštění extrakce.
  3. 3Extrahujte a zkontrolujte. Spusťte OCR, porovnejte jména a čísla se zdrojem, případně opravte chyby, a poté text zkopírujte nebo stáhněte jako TXT v kódování UTF-8.

Pro koho je nástroj

Tento převodník využívá Tesseract.js 7, prohlížečovou verzi open-source OCR enginu Tesseract. Kód, WebAssembly jádro a vybraná jazyková data se načítají až při spuštění extrakce. Rozpoznávání probíhá v samostatném background procesu, takže stránka zůstává během zpracování obrázku plynule ovladatelná.

Přesnost OCR závisí hlavně na kvalitě předlohy, nikoliv na formátu souboru. Nejlepších výsledků dosáhnete s rovně vyfoceným tištěným textem, rovnoměrným osvětlením, ostrým obrazem, silným kontrastem a dostatečným rozlišením. Malé screenshoty lze vylepšit zvětšením. Naopak šikmé stránky, dekorativní písma, sloupce, rukopis, odlesky nebo rozmazané fotky mohou vyžadovat ruční opravy.

Časté dotazy

Nahrává se můj obrázek na server?

Ne. Vybraný soubor je dekódován a rozpoznán přímo ve vašem zařízení v background procesu Tesseractu. Prohlížeč stahuje veřejné OCR komponenty a jazyková data z externích serverů, ale tyto požadavky nikdy neobsahují váš obrázek. CanDoYa neukládá ani nevidí zdrojový obrázek ani extrahovaný text.

Je tento převodník obrázku na text zdarma?

Ano. Není potřeba účet, platba, vodoznak, kredity ani poplatek za stažení výsledku. Zpracování probíhá na vašem zařízení. První stažení OCR enginu a jazykových dat využívá vaše internetové připojení a větší jazykové modely mohou být znát na omezeném tarifu.

Jaké formáty a limity obrázků jsou podporovány?

Můžete zpracovat jeden JPEG, PNG, WebP, BMP nebo neanimovaný GIF do 15 MB a 24 megapixelů. Tato omezení snižují riziko chyb na telefonech a noteboocích. Nástroj je určen pouze pro obrázky; pro celé PDF stránky použijte specializovaný OCR nástroj na skenované PDF.

Jak přesný je převod obrázku na text pomocí OCR?

Čistý tištěný text lze rozpoznat dobře, ale žádný výsledek není zaručen. Ostrost, velikost písma, kontrast, rovná stránka a správně zvolený jazyk zvyšují přesnost. Rukopis, neobvyklá písma, odlesky, rozmazání, tabulky, sloupce a smíšené směry čtení mohou způsobit chyby nebo změnit pořadí řádků.

Lze extrahovat i rukopisné poznámky?

Může rozpoznat velmi úhledný tiskací rukopis, ale tento nástroj založený na Tesseractu je určen hlavně pro tištěný text. Spojované písmo a nepravidelné tvary jsou mnohem méně spolehlivé. Výstup z rukopisu berte jako hrubý návrh a ověřte každý důležitý údaj podle originálu.

Jaký jazyk textu mám zvolit?

Vyberte jazyk, který je na obrázku použit, nikoliv jazyk vašeho prohlížeče. Výběr pokrývá jazyky používané ve všech 40 lokalizacích CanDoYa, včetně zjednodušené a tradiční čínštiny zvlášť. Pokud je na stránce více jazyků, zvolte převládající; v jednom běhu se načítá vždy jen jeden model.

Proč první extrakce trvá déle?

Prohlížeč musí nejprve stáhnout kód Tesseract.js, kompatibilní WebAssembly jádro a trénovaná jazyková data. Další běhy mohou být rychlejší díky mezipaměti, ale anonymní režim, vymazání úložiště, nový jazyk nebo vyprázdnění cache mohou vyžadovat nové stažení.

Mohu použít extrahovaný text bez kontroly?

Výsledek si vždy zkontrolujte, zejména jména, částky, data, interpunkci a znaky, které vypadají podobně (například O a 0 nebo l a 1). Zobrazená důvěra je pouze orientační odhad Tesseractu. Nezaručuje správnost každého slova ani zachování původního rozložení textu.