Nástroj mení nahranú reč na text bez odoslania nahrávky prepisovacej službe. Model Whisper beží v pracovnom vlákne prehliadača, takže stránka zostáva počas spracovania použiteľná. Ak je dostupné WebGPU, využije grafický procesor. Inak sa zapne pomalší režim CPU. Stiahnutý model si prehliadač uloží pre ďalšie návštevy.
Prepis zvuku na text
Beží celý vo vašom prehliadači - bez nahrávania, bez registrácie.
Ako súkromne prepísať zvuk na text?
Pridajte zvukový súbor a nástroj spustí rozpoznávanie reči Whisper priamo vo vašom zariadení. Výsledkom je upraviteľný prepis, ktorý možno stiahnuť ako TXT alebo SRT. Nahrávka sa nikam neodosiela, pri prvom použití si však prehliadač musí stiahnuť model AI.
Ako na to
- 1Vyberte nahrávku. Pretiahnite do nástroja súbor MP3, WAV, M4A, OGG, FLAC či WebM alebo kliknite na oblasť nahrávania a súbor vyberte.
- 2Spustite súkromný prepis. Kliknite na Prepísať zvuk. Pri prvom spustení počkajte na stiahnutie viacjazyčného modelu Whisper a potom nechajte zariadenie spracovať nahrávku.
- 3Skontrolujte a stiahnite. Neisté pasáže si znova vypočujte, opravte chyby a prepis skopírujte alebo stiahnite ako TXT či časovaný SRT.
Pre koho je nástroj určený
- Novinári a výskumníci získajú súkromný prvý prepis a následne overia mená aj citácie podľa nahrávky.
- Študenti premenia nahrané prednášky alebo hlasové poznámky na upraviteľný text bez odosielania školského zvuku.
- Tvorcovia podcastov a videí pripravia hrubý prepis alebo časovaný súbor SRT pre titulky.
- Tímy pracujúce s citlivými nahrávkami ponechajú zdrojový zvuk v zariadení namiesto odoslania do cloudovej služby.
Časté otázky
Odosiela sa môj zvuk na server?
Nie. Prehliadač dekóduje vybraný súbor a zvukové vzorky odovzdá iba miestnemu pracovnému vláknu v rovnakom zariadení. Vlákno stiahne súbory modelu Whisper z Hugging Face, no nahrávku ani prepis nikam neodosiela. CanDoYa súbor neprijíma ani neukladá.
Je prepis zvuku na text zadarmo?
Áno. Nie je potrebný účet, platba, kredit ani vodoznak. Výpočet vykonáva vaše zariadenie, praktickou cenou je teda čas, pamäť a prvé stiahnutie modelu. Poskytovateľ internetu môže stiahnutie započítať do dátového limitu.
Akú veľkú a dlhú nahrávku môžem prepísať?
Výber súboru prijíma najviac 500 MB. Pevný limit minút nie je stanovený, dlhé nahrávky však potrebujú viac pamäte a spracovanie trvá dlhšie. Na hodinové porady alebo prednášky je vhodnejší moderný notebook než telefón.
Ktoré zvukové formáty sú podporované?
Nástroj prijíma MP3, WAV, M4A, OGG, FLAC, WebM a niekoľko príbuzných formátov. Skutočná podpora dekódovania závisí od prehliadača a operačného systému. Ak súbor s uvedenou príponou nefunguje, preveďte ho na MP3 alebo nekomprimovaný WAV.
Ktoré jazyky dokáže Whisper prepísať?
Použitý malý model Whisper je viacjazyčný a automaticky rozpozná mnoho hovorených jazykov. Presnosť sa líši podľa jazyka, prízvuku, kvality záznamu a témy. Model neprekladá do iného jazyka, nerozlišuje rečníkov a nezaručuje správny zápis mien ani odborných výrazov.
Prečo sa pri prvom prepise sťahuje model?
Súkromné spracovanie v zariadení potrebuje model rozpoznávania reči priamo v počítači. Verzia WebGPU stiahne približne 80 MB, kvantovaná záloha pre CPU asi 105 MB. Prehliadač súbory zvyčajne uloží, kým nevymažete údaje webu alebo vyrovnávaciu pamäť.
Funguje prepis aj bez WebGPU?
Áno. Nástroj uprednostňuje WebGPU, pretože podporovaný grafický procesor dokáže Whisper výrazne zrýchliť. Keď WebGPU chýba alebo zlyhá, prepne sa na WebAssembly v CPU. Tento režim funguje vo viacerých prehliadačoch, no pri dlhých nahrávkach môže byť pomalý.
Aký presný je prepis?
Whisper tiny vytvorí z čistej reči užitočný návrh, nie zaručene doslovný prepis. Hluk, hudba, prekrývajúce sa hlasy, slabý mikrofón, neobvyklé mená a dlhé ticho znižujú presnosť. Dôležité citácie, zdravotné údaje, právne vyjadrenia a rozhodnutia overte podľa pôvodného zvuku.