Az eszköz a böngészőben kinyeri a hangsávot, a Whisper által várt 16 kHz-es monó jellé alakítja, majd egy háttérfolyamatban elkészíti a felirat időzítését. Támogatott számítógépen a WebGPU gyorsítja a feldolgozást; a többi böngésző lassabb CPU módra vált. Exportálás előtt a szöveg, valamint minden felirat kezdete és vége is javítható.
Automatikus feliratozás videóhoz
Teljesen a böngésződben fut - feltöltés és regisztráció nélkül.
Hogyan készíthető automatikus felirat egy videóhoz?
Adjon hozzá egy videót, és ez az automatikus feliratozó a fájl feltöltése nélkül, helyben futtatja a Whisper beszédfelismerést. Az időzített feliratok előnézetben lejátszhatók, szerkeszthetők, majd SRT vagy VTT formátumban letölthetők. Az első használatkor a böngészőnek le kell töltenie az AI-modellt.
Így működik
- 1Válasszon videót. Húzzon az eszközre egy MP4, WebM, MOV, M4V vagy MKV fájlt, vagy kattintson a feltöltési területre a kiválasztásához.
- 2Készítse el az időzített feliratot. Kattintson a Felirat készítése gombra. Első alkalommal várja meg a többnyelvű Whisper modell letöltését, majd hagyja, hogy az eszköz feldolgozza a hangsávot.
- 3Ellenőrizze az összes feliratot. Játssza le a feliratokat a szerkesztőben, javítsa a szöveget, és módosítsa a túl korai vagy túl késői kezdési és befejezési időt.
- 4Exportálja a feliratfájlt. Töltsön le SRT fájlt a videoszerkesztők és platformok széles körű támogatásához, vagy VTT fájlt HTML-videóhoz és webes közzétételhez.
Kinek hasznos
- Rövid videók készítői könnyen olvasható feliratot készíthetnek, mielőtt megformázzák vagy véglegesen a képbe égetik.
- Tanárok és oktatók követhetőbbé tehetik a rögzített tananyagot, és külön letölthető feliratsávot adhatnak hozzá.
- Podcastok és interjúk készítői időzített vázlatot kaphatnak anélkül, hogy a még nem nyilvános felvételt felhőalapú átíró szolgáltatásnak küldenék.
- Akadálymentességi ellenőrök első változatot hozhatnak létre a beszéd, a nevek, a hangjelzések, az időzítés és az olvasási sebesség ellenőrzéséhez.
Gyakori kérdések
Feltöltődik a videóm egy szerverre?
Nem. A böngésző beolvassa a kiválasztott fájlt, és a dekódolt hangmintákat ugyanazon eszköz egyik háttérfolyamatának adja át. Ez letölti a Whisper modell fájljait a Hugging Face-ről, de a videót, a hangot és a feliratot nem tölti fel. A CanDoYa nem kapja meg és nem tárolja a fájlt.
Ingyenes az automatikus feliratozó?
Igen. Nincs szükség fiókra vagy fizetésre, és nincs perckorlát, vízjel vagy exportzár. Az átírást a saját eszköze végzi, ezért a tényleges ráfordítás a helyi feldolgozás ideje, a memóriahasználat és a modell első letöltése. Korlátozott adatcsomagnál a szolgáltató beleszámíthatja ezt a letöltést az adatkeretbe.
Mekkora és milyen hosszú videót lehet feliratozni?
A feltöltő legfeljebb 500 MB-os fájlt fogad. Nincs rögzített perckorlát, de a hosszú videók több memóriát és időt igényelnek, mert a dekódolás és az AI-feldolgozás helyben történik. Egyórás felvételhez használjon korszerű laptopot, zárja be a sok memóriát használó lapokat, vagy előbb ossza kisebb részekre a videót.
Milyen videoformátumok működnek?
Az eszköz MP4, WebM, MOV, M4V, MKV, AVI, MPEG és OGV tárolóformátumot fogad. A hang tényleges dekódolása a böngésző és az operációs rendszer kodektámogatásától függ. Az AAC-hangot tartalmazó MP4 és az Opus-hangot tartalmazó WebM általában a legtöbb böngészőben működik.
Szerkeszthető az automatikus felirat?
Igen. Minden felirat szövege, kezdési és befejezési ideje módosítható. Játsszon le egy feliratot, hogy az előnézet annak elejére ugorjon, javítsa a felismerési hibákat, és állítsa be a határokat. Az export nem érhető el, ha a felirat üres, a kezdete előtt ér véget, vagy túlnyúlik a videón.
Mi a különbség az SRT és a VTT között?
Az SRT széles körben támogatott feliratformátum, amelyet videoszerkesztők és közzétételi platformok használnak. A WebVTT hasonló időzített szövegszerkezetet használ, de webes használatra készült, és közvetlenül működik a HTML video elem track elemével. Az eszköz mindkettőt vizuális stílus és a szöveg képbe égetése nélkül exportálja.
WebGPU nélkül is működik a feliratozás?
Igen. Az eszköz először a WebGPU-t próbálja, mert támogatott grafikus processzorral a Whisper gyorsabban futhat. Ha a WebGPU nem érhető el vagy hibát jelez, WebAssembly segítségével újrapróbálja a CPU-n. Ez több böngészőben működik, de hosszú videóknál, telefonon vagy régi számítógépen jóval lassabb lehet.
Elég pontos az automatikus felirat akadálymentesítéshez?
Használható vázlat, de nem kész akadálymentességi anyag. A zaj, a zene, az egymásba beszélés, az akcentus, a ritka nevek és a szakkifejezések hibát okozhatnak. A beszédfelismerés sok hangleírást és beszélőcímkét is kihagy. Hivatalos akadálymentes felirat közzététele előtt nézze végig a videót, és adja hozzá a fontos, nem beszélt jelzéseket.