CanDoYa
DA

Lav automatiske undertekster på video

Kører helt i din browser - ingen upload, ingen tilmelding.

Tilføj en video for at lave private, redigerbare undertekster på enheden.

Del dette værktøj

Hvordan laver jeg automatiske undertekster på en video?

Tilføj en video, så kører værktøjet Whisper-talegenkendelse på din enhed. Det opretter redigerbare undertekster med tidskoder, som kan afspilles og hentes som SRT eller VTT. Videoen uploades aldrig, men browseren skal hente AI-modellen første gang.

Sådan gør du

  1. 1Vælg en video. Slip en MP4-, WebM-, MOV-, M4V- eller MKV-fil i værktøjet, eller klik på uploadområdet for at vælge den.
  2. 2Lav undertekster med tidskoder. Klik på Lav undertekster. Første gang skal du vente, mens den flersprogede Whisper-model hentes; derefter behandler enheden lydsporet.
  3. 3Gennemgå hver undertekst. Afspil underteksten i editoren, ret fejl i ordene, og justér start- eller sluttiden, hvis den automatiske timing ligger for tidligt eller sent.
  4. 4Eksportér undertekstfilen. Hent SRT for bred understøttelse i editorer og platforme, eller VTT til HTML-video og udgivelse på nettet.

Hvem er det til

Værktøjet trækker lydsporet ud af videoen i browseren, konverterer det til det 16 kHz monosignal, Whisper bruger, og laver tidskoderne i en baggrundsproces. WebGPU gør behandlingen hurtigere på understøttede computere; andre browsere bruger en langsommere CPU-reserve. Før eksport kan både ordlyd og start- og sluttid for hver undertekst rettes.

Ofte stillede spørgsmål

Bliver min video uploadet til en server?

Nej. Browseren læser den valgte fil og sender kun afkodede lyddata til en worker på samme enhed. Workeren henter Whisper-modelfiler fra Hugging Face, men uploader ikke video, lyd eller undertekster. CanDoYa modtager eller gemmer ikke filen.

Er værktøjet til automatiske undertekster gratis?

Ja. Der er ingen konto, betaling, minutgrænse, vandmærke eller låst eksport. Din enhed udfører transskriberingen, så de praktiske omkostninger er behandlingstid, hukommelse og den første modeldownload. Din udbyder kan tælle downloadet med i et begrænset dataabonnement.

Hvor stor og lang en video kan jeg tekste?

Filvælgeren accepterer op til 500 MB. Der er ingen fast minutgrænse, men lange videoer kræver mere hukommelse og tid, fordi afkodning og AI-kørsel foregår lokalt. Brug en moderne bærbar til optagelser på en time, luk hukommelsestunge faner, eller del videoen først.

Hvilke videoformater virker?

Værktøjet accepterer MP4, WebM, MOV, M4V, MKV, AVI, MPEG og OGV. Den faktiske lydafkodning afhænger af codecs i browseren og operativsystemet. MP4 med AAC-lyd og WebM med Opus-lyd har som regel den bredeste understøttelse.

Kan jeg redigere de automatiske undertekster?

Ja. Hver undertekst har redigerbar tekst samt start- og sluttid. Afspil en linje for at hoppe til begyndelsen og rette genkendelsesfejl eller tidsgrænser. Eksport er slået fra, hvis en linje er tom, slutter før starten eller går ud over videoens varighed.

Hvad er forskellen på SRT og VTT?

SRT er et undertekstformat med bred understøttelse i videoredigering og på udgivelsesplatforme. WebVTT har en lignende tidskodet struktur, men er lavet til nettet og virker direkte med HTML-elementet video. Værktøjet eksporterer begge uden styling eller indbrænding i billedet.

Virker undertekster uden WebGPU?

Ja. Værktøjet prøver WebGPU først, fordi en kompatibel grafikprocessor kan køre Whisper hurtigere. Hvis WebGPU mangler eller fejler, prøver det igen med WebAssembly på CPU'en. Reserven virker i flere browsere, men kan være meget langsom med lange videoer på telefoner og ældre computere.

Er automatiske undertekster præcise nok til tilgængelighed?

De er nyttige som udkast, ikke som et færdigt tilgængelighedsprodukt. Støj, musik, overlappende stemmer, accenter, sjældne navne og fagudtryk kan give fejl. Automatisk genkendelse udelader også mange lydbeskrivelser og talermarkeringer. Gennemgå videoen, og tilføj vigtige oplysninger uden tale før udgivelse.