CanDoYa
BG

Автоматични субтитри за видео

Работи изцяло в браузъра - без качване и без регистрация.

Добавете видео, за да създадете локални и редактируеми субтитри.

Споделете този инструмент

Как да създам автоматични субтитри за видео?

Добавете видео и генераторът на автоматични субтитри ще стартира разпознаване на реч с Whisper директно на устройството. Ще получите редактируеми сегменти с времеви маркери, които може да прегледате и изтеглите като SRT или VTT. Видеото не се качва никъде, но при първото използване браузърът трябва да изтегли AI модела.

Как се използва

  1. 1Изберете видео. Пуснете MP4, WebM, MOV, M4V или MKV файл върху инструмента или натиснете зоната за качване, за да го изберете от устройството.
  2. 2Създайте субтитри с времеви маркери. Натиснете „Създаване на субтитри“. При първото стартиране изчакайте многоезичният модел Whisper да се изтегли, след което оставете устройството да обработи звуковата пътека.
  3. 3Проверете всеки сегмент. Пускайте сегментите от редактора, поправяйте текста и променяйте началния или крайния час, когато автоматичната синхронизация е прекалено ранна или късна.
  4. 4Експортирайте файла със субтитри. Изтеглете SRT за видеоредактори и платформи или VTT за HTML видео и публикуване в интернет.

За кого е

Инструментът извлича звуковата пътека в браузъра, преобразува я в 16 kHz моно сигнал за Whisper и изчислява времето на субтитрите във фонов процес. WebGPU ускорява обработката на поддържаните компютри; останалите браузъри използват по-бавен режим с процесора. Преди експортиране може да поправите текста, началото и края на всеки сегмент.

Често задавани въпроси

Качва ли се видеото ми на сървър?

Не. Браузърът прочита избрания файл и предава декодираните аудиоданни само към локален фонов процес на същото устройство. Процесът изтегля файловете на модела Whisper от Hugging Face, но не качва видеото, звука или субтитрите. CanDoYa не получава и не съхранява файла.

Безплатен ли е генераторът на автоматични субтитри?

Да. Не са нужни профил и плащане, няма лимит за минути, воден знак или заключен експорт. Устройството извършва транскрипцията, така че реалната цена е време, памет и първото изтегляне на модела. Интернет доставчикът може да отчете този трафик при план с ограничени данни.

Видео с какъв размер и продължителност мога да обработя?

Може да изберете файл до 500 MB. Няма фиксиран лимит за минути, но дългите видеа изискват повече памет и време, защото декодирането и AI обработката се извършват локално. За едночасов запис използвайте съвременен лаптоп, затворете тежките раздели или първо разделете видеото.

Кои видеоформати работят?

Инструментът приема контейнери MP4, WebM, MOV, M4V, MKV, AVI, MPEG и OGV. Реалното декодиране на звука зависи от кодеците в браузъра и операционната система. Обикновено най-широко се поддържат MP4 с AAC звук и WebM с Opus звук.

Мога ли да редактирам автоматичните субтитри?

Да. За всеки сегмент може да промените текста, началния и крайния час. Пуснете сегмента, за да отидете на точното място във видеото, поправете грешките при разпознаване и уточнете границите. Експортът остава изключен, ако сегментът е празен, завършва преди началото или излиза извън продължителността на видеото.

Каква е разликата между SRT и VTT?

SRT е широко поддържан формат за субтитри във видеоредактори и платформи за публикуване. WebVTT има подобна структура с времеви маркери, но е създаден за уеб и работи директно с елемента за пътека на HTML видео. Инструментът експортира и двата формата без визуално оформление и без вграждане на текста в картината.

Работи ли създаването на субтитри без WebGPU?

Да. Инструментът първо опитва с WebGPU, защото съвместим графичен процесор ускорява Whisper. Ако WebGPU липсва или даде грешка, обработката се повтаря чрез WebAssembly на централния процесор. Този режим работи в повече браузъри, но може да е много по-бавен, особено за дълги видеа на телефони и по-стари компютри.

Достатъчно точни ли са автоматичните субтитри за достъпност?

Те са полезна чернова, а не завършен материал за достъпност. Шум, музика, едновременна реч, акценти, необичайни имена и специализирани термини могат да причинят грешки. Разпознаването на реч пропуска и много звукови описания и означения на говорещите, затова прегледайте видеото и добавете важните неречеви пояснения преди публикуване.