Інструмент дістає звукову доріжку прямо в браузері, перетворює її на моносигнал 16 кГц для Whisper і розраховує часові межі субтитрів у фоновому процесі. На сумісних комп'ютерах обробку прискорює WebGPU; інші браузери використовують повільніший режим CPU. Перед експортом у редакторі можна виправити текст, початок і кінець кожного фрагмента.
Автоматичні субтитри до відео
Працює повністю у вашому браузері - без завантаження на сервер і без реєстрації.
Як автоматично створити субтитри до відео?
Додайте відео, і генератор автоматичних субтитрів запустить розпізнавання мовлення Whisper на вашому пристрої. Він створить редаговані фрагменти з часовими мітками, які можна переглянути й завантажити як SRT або VTT. Відео нікуди не надсилається, але під час першого запуску браузер має завантажити модель AI.
Як користуватися
- 1Виберіть відео. Перетягніть у поле файл MP4, WebM, MOV, M4V або MKV чи натисніть область завантаження, щоб вибрати його на пристрої.
- 2Створіть субтитри з часовими мітками. Натисніть «Створити субтитри». Під час першого запуску дочекайтеся завантаження багатомовної моделі Whisper, після чого пристрій опрацює звукову доріжку.
- 3Перевірте кожен фрагмент. Відтворюйте фрагменти з редактора, виправляйте текст і змінюйте час початку або завершення, якщо автоматична синхронізація виявилася надто ранньою чи пізньою.
- 4Експортуйте файл субтитрів. Завантажте SRT для відеоредакторів і платформ або VTT для HTML-відео та публікації в інтернеті.
Кому це знадобиться
- Автори коротких відео можуть підготувати читабельні субтитри для роликів перед оформленням або вбудовуванням тексту у фінальний монтаж.
- Викладачі й тренери можуть зробити записані заняття зрозумілішими та додати окрему доріжку субтитрів для завантаження.
- Подкастери та інтерв'юери можуть отримати чернетку з часовими мітками, не надсилаючи неопубліковане відео до хмарної черги транскрипції.
- Фахівці з доступності можуть створити першу версію, а потім перевірити мовлення, імена, звукові позначки, синхронізацію та швидкість читання.
Часті запитання
Чи надсилається моє відео на сервер?
Ні. Браузер читає вибраний файл і передає декодовані аудіодані лише локальному фоновому процесу на тому самому пристрої. Цей процес завантажує файли моделі Whisper з Hugging Face, але не надсилає відео, аудіо чи субтитри. CanDoYa не отримує і не зберігає файл.
Генератор автоматичних субтитрів безкоштовний?
Так. Не потрібні обліковий запис, оплата чи кредити на хвилини, а на результаті немає водяного знака або блокування експорту. Транскрипцію виконує ваш пристрій, тому практична ціна полягає в часі обробки, використаній пам'яті та першому завантаженні моделі.
Відео якого розміру та тривалості можна опрацювати?
Можна вибрати файл до 500 МБ. Фіксованого ліміту хвилин немає, але довгі відео потребують більше пам'яті й часу, адже декодування та обчислення AI відбуваються локально. Для годинного запису скористайтеся сучасним ноутбуком, закрийте важкі вкладки або спочатку розділіть відео.
Які відеоформати працюють?
Інструмент приймає контейнери MP4, WebM, MOV, M4V, MKV, AVI, MPEG і OGV. Фактичне декодування звуку залежить від кодеків браузера та операційної системи. Зазвичай найкращу підтримку мають MP4 зі звуком AAC і WebM зі звуком Opus.
Чи можна редагувати автоматичні субтитри?
Так. У кожному фрагменті можна змінити текст, час початку та час завершення. Відтворіть його, щоб перейти до потрібного місця у відео, виправте помилки розпізнавання й уточніть межі. Експорт буде недоступний, якщо фрагмент порожній, закінчується раніше початку або виходить за тривалість відео.
Чим SRT відрізняється від VTT?
SRT широко підтримується відеоредакторами та платформами для публікації. WebVTT має подібну структуру тексту з часовими мітками, але створений для вебу й працює безпосередньо з елементом доріжки HTML-відео. Інструмент експортує обидва формати без стилізації та вбудовування тексту в зображення.
Чи працює створення субтитрів без WebGPU?
Так. Спочатку інструмент пробує WebGPU, тому що сумісний графічний процесор прискорює Whisper. Якщо WebGPU недоступний або дає збій, обробка повторюється через WebAssembly на CPU. Цей режим підтримує більше браузерів, але може бути набагато повільнішим, особливо для довгих відео на телефонах і старих комп'ютерах.
Чи достатньо точні автоматичні субтитри для доступності?
Це корисна чернетка, а не готовий матеріал із доступності. Шум, музика, одночасне мовлення, акценти, незвичні імена й технічні терміни можуть спричинити помилки. Автоматичне розпізнавання також пропускає чимало описів звуків і позначок мовців, тому перевірте відео та додайте змістовні немовленнєві підказки перед публікацією.