CanDoYa
ID

Pembuat subtitle otomatis

Berjalan sepenuhnya di browser Anda - tanpa unggah, tanpa daftar.

Tambahkan video untuk membuat subtitle privat yang dapat diedit di perangkat.

Bagikan tool ini

Bagaimana cara membuat subtitle otomatis untuk video?

Tambahkan video, lalu pembuat subtitle otomatis ini menjalankan pengenalan suara Whisper di perangkat. Hasilnya berupa baris subtitle bertanda waktu yang dapat dipratinjau, diedit, dan diunduh sebagai SRT atau VTT. Video tidak diunggah, meski browser perlu mengunduh model AI saat pertama kali dipakai.

Cara pakai

  1. 1Pilih video. Letakkan file MP4, WebM, MOV, M4V, atau MKV di alat ini, atau klik area unggah untuk memilih file.
  2. 2Buat subtitle bertanda waktu. Klik Buat subtitle. Pada pemakaian pertama, tunggu model Whisper multibahasa selesai diunduh, lalu biarkan perangkat memproses trek audio.
  3. 3Periksa setiap baris. Putar subtitle dari editor, perbaiki kata yang salah dikenali, serta sesuaikan waktu mulai atau selesai jika penanda otomatis terlalu awal maupun terlambat.
  4. 4Ekspor file subtitle. Unduh SRT untuk dukungan luas di editor dan platform, atau pilih VTT untuk video HTML dan publikasi web.

Cocok untuk siapa

Alat ini mengambil trek audio di dalam browser, mengubahnya menjadi sinyal mono 16 kHz yang dibutuhkan Whisper, lalu membuat waktu subtitle melalui worker latar. Komputer yang didukung memakai WebGPU untuk mempercepat proses; browser lain beralih ke mode CPU yang lebih lambat. Sebelum diekspor, teks serta batas awal dan akhir setiap baris dapat diperbaiki.

Tanya jawab

Apakah video saya diunggah ke server?

Tidak. Browser membaca file yang dipilih dan hanya mengirim sampel audio yang sudah didekode ke worker di perangkat yang sama. Worker mengunduh file model Whisper dari Hugging Face, tetapi tidak mengunggah video, audio, atau subtitle. CanDoYa tidak menerima maupun menyimpan file.

Apakah pembuat subtitle otomatis ini gratis?

Ya. Tidak ada akun, pembayaran, batas menit subtitle, tanda air, atau penguncian ekspor. Perangkat sendiri menjalankan transkripsi, jadi biaya praktisnya berupa waktu pemrosesan, memori, dan unduhan model pertama. Penyedia internet dapat menghitung unduhan itu dalam kuota data.

Seberapa besar dan panjang video yang dapat diberi subtitle?

Pemilih file menerima ukuran hingga 500 MB. Tidak ada batas menit tetap, tetapi video panjang membutuhkan lebih banyak memori dan waktu karena dekode serta proses AI berlangsung di perangkat. Untuk rekaman satu jam, gunakan laptop modern, tutup tab yang boros memori, atau bagi video menjadi bagian yang lebih pendek.

Format video apa saja yang didukung?

Alat ini menerima kontainer MP4, WebM, MOV, M4V, MKV, AVI, MPEG, dan OGV. Kemampuan dekode audio sebenarnya bergantung pada codec yang tersedia di browser dan sistem operasi. MP4 dengan audio AAC serta WebM dengan audio Opus biasanya memiliki dukungan browser terluas.

Apakah subtitle otomatis dapat diedit?

Ya. Setiap baris memiliki teks, waktu mulai, dan waktu selesai yang dapat diedit. Putar satu baris untuk memindahkan pratinjau ke titik awalnya, lalu perbaiki kesalahan pengenalan dan batas waktu. Ekspor dinonaktifkan jika baris kosong, selesai sebelum mulai, atau melewati durasi video.

Apa perbedaan SRT dan VTT?

SRT adalah format subtitle yang didukung secara luas oleh editor video dan platform penerbitan. WebVTT memakai struktur teks bertanda waktu yang serupa, tetapi dirancang untuk web dan dapat digunakan langsung dengan elemen video HTML. Alat ini mengekspor keduanya tanpa menambahkan gaya visual atau menyatukan teks ke dalam video.

Apakah subtitle bisa dibuat tanpa WebGPU?

Bisa. Alat mencoba WebGPU lebih dahulu karena prosesor grafis yang kompatibel dapat menjalankan Whisper lebih cepat. Jika WebGPU tidak tersedia atau gagal, alat mencoba lagi dengan WebAssembly di CPU. Mode ini mendukung lebih banyak browser, tetapi bisa sangat lambat untuk video panjang, terutama di ponsel dan komputer lama.

Apakah subtitle otomatis cukup akurat untuk aksesibilitas?

Hasilnya berguna sebagai draf, bukan produk aksesibilitas yang sudah selesai. Derau, musik, pembicara yang tumpang tindih, aksen, nama yang jarang, dan istilah teknis dapat menyebabkan kesalahan. Pengenalan otomatis juga melewatkan banyak deskripsi bunyi serta label pembicara, jadi tinjau video dan tambahkan petunjuk nonucapan yang penting sebelum menerbitkan takarir resmi.