CanDoYa
FIL

Audio to Text Converter para sa Tagalog

Tumatakbo nang buo sa iyong browser - walang upload, walang sign-up.

Magdagdag ng audio file para gumawa ng pribadong transcript sa device mo.

Ibahagi ang tool na ito

Paano gawing text ang audio nang hindi ito ina-upload?

Magdagdag ng audio file at patatakbuhin ng audio to text converter na ito ang Whisper speech recognition model sa device mo. Makakakuha ka ng nae-edit na transcript na puwedeng i-export bilang TXT o SRT. Hindi ina-upload ang recording mo, pero kailangang i-download ng browser ang AI model sa unang paggamit.

Paano gamitin

  1. 1Piliin ang recording. I-drop sa tool ang MP3, WAV, M4A, OGG, FLAC o WebM file, o i-click ang upload area para pumili.
  2. 2Simulan ang pribadong transcription. I-click ang I-transcribe ang audio. Sa unang paggamit, hintaying ma-download ang multilingual Whisper model, saka hayaang iproseso ito ng device mo.
  3. 3Suriin at i-export. Pakinggan ulit ang mga bahaging hindi tiyak, ayusin ang mga mali, saka kopyahin ang transcript o i-download bilang TXT o SRT na may timestamp.

Para kanino ito

Ginagawang text ng tool na ito ang na-record na boses nang hindi ipinapadala ang recording sa isang transcription service. Tumatakbo ang Whisper model sa isang browser worker, kaya nananatiling responsive ang page habang ang computer mo ang nagpoproseso. WebGPU ang ginagamit kapag available; lumilipat naman sa mas mabagal na CPU mode ang ibang browser. Sine-save ng browser sa cache ang na-download na model para sa susunod na paggamit.

FAQ

Ina-upload ba sa server ang audio ko?

Hindi. Dine-decode ng browser ang pinili mong file at ipinapadala lang ang audio samples sa lokal na worker sa device mo. Dina-download ng worker ang Whisper model files mula sa Hugging Face, pero hindi nito ina-upload ang recording o transcript mo. Hindi natatanggap o sine-save ng CanDoYa ang file.

Libre ba ang audio to text converter?

Oo. Walang account, bayad, transcription credit o watermark. Device mo ang gumagawa ng AI inference, kaya processing time, memory at unang model download lang ang praktikal na kapalit. Posibleng ibilang pa rin ng internet provider mo ang model download sa metered data allowance.

Gaano kalaking file at kahabang recording ang puwedeng i-transcribe?

Tumatanggap ang upload control ng file na hanggang 500 MB. Walang nakatakdang limitasyon sa minuto, pero mas maraming memory at oras ang kailangan ng mahabang recording dahil sa device mo ginagawa ang inference. Mas angkop ang modernong laptop kaysa phone para sa isang oras na meeting o lecture.

Anong mga audio format ang sinusuportahan?

Tumatanggap ang tool ng MP3, WAV, M4A, OGG, FLAC, WebM at ilang kaugnay na format. Nakasalalay sa browser at operating system mo ang aktuwal na decoding support. Kung tinanggihan ang file kahit kasama ang extension nito, i-convert muna sa MP3 o uncompressed WAV at subukan ulit.

Anong mga wika ang kayang i-transcribe ng Whisper?

Multilingual ang napiling Whisper tiny model at awtomatiko nitong natutukoy ang maraming sinasalitang wika, kabilang ang Tagalog at English. Nag-iiba ang accuracy ayon sa wika, accent, linaw ng recording at paksa. Hindi nito isinasalin ang transcript sa ibang wika, tinutukoy kung sino ang nagsasalita o ginagarantiya ang tamang baybay ng mga pangalan at espesyal na termino.

Bakit kailangang mag-download ng model sa unang transcription?

Kailangan ng pribadong transcription sa device ang speech recognition model sa computer mo. Humigit-kumulang 80 MB ang dina-download ng WebGPU path, habang mga 105 MB naman ang compatible na quantized CPU fallback. Karaniwang sine-save ng browser sa cache ang mga file para magamit ulit sa susunod, maliban kung binura ang site data o cache.

Gumagana ba ang audio transcription nang walang WebGPU?

Oo. Inuuna ng tool ang WebGPU dahil mas mabilis nitong mapapatakbo ang Whisper sa supported na graphics processor. Kapag wala o pumalya ang WebGPU, susubukan ulit gamit ang WebAssembly sa CPU. Gumagana ang fallback na ito sa mas maraming browser, pero maaaring mabagal sa mahabang recording, lalo na sa phone at lumang computer.

Gaano ka-accurate ang transcript?

Nakakagawa ang Whisper tiny ng kapaki-pakinabang na draft mula sa malinaw na boses, pero hindi nito garantisado ang bawat salita. Nakababawas sa accuracy ang ingay, musika, sabayang pagsasalita, mahinang microphone, di-pangkaraniwang pangalan at mahabang katahimikan. Ikumpara sa orihinal na audio ang mahahalagang sipi, medical detail, legal statement at pasya.