0
Whisper Model
Có cách nào để Whisper hoạt động tốt trên các âm thanh âm nhạc không ạ, em có dùng thử https://github.com/EtienneAb3d/WhisperTimeSync với có chia nhỏ đoạn âm thanh ra và https://github.com/kaim-tqkhai711/ASR- để tăng hiệu suất nhưng kết quả không khả quan lắm ạ
Thêm một bình luận
1 CÂU TRẢ LỜI
0
Bạn sử dụng cho mục đích up file audio và nhận về transcription hay sử dụng cho realtime. Trong faster whisper (https://github.com/SYSTRAN/faster-whisper) có các param để bật VAD filter (Voice Activity Detection) bạn thử xem có cải thiện không.
Dạ mình cảm ơn bạn nhiều ạ, mình có dùng thử Stable Whisper và nhiều tiền, hậu xử lý và có kết quả khá ổn (hầu như là đúng hết) trên đa số các bài rồi ạ https://github.com/lengoc-tuyen/Youtube-Auto-SRT-Generator