往下拉回到首頁
有人做了個超方便的工具,可以自動對齐音檔和文字,還用 GPU 加速超快

有人做了個超方便的工具,可以自動對齐音檔和文字,還用 GPU 加速超快

easyaligner: GPU-Powered Forced Alignment That Actually Works With Any Speech Model

欸你知道嗎,有個開發者做了一個叫 easyaligner 的工具,專門用來對齁音檔和文字稿的。簡單來說就是:你有一堆音檔和對應的文字,但它們沒有對齐,easyaligner 就可以自動幫你配對,而且用 GPU 加速超快。 如果你有在做語音 AI 相關的工作,應該知道這有多煩——要處理幾千小時的音檔和文字,手動對齁根本不可能。這個工具就是為了解決這個問題。最猛的是它相容 Hugging Face 上面所有的 wav2vec2 模型,所以你不用擔心相容性問題。 作者自己也是被現有的工具搞到很煩,所以才自己做一個。說真的,這種「既強大又好用」的工具在這個領域真的不多見,通常要嘛很強大但超難用,要嘛簡單但功能不夠。有興趣的話可以去看看,說不定能省你不少時間。