語音辨識 (Automatic Speech Recognition, ASR) 可以將麥克風或語音檔 (.wav) 輸出成文字。在 python 中常用的套件為 SpeechRecognition。
套件安裝
請先在 Pycharm Terminal 中安裝 SpeechRecognition 套件
🔒 更多內容,請登入會員繼續閱讀。
立即登入然後準備一個 “.wav” 檔置於專案下,再輸入如下代碼即可執行。代碼中的 test.wav 請由本站下載
🔒 更多內容,請登入會員繼續閱讀。
立即登入Speeh_recognition 可以連接到不少的 api,但大部份的 api 都需要 key。而 r.recognize_google 為 Google 所提供的 api,不需要 key,不過好像有時間長度的限制。
使用麥克風
若要使用麥克風說話再進行輸出,需先安裝如下套件
