SpeechRecognition Python 函式庫

Python 的口語語言處理

Daniel Bourke

Machine Learning Engineer/YouTube Creator

為何使用 SpeechRecognition?

現有的部分 Python 函式庫

  • CMU Sphinx
  • Kaldi
  • SpeechRecognition
  • Facebook 的 Wav2letter++
Python 的口語語言處理

開始使用 SpeechRecognition

從 PyPi 安裝:

$ pip install SpeechRecognition
  • 相容 Python 2 與 3
  • 我們將使用 Python 3
Python 的口語語言處理

使用 Recognizer 類別

# 匯入 SpeechRecognition 函式庫
import speech_recognition as sr

# 建立 Recognizer 實例 recognizer = sr.Recognizer()
# 設定 energy 門檻 recognizer.energy_threshold = 300
Python 的口語語言處理

用 Recognizer 類別進行語音辨識

  • Recognizer 類別內建與語音 API 互動的函式
    • recognize_bing()
    • recognize_google()
    • recognize_google_cloud()
    • recognize_wit()

輸入:audio_file

輸出:audio_file 的轉譯文字

Python 的口語語言處理

SpeechRecognition 範例

  • 聚焦 recognize_google()

  • 用 SpeechRecognition 從音訊檔辨識語音:

# 匯入 SpeechRecognition 函式庫
import speech_recognition as sr

# 建立 Recognizer 類別的實例 recognizer = sr.Recognizer()
# 使用 Google 網路 API 轉譯語音 recognizer.recognize_google(audio_data=audio_file language="en-US")
Learning speech recognition on DataCamp is awesome!
Python 的口語語言處理

換你了!

Python 的口語語言處理

Preparing Video For Download...