Knihovna SpeechRecognition

Zpracování mluveného jazyka v Pythonu

Daniel Bourke

Machine Learning Engineer/YouTube Creator

Proč knihovna SpeechRecognition?

Existující Python knihovny

  • CMU Sphinx
  • Kaldi
  • SpeechRecognition
  • Wav2letter++ od Facebooku
Zpracování mluveného jazyka v Pythonu

Začínáme se SpeechRecognition

Instalace z PyPi:

$ pip install SpeechRecognition
  • Kompatibilní s Pythonem 2 a 3
  • Budeme používat Python 3
Zpracování mluveného jazyka v Pythonu

Použití třídy Recognizer

# Import the SpeechRecognition library
import speech_recognition as sr

# Create an instance of Recognizer recognizer = sr.Recognizer()
# Set the energy threshold recognizer.energy_threshold = 300
Zpracování mluveného jazyka v Pythonu

Rozpoznávání řeči pomocí třídy Recognizer

  • Třída Recognizer obsahuje vestavěné funkce pro práci se speech API
    • recognize_bing()
    • recognize_google()
    • recognize_google_cloud()
    • recognize_wit()

Vstup: audio_file

Výstup: přepis řeči z audio_file

Zpracování mluveného jazyka v Pythonu

Příklad použití SpeechRecognition

  • Zaměříme se na recognize_google()

  • Přepis řeči z audio souboru pomocí SpeechRecognition:

# Import SpeechRecognition library
import speech_recognition as sr

# Instantiate Recognizer class recognizer = sr.Recognizer()
# Transcribe speech using Goole web API recognizer.recognize_google(audio_data=audio_file language="en-US")
Learning speech recognition on DataCamp is awesome!
Zpracování mluveného jazyka v Pythonu

Vyzkoušejte si to!

Zpracování mluveného jazyka v Pythonu

Preparing Video For Download...