Đọc tệp âm thanh với SpeechRecognition

Xử lý Ngôn ngữ Nói bằng Python

Daniel Bourke

Machine Learning Engineer/YouTube Creator

Lớp AudioFile

import speech_recognition as sr

# Setup recognizer instance recognizer = sr.Recognizer()
# Read in audio file clean_support_call = sr.AudioFile("clean-support-call.wav")
# Check type of clean_support_call type(clean_support_call)
<class 'speech_recognition.AudioFile'>
Xử lý Ngôn ngữ Nói bằng Python

Từ AudioFile đến AudioData

recognizer.recognize_google(audio_data=clean_support_call)
AssertionError: ``audio_data`` must be audio data
# Convert from AudioFile to AudioData
with clean_support_call as source:

# Record the audio clean_support_call_audio = recognizer.record(source)
# Check the type type(clean_support_call_audio)
<class 'speech_recognition.AudioData'>
Xử lý Ngôn ngữ Nói bằng Python

Phiên âm AudioData của chúng ta

# Transcribe clean support call
recognizer.recognize_google(audio_data=clean_support_call_audio)
hello I'd like to get some help setting up my account please
Xử lý Ngôn ngữ Nói bằng Python

Duration và offset

  • durationoffset mặc định đều là None
# Giữ nguyên duration và offset mặc định
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=None,
                                                 offset=None)
# Lấy 2 giây đầu của cuộc gọi sạch
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=2.0)
hello I'd like to get
Xử lý Ngôn ngữ Nói bằng Python

Hãy thực hành!

Xử lý Ngôn ngữ Nói bằng Python

Preparing Video For Download...