Processamento de Linguagem Falada em Python
Daniel Bourke
Machine Learning Engineer/YouTube Creator
import speech_recognition as sr# Criar a instância do reconhecedor recognizer = sr.Recognizer()# Ler o arquivo de áudio clean_support_call = sr.AudioFile("clean-support-call.wav")# Verificar o tipo de clean_support_call type(clean_support_call)
<class 'speech_recognition.AudioFile'>
recognizer.recognize_google(audio_data=clean_support_call)
AssertionError: ``audio_data`` must be audio data
# Converter de AudioFile para AudioData with clean_support_call as source:# Gravar o áudio clean_support_call_audio = recognizer.record(source)# Verificar o tipo type(clean_support_call_audio)
<class 'speech_recognition.AudioData'>
# Transcrever a chamada de suporte limpa
recognizer.recognize_google(audio_data=clean_support_call_audio)
hello I'd like to get some help setting up my account please
duration e offset são None por padrão# Manter duration e offset como padrão
with clean_support_call as source:
clean_support_call_audio = recognizer.record(source,
duration=None,
offset=None)
# Pegar os primeiros 2 segundos da chamada limpa
with clean_support_call as source:
clean_support_call_audio = recognizer.record(source,
duration=2.0)
hello I'd like to get
Processamento de Linguagem Falada em Python