Lendo arquivos de áudio com SpeechRecognition

Processamento de Linguagem Falada em Python

Daniel Bourke

Machine Learning Engineer/YouTube Creator

A classe AudioFile

import speech_recognition as sr

# Criar a instância do reconhecedor recognizer = sr.Recognizer()
# Ler o arquivo de áudio clean_support_call = sr.AudioFile("clean-support-call.wav")
# Verificar o tipo de clean_support_call type(clean_support_call)
<class 'speech_recognition.AudioFile'>
Processamento de Linguagem Falada em Python

De AudioFile para AudioData

recognizer.recognize_google(audio_data=clean_support_call)
AssertionError: ``audio_data`` must be audio data
# Converter de AudioFile para AudioData
with clean_support_call as source:

# Gravar o áudio clean_support_call_audio = recognizer.record(source)
# Verificar o tipo type(clean_support_call_audio)
<class 'speech_recognition.AudioData'>
Processamento de Linguagem Falada em Python

Transcrevendo nosso AudioData

# Transcrever a chamada de suporte limpa
recognizer.recognize_google(audio_data=clean_support_call_audio)
hello I'd like to get some help setting up my account please
Processamento de Linguagem Falada em Python

Duration e offset

  • duration e offset são None por padrão
# Manter duration e offset como padrão
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=None,
                                                 offset=None)
# Pegar os primeiros 2 segundos da chamada limpa
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=2.0)
hello I'd like to get
Processamento de Linguagem Falada em Python

Vamos praticar!

Processamento de Linguagem Falada em Python

Preparing Video For Download...