Lire des fichiers audio avec SpeechRecognition

Traitement de la langue parlée en Python

Daniel Bourke

Machine Learning Engineer/YouTube Creator

La classe AudioFile

import speech_recognition as sr

# Configurer une instance de reconnaisseur recognizer = sr.Recognizer()
# Lire le fichier audio clean_support_call = sr.AudioFile("clean-support-call.wav")
# Vérifier le type de clean_support_call type(clean_support_call)
<class 'speech_recognition.AudioFile'>
Traitement de la langue parlée en Python

De AudioFile à AudioData

recognizer.recognize_google(audio_data=clean_support_call)
AssertionError: ``audio_data`` must be audio data
# Convertir de AudioFile à AudioData
with clean_support_call as source:

# Enregistrer l'audio clean_support_call_audio = recognizer.record(source)
# Vérifier le type type(clean_support_call_audio)
<class 'speech_recognition.AudioData'>
Traitement de la langue parlée en Python

Transcrire notre AudioData

# Transcrire l'appel d'assistance propre
recognizer.recognize_google(audio_data=clean_support_call_audio)
hello I'd like to get some help setting up my account please
Traitement de la langue parlée en Python

Duration et offset

  • duration et offset sont tous deux None par défaut
# Laisser duration et offset par défaut
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=None,
                                                 offset=None)
# Obtenir les 2 premières secondes de l'appel
with clean_support_call as source:
    clean_support_call_audio = recognizer.record(source,
                                                 duration=2.0)
hello I'd like to get
Traitement de la langue parlée en Python

Passons à la pratique !

Traitement de la langue parlée en Python

Preparing Video For Download...