Traitement de la langue parlée en Python
Daniel Bourke
Machine Learning Engineer/YouTube Creator
# Importer un fichier audio
wav_file = AudioSegment.from_file("wav_file.wav")
# Moins 60 dB
quiet_wav_file = wav_file - 60
# Tenter de reconnaître l'audio faible
recognizer.recognize_google(quiet_wav_file)
UnknownValueError:
# Augmenter le volume de 10 dB
louder_wav_file = wav_file + 10
# Tenter la reconnaissance
recognizer.recognize_google(louder_wav_file)
this is a wav file
# Importer AudioSegment et normaliser
from pydub import AudioSegment
from pydub.effects import normalize
from pydub.playback import play
# Importer un fichier audio avec niveaux inégaux
loud_quiet = AudioSegment.from_file("loud_quiet.wav")
# Normaliser les niveaux sonores
normalized_loud_quiet = normalize(loud_quiet)
# Vérifier le son
play(normalized_loud_quiet)
# Importer un audio avec grésillement au début
static_at_start = AudioSegment.from_file("static_at_start.wav")
# Retirer le grésillement par découpage
no_static_at_start = static_at_start[5000:]
# Vérifier le nouveau son
play(no_static_at_start)
# Importer deux fichiers audio
wav_file_1 = AudioSegment.from_file("wav_file_1.wav")
wav_file_2 = AudioSegment.from_file("wav_file_2.wav")
# Combiner les deux fichiers audio
wav_file_3 = wav_file_1 + wav_file_2
# Vérifier le son
play(wav_file_3)
# Combiner deux fichiers wav et augmenter le volume du mix
louder_wav_file_3 = wav_file_1 + wav_file_2 + 10
# Importer l'audio d'un appel
phone_call = AudioSegment.from_file("phone_call.wav")
# Obtenir le nombre de canaux
phone_call.channels
2
# Scinder stéréo en mono
phone_call_channels = phone_call.split_to_mono()
phone_call_channels
[<pydub.audio_segment.AudioSegment, <pydub.audio_segment.AudioSegment>]
# Obtenir le nombre de canaux du premier élément
phone_call_channels[0].channels
1
# Reconnaître le premier canal
recognizer.recognize_google(phone_call_channel_1)
the pydub library is really useful
Traitement de la langue parlée en Python