Обробка усного мовлення в Python
Daniel Bourke
Machine Learning Engineer/YouTube Creator
from pydub import AudioSegment # Імпортуйте аудіофайл wav_file = AudioSegment.from_file("wav_file.wav")# Збільште гучність на 10 децибелів louder_wav_file = wav_file + 10# Експортуйте гучніший аудіофайл louder_wav_file.export(out_f="louder_wav_file.wav", format="wav")
<_io.BufferedRandom name='louder_wav_file.wav'>
def make_wav(wrong_folder_path, right_folder_path):# Переберіть файли з неправильним форматом for file in os.scandir(wrong_folder_path):# Працюйте лише з аудіофайлами, які виправляємо if file.path.endswith(".mp3") or file.path.endswith(".flac"):# Створіть нову назву файлу .wav out_file = right_folder_path + os.path.splitext(os.path.basename(file.path))[0] + ".wav"# Прочитайте аудіо та експортуйте у форматі wav AudioSegment.from_file(file.path).export(out_file, format="wav")print(f"Creating {out_file}")
# Викличте нашу нову функцію
make_wav("data/wrong_formats/", "data/right_format/")
Creating data/right_types/wav_file.wav
Creating data/right_types/flac_file.wav
Creating data/right_types/mp3_file.wav
def make_no_static_louder(static_quiet, louder_no_static): # Переберіть файли зі статикою й тихі (вже у форматі wav) for file in os.scandir(static_quiet_folder_path):# Створіть шлях до нового файлу out_file = louder_no_static + os.path.splitext(os.path.basename(file.path))[0] + ".wav"# Прочитайте аудіофайл audio_file = AudioSegment.from_file(file.path)# Вилучіть перші три секунди, додайте 10 децибелів та експортуйте audio_file = (audio_file[3100:] + 10).export(out_file, format="wav") print(f"Creating {out_file}")
# Приберіть статику та підвищте гучність
make_no_static_louder("data/static_quiet/", "data/louder_no_static/")
Creating data/louder_no_static/speech-recognition-services.wav
Creating data/louder_no_static/order-issue.wav
Creating data/louder_no_static/help-with-acount.wav
Обробка усного мовлення в Python