Python में Spoken Language Processing
Daniel Bourke
Machine Learning Engineer/YouTube Creator
$ pip install pydub
.wav के अलावा अन्य फाइलें उपयोग कर रहे हैं, तो ffmpeg.org{{2}} से ffmpeg इंस्टॉल करें# PyDub की मुख्य class इम्पोर्ट करें
from pydub import AudioSegment
# एक ऑडियो फाइल इम्पोर्ट करें
wav_file = AudioSegment.from_file(file="wav_file.wav", format="wav")
# केवल पठनीयता के लिए format पैरामीटर
wav_file = AudioSegment.from_file(file="wav_file.wav")
type(wav_file)
pydub.audio_segment.AudioSegment
# wav प्लेबैक के लिए simpleaudio इंस्टॉल करें
$pip install simpleaudio
# play फंक्शन इम्पोर्ट करें
from pydub.playback import play
# ऑडियो फाइल इम्पोर्ट करें
wav_file = AudioSegment.from_file(file="wav_file.wav")
# ऑडियो फाइल चलाएँ
play(wav_file)
# ऑडियो फाइलें इम्पोर्ट करें wav_file = AudioSegment.from_file(file="wav_file.wav") two_speakers = AudioSegment.from_file(file="two_speakers.wav")# चैनलों की संख्या जाँचें wav_file.channels, two_speakers.channels
1, 2
wav_file.frame_rate
480000
# प्रति सैंपल बाइट्स की संख्या जानें
wav_file.sample_width
2
# अधिकतम अम्प्लीट्यूड जानें
wav_file.max
8488
# ऑडियो फाइल की अवधि (मिलीसेकंड में)
len(wav_file)
3284
# AudioSegment का ATTRIBUTENAME x पर बदलें
changeed_audio_segment = audio_segment.set_ATTRIBUTENAME(x)
# sample width को 1 करें
wav_file_width_1 = wav_file.sample_width(1)
wav_file_width_1.sample_width
1
# sample rate बदलें
wav_file_16k = wav_file.frame_rate(16000)
wav_file_16k.frame_rate
16000
# चैनलों की संख्या बदलें
wav_file_1_channel = wav_file.set_channels(1)
wav_file_1_channel.channels
1
Python में Spoken Language Processing