Python में Spoken Language Processing
Daniel Bourke
Machine Learning Engineer/YouTube Creator
ऑडियो फाइलों के अलग-अलग प्रकार
डिजिटल ध्वनि को फ्रीक्वेंसी (kHz) में मापा जाता है
ऑडियोबुक्स और बोली गई भाषा 8–16 kHz के बीच होती हैं
हम ऑडियो फाइलें देख नहीं सकते, इसलिए पहले उन्हें बदलना पड़ता है
import wave
good-morning.wav के रूप में सेव है# Import audio file as wave object
good_morning = wave.open("good-morning.wav", "r")
# Convert wave object to bytes
good_morning_soundwave = good_morning.readframes(-1)
# View the wav file in byte form
good_morning_soundwave
b'\xfd\xff\xfb\xff\xf8\xff\xf8\xff\xf7\...
Python में Spoken Language Processing