Python में ऑडियो डेटा परिचय

Python में Spoken Language Processing

Daniel Bourke

Machine Learning Engineer/YouTube Creator

Python में ऑडियो फाइलों से निपटना

  • ऑडियो फाइलों के अलग-अलग प्रकार

    • mp3
    • wav
    • m4a
    • flac
  • डिजिटल ध्वनि को फ्रीक्वेंसी (kHz) में मापा जाता है

    • 1 kHz = प्रति सेकंड 1000 सूचनाएँ
Python में Spoken Language Processing

फ्रीक्वेंसी के उदाहरण

  • स्ट्रीमिंग गानों की फ्रीक्वेंसी 32 kHz होती है
  • ऑडियोबुक्स और बोली गई भाषा 8–16 kHz के बीच होती हैं

  • हम ऑडियो फाइलें देख नहीं सकते, इसलिए पहले उन्हें बदलना पड़ता है

import wave
Python में Spoken Language Processing

Python में ऑडियो फाइल खोलना

  • ऑडियो फाइल good-morning.wav के रूप में सेव है
    # Import audio file as wave object
    good_morning = wave.open("good-morning.wav", "r")
    
# Convert wave object to bytes
good_morning_soundwave = good_morning.readframes(-1)
# View the wav file in byte form
good_morning_soundwave
b'\xfd\xff\xfb\xff\xf8\xff\xf8\xff\xf7\...
Python में Spoken Language Processing

ऑडियो के साथ काम अलग होता है

  • ऑडियो को उपयोगी रूप में बदलना ज़रूरी है
  • छोटे से सैंपल में भी बहुत जानकारी होती है
Python में Spoken Language Processing

अभ्यास करते हैं!

Python में Spoken Language Processing

Preparing Video For Download...