विभिन्न प्रकार के ऑडियो से निपटना

Python में Spoken Language Processing

Daniel Bourke

Machine Learning Engineer/YouTube Creator

कौन-सी भाषा?

# एक recognizer क्लास बनाएँ
recognizer = sr.Recognizer()

# जापानी ऑडियो को recognize_google में पास करें text = recognizer.recognize_google(japanese_good_morning, language="en-US")
# टेक्स्ट प्रिंट करें print(text)
Ohio gozaimasu
Python में Spoken Language Processing

कौन-सी भाषा?

# एक recognizer क्लास बनाएँ
recognizer = sr.Recognizer()

# जापानी ऑडियो को recognize_google में पास करें text = recognizer.recognize_google(japanese_good_morning, language="ja")
# टेक्स्ट प्रिंट करें print(text)
おはようございます
Python में Spoken Language Processing

गैर-वाक् ऑडियो

# तेंदुए की दहाड़ का ऑडियो फ़ाइल इम्पोर्ट करें
leopard_roar = sr.AudioFile("leopard_roar.wav")

# AudioFile को AudioData में बदलें with leopard_roar as source: leopard_roar_audio = recognizer.record(source)
# AudioData को पहचानें recognizer.recognize_google(leopard_roar_audio)
UnknownValueError:
Python में Spoken Language Processing

गैर-वाक् ऑडियो

# तेंदुए की दहाड़ का ऑडियो फ़ाइल इम्पोर्ट करें
leopard_roar = sr.AudioFile("leopard_roar.wav")

# AudioFile को AudioData में बदलें with leopard_roar as source: leopard_roar_audio = recognizer.record(source)
# show_all चालू करके AudioData को पहचानें recognizer.recognize_google(leopard_roar_audio, show_all=True)
[]
Python में Spoken Language Processing

सभी दिखाना

# show_all=True के साथ जापानी ऑडियो को पहचानना
text = recognizer.recognize_google(japanese_good_morning, 
                                   language="en-US",
                                   show_all=True)
# टेक्स्ट प्रिंट करें
print(text)
{'alternative': [{'transcript': 'Ohio gozaimasu', 'confidence': 0.89041114},
  {'transcript': 'all hail gozaimasu'},
  {'transcript': 'ohayo gozaimasu'},
  {'transcript': 'olho gozaimasu'},
  {'transcript': 'all Hale gozaimasu'}],
 'final': True}
Python में Spoken Language Processing

एकाधिक वक्ता

# कई वक्ताओं वाला ऑडियो फ़ाइल इम्पोर्ट करें
multiple_speakers = sr.AudioFile("multiple-speakers.wav")

# AudioFile को AudioData में बदलें with multiple_speakers as source: multiple_speakers_audio = recognizer.record(source)
# AudioData को पहचानें recognizer.recognize_google(multiple_speakers_audio)
one of the limitations of the speech recognition library is that it doesn't
recognise different speakers and voices it will just return it all as one block 
of text
Python में Spoken Language Processing

एकाधिक वक्ता

# ऑडियो फ़ाइलें अलग-अलग इम्पोर्ट करें
speakers = [sr.AudioFile("s0.wav"), sr.AudioFile("s1.wav"), sr.AudioFile("s2.wav")]

# प्रत्येक वक्ता को अलग-अलग ट्रांसक्राइब करें for i, speaker in enumerate(speakers): with speaker as source: speaker_audio = recognizer.record(source) print(f"Text from speaker {i}: {recognizer.recognize_google(speaker_audio)}")
Text from speaker 0: one of the limitations of the speech recognition library
Text from speaker 1: is that it doesn't recognise different speakers and voices
Text from speaker 2: it will just return it all as one block a text
Python में Spoken Language Processing

शोरयुक्त ऑडियो

  • अगर आपको सुनने में कठिनाई है, तो APIs को भी होगी
# बैकग्राउंड शोर वाली ऑडियो फ़ाइल इम्पोर्ट करें
noisy_support_call = sr.AudioFile(noisy_support_call.wav)

with noisy_support_call as source: # परिवेश शोर के लिए समायोजित करें और रिकॉर्ड करें recognizer.adjust_for_ambient_noise(source, duration=0.5) noisy_support_call_audio = recognizer.record(source)
# ऑडियो को पहचानें recognizer.recognize_google(noisy_support_call_audio)
hello ID like to get some help setting up my calories
Python में Spoken Language Processing

अभ्यास करते हैं!

Python में Spoken Language Processing

Preparing Video For Download...