Python में Spoken Language Processing
Daniel Bourke
Machine Learning Engineer/YouTube Creator
# एक recognizer क्लास बनाएँ recognizer = sr.Recognizer()# जापानी ऑडियो को recognize_google में पास करें text = recognizer.recognize_google(japanese_good_morning, language="en-US")# टेक्स्ट प्रिंट करें print(text)
Ohio gozaimasu
# एक recognizer क्लास बनाएँ recognizer = sr.Recognizer()# जापानी ऑडियो को recognize_google में पास करें text = recognizer.recognize_google(japanese_good_morning, language="ja")# टेक्स्ट प्रिंट करें print(text)
おはようございます
# तेंदुए की दहाड़ का ऑडियो फ़ाइल इम्पोर्ट करें leopard_roar = sr.AudioFile("leopard_roar.wav")# AudioFile को AudioData में बदलें with leopard_roar as source: leopard_roar_audio = recognizer.record(source)# AudioData को पहचानें recognizer.recognize_google(leopard_roar_audio)
UnknownValueError:
# तेंदुए की दहाड़ का ऑडियो फ़ाइल इम्पोर्ट करें leopard_roar = sr.AudioFile("leopard_roar.wav")# AudioFile को AudioData में बदलें with leopard_roar as source: leopard_roar_audio = recognizer.record(source)# show_all चालू करके AudioData को पहचानें recognizer.recognize_google(leopard_roar_audio, show_all=True)
[]
# show_all=True के साथ जापानी ऑडियो को पहचानना
text = recognizer.recognize_google(japanese_good_morning,
language="en-US",
show_all=True)
# टेक्स्ट प्रिंट करें
print(text)
{'alternative': [{'transcript': 'Ohio gozaimasu', 'confidence': 0.89041114},
{'transcript': 'all hail gozaimasu'},
{'transcript': 'ohayo gozaimasu'},
{'transcript': 'olho gozaimasu'},
{'transcript': 'all Hale gozaimasu'}],
'final': True}
# कई वक्ताओं वाला ऑडियो फ़ाइल इम्पोर्ट करें multiple_speakers = sr.AudioFile("multiple-speakers.wav")# AudioFile को AudioData में बदलें with multiple_speakers as source: multiple_speakers_audio = recognizer.record(source)# AudioData को पहचानें recognizer.recognize_google(multiple_speakers_audio)
one of the limitations of the speech recognition library is that it doesn't
recognise different speakers and voices it will just return it all as one block
of text
# ऑडियो फ़ाइलें अलग-अलग इम्पोर्ट करें speakers = [sr.AudioFile("s0.wav"), sr.AudioFile("s1.wav"), sr.AudioFile("s2.wav")]# प्रत्येक वक्ता को अलग-अलग ट्रांसक्राइब करें for i, speaker in enumerate(speakers): with speaker as source: speaker_audio = recognizer.record(source) print(f"Text from speaker {i}: {recognizer.recognize_google(speaker_audio)}")
Text from speaker 0: one of the limitations of the speech recognition library
Text from speaker 1: is that it doesn't recognise different speakers and voices
Text from speaker 2: it will just return it all as one block a text
# बैकग्राउंड शोर वाली ऑडियो फ़ाइल इम्पोर्ट करें noisy_support_call = sr.AudioFile(noisy_support_call.wav)with noisy_support_call as source: # परिवेश शोर के लिए समायोजित करें और रिकॉर्ड करें recognizer.adjust_for_ambient_noise(source, duration=0.5) noisy_support_call_audio = recognizer.record(source)# ऑडियो को पहचानें recognizer.recognize_google(noisy_support_call_audio)
hello ID like to get some help setting up my calories
Python में Spoken Language Processing