Spoken Language Processing ด้วย Python
Daniel Bourke
Machine Learning Engineer/YouTube Creator
ไฟล์เสียงมีหลายประเภท
เสียงดิจิทัลวัดด้วยความถี่ (kHz)
หนังสือเสียงและภาษาพูดอยู่ที่ 8–16 kHz
ไม่สามารถมองเห็นไฟล์เสียงได้โดยตรง จึงต้องแปลงข้อมูลก่อน
import wave
good-morning.wav# Import audio file as wave object
good_morning = wave.open("good-morning.wav", "r")
# Convert wave object to bytes
good_morning_soundwave = good_morning.readframes(-1)
# View the wav file in byte form
good_morning_soundwave
b'\xfd\xff\xfb\xff\xf8\xff\xf8\xff\xf7\...
Spoken Language Processing ด้วย Python