Python 的口語語言處理
Daniel Bourke
Machine Learning Engineer/YouTube Creator
常見音訊檔案種類
數位聲音以頻率(kHz)衡量
有聲書與口語多在 8–16 kHz 之間
音訊檔看不見,需先轉換後才能分析
import wave
good-morning.wav# 匯入音訊檔為 wave 物件
good_morning = wave.open("good-morning.wav", "r")
# 將 wave 物件轉為位元組
good_morning_soundwave = good_morning.readframes(-1)
# 以位元組形式檢視 wav 檔
good_morning_soundwave
b'\xfd\xff\xfb\xff\xf8\xff\xf8\xff\xf7\...
Python 的口語語言處理