사운드 파형 바이트를 정수로 변환하기

Python으로 배우는 음성 언어 처리

Daniel Bourke

Machine Learning Engineer/YouTube Creator

바이트를 정수로 변환하기

  • 바이트는 직접 사용할 수 없음
  • numpy로 바이트를 정수로 변환
import numpy as np

# soundwave_gm을 바이트에서 정수로 변환 signal_gm = np.frombuffer(soundwave_gm, dtype='int16')
# 처음 10개 항목 보기 signal_gm[:10]
array([ -3,  -5,  -8,  -8,  -9, -13,  -8, -10,  -9, -11], dtype=int16)
Python으로 배우는 음성 언어 처리

프레임 레이트 찾기

  • 주파수(Hz) = 파형 배열 길이 / 오디오 파일 길이(초)
# 프레임 레이트 가져오기
framerate_gm = good_morning.getframerate()

# 프레임 레이트 표시 framerate_gm
48,000
  • 오디오 길이(초) = 파형 배열 길이 / 주파수(Hz)
Python으로 배우는 음성 언어 처리

사운드 파형 타임스탬프 찾기

# start와 stop 사이 균일 간격 값 반환
np.linspace(start=1, stop=10, num=10)
array([ 1.,  2.,  3.,  4.,  5.,  6.,  7.,  8.,  9., 10.])
# good morning 사운드 파형의 타임스탬프 구하기
time_gm = np.linspace(start=0, 
                      stop=len(soundwave_gm)/framerate_gm,
                      num=len(soundwave_gm))
Python으로 배우는 음성 언어 처리

사운드 파형 타임스탬프 찾기

# good morning 사운드 파형의 처음 10개 타임스탬프 보기
time_gm[:10]
array([0.00000000e+00, 2.08334167e-05, 4.16668333e-05, 6.25002500e-05,
       8.33336667e-05, 1.04167083e-04, 1.25000500e-04, 1.45833917e-04,
       1.66667333e-04, 1.87500750e-04])
Python으로 배우는 음성 언어 처리

연습해 봅시다!

Python으로 배우는 음성 언어 처리

Preparing Video For Download...