텍스트-투-스피치(TTS)

OpenAI API로 만드는 멀티모달 시스템

James Chapman

Curriculum Manager, DataCamp

텍스트-투-스피치

 

  • 인터넷 브라우저, 모바일 앱, 접근성
  • 텍스트 → 현실적인 사람 목소리
  • 접근성 향상

모바일 앱에서의 텍스트-투-스피치.

OpenAI API로 만드는 멀티모달 시스템

OpenAI로 TTS 생성

  • Audio 엔드포인트 → .speech.create()
response = client.audio.speech.create(

model="gpt-4o-mini-tts",
voice="onyx",
input="Creating human-like speech is now possible with just a few lines of code. Pretty neat, right?"
)
response.stream_to_file("output.mp3")
  • response_format: "mp3", "opus", "aac", "flac", "wav", "pcm"
1 https://www.openai.fm/
OpenAI API로 만드는 멀티모달 시스템

Onyx

가상 비서로 묘사된 Onyx 음성.

OpenAI API로 만드는 멀티모달 시스템

OpenAI TTS

  • 영어에 최적화됨

가상 비서로 묘사된 Onyx 음성.

오디오 녹음과 텍스트 블록 아이콘.

OpenAI API로 만드는 멀티모달 시스템

연습해 봅시다!

OpenAI API로 만드는 멀티모달 시스템

Preparing Video For Download...