文字轉語音(TTS)

使用 OpenAI API 的多模態系統

James Chapman

Curriculum Manager, DataCamp

文字轉語音

 

  • 網路瀏覽器、行動 App、無障礙
  • 文字 → 擬真人聲
  • 提升無障礙

行動 App 上的文字轉語音。

使用 OpenAI API 的多模態系統

使用 OpenAI 的文字轉語音

  • Audio 端點 → .speech.create()
response = client.audio.speech.create(

model="gpt-4o-mini-tts",
voice="onyx",
input="Creating human-like speech is now possible with just a few lines of code. Pretty neat, right?"
)
response.stream_to_file("output.mp3")
  • response_format"mp3""opus""aac""flac""wav""pcm"
1 https://www.openai.fm/
使用 OpenAI API 的多模態系統

Onyx

「Onyx」語音化身為虛擬助理的圖像。

使用 OpenAI API 的多模態系統

OpenAI TTS

  • 針對 English 最佳化

「Onyx」語音化身為虛擬助理的圖像。

顯示音訊錄製與文字方塊的圖示。

使用 OpenAI API 的多模態系統

一起來練習吧!

使用 OpenAI API 的多模態系統

Preparing Video For Download...