Text-to-speech (TTS)

ระบบ Multi-Modal ด้วย OpenAI API

James Chapman

Curriculum Manager, DataCamp

Text-to-speech

 

  • เบราว์เซอร์, แอปมือถือ, การเข้าถึง
  • ข้อความ → เสียงพูดที่เหมือนมนุษย์
  • เพิ่มการเข้าถึง

Text-to-speech บนแอปมือถือ

ระบบ Multi-Modal ด้วย OpenAI API

Text-to-speech ด้วย OpenAI

  • Audio endpoint → .speech.create()
response = client.audio.speech.create(

model="gpt-4o-mini-tts",
voice="onyx",
input="Creating human-like speech is now possible with just a few lines of code. Pretty neat, right?"
)
response.stream_to_file("output.mp3")
  • response_format: "mp3", "opus", "aac", "flac", "wav", และ "pcm"
1 https://www.openai.fm/
ระบบ Multi-Modal ด้วย OpenAI API

Onyx

เสียง Onyx ในรูปแบบผู้ช่วยเสมือน

ระบบ Multi-Modal ด้วย OpenAI API

OpenAI TTS

  • ปรับให้เหมาะกับ ภาษาอังกฤษ

เสียง Onyx ในรูปแบบผู้ช่วยเสมือน

ไอคอนแสดงการบันทึกเสียงและบล็อกข้อความ

ระบบ Multi-Modal ด้วย OpenAI API

มาฝึกกันเถอะ!

ระบบ Multi-Modal ด้วย OpenAI API

Preparing Video For Download...