Teks ke ucapan (TTS)

Sistem Multi-Modal dengan OpenAI API

James Chapman

Curriculum Manager, DataCamp

Teks ke ucapan

 

  • Peramban, aplikasi seluler, aksesibilitas
  • Teks → ucapan manusia realistis
  • Meningkatkan aksesibilitas

Teks ke ucapan di aplikasi seluler.

Sistem Multi-Modal dengan OpenAI API

Teks ke ucapan dengan OpenAI

  • Endpoint Audio.speech.create()
response = client.audio.speech.create(

model="gpt-4o-mini-tts",
voice="onyx",
input="Creating human-like speech is now possible with just a few lines of code. Pretty neat, right?"
)
response.stream_to_file("output.mp3")
  • response_format: "mp3", "opus", "aac", "flac", "wav", dan "pcm"
1 https://www.openai.fm/
Sistem Multi-Modal dengan OpenAI API

Onyx

Suara Onyx digambarkan sebagai asisten virtual.

Sistem Multi-Modal dengan OpenAI API

OpenAI TTS

  • Dioptimalkan untuk bahasa Inggris

Suara Onyx digambarkan sebagai asisten virtual.

Ikon yang menampilkan rekaman audio dan blok teks.

Sistem Multi-Modal dengan OpenAI API

Ayo berlatih!

Sistem Multi-Modal dengan OpenAI API

Preparing Video For Download...