Text-to-speech (TTS)

Sisteme multi-modale cu API-ul OpenAI

James Chapman

Curriculum Manager, DataCamp

Text-to-speech

 

  • Browsere, aplicații mobile, accesibilitate
  • Text → vorbire umană realistă
  • Îmbunătățirea accesibilității

Text-to-speech într-o aplicație mobilă.

Sisteme multi-modale cu API-ul OpenAI

Text-to-speech cu OpenAI

  • Endpoint Audio.speech.create()
response = client.audio.speech.create(

model="gpt-4o-mini-tts",
voice="onyx",
input="Creating human-like speech is now possible with just a few lines of code. Pretty neat, right?"
)
response.stream_to_file("output.mp3")
  • response_format: "mp3", "opus", "aac", "flac", "wav" și "pcm"
1 https://www.openai.fm/
Sisteme multi-modale cu API-ul OpenAI

Onyx

Vocea Onyx reprezentată ca asistent virtual.

Sisteme multi-modale cu API-ul OpenAI

TTS OpenAI

  • Optimizat pentru engleză

Vocea Onyx reprezentată ca asistent virtual.

Pictogramă cu o înregistrare audio și un bloc de text.

Sisteme multi-modale cu API-ul OpenAI

Să exersăm!

Sisteme multi-modale cu API-ul OpenAI

Preparing Video For Download...