Creating a speech response for customers

Sistemas multimodales con la API de OpenAI

James Chapman

Curriculum Manager, DataCamp

Case study plan

$$

$$

  • Response translation

$$

  • Converting text in audio

$$

Case study plan

Sistemas multimodales con la API de OpenAI

Variables to use

$$

Detected language
print(language)
uk

$$

Generated response
print(chatbot_reply)

Chatbot reply

Sistemas multimodales con la API de OpenAI

Response translation

response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": f"""Translate the following text 
        from English to country code {language}. Only return the translated text!"""},
        {"role": "user", "content": chatbot_reply}
             ],
    max_completion_tokens=500)
Sistemas multimodales con la API de OpenAI

Response translation

# Extract and print the translated response
translated_reply = response.choices[0].message.content
print(translated_reply)

Translated output

Sistemas multimodales con la API de OpenAI

Text-to-speech

response = client.audio.speech.create(
    model="gpt-4o-mini-tts",
    voice="onyx",
    input=translated_reply)

response.stream_to_file("audio_reply.mp3")

The Onyx voice depicted as a virtual assistant.

Sistemas multimodales con la API de OpenAI

Case study recap

Case study - full

Sistemas multimodales con la API de OpenAI

Next steps

Adding memory to  the chatbot

Sistemas multimodales con la API de OpenAI

Let's practice!

Sistemas multimodales con la API de OpenAI

Preparing Video For Download...