Créer une réponse vocale pour les clientes et clients

Systèmes multimodaux avec l'API d'OpenAI

James Chapman

Curriculum Manager, DataCamp

Plan de l'étude de cas

$$

$$

  • Traduction de la réponse

$$

  • Conversion du texte en audio

$$

Plan de l'étude de cas

Systèmes multimodaux avec l'API d'OpenAI

Variables à utiliser

$$

Langue détectée
print(language)
uk

$$

Réponse générée
print(chatbot_reply)

Réponse du clavardeur

Systèmes multimodaux avec l'API d'OpenAI

Traduction de la réponse

response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": f"""Translate the following text 
        from English to country code {language}. Only return the translated text!"""},
        {"role": "user", "content": chatbot_reply}
             ],
    max_completion_tokens=500)
Systèmes multimodaux avec l'API d'OpenAI

Traduction de la réponse

# Extract and print the translated response
translated_reply = response.choices[0].message.content
print(translated_reply)

Résultat traduit

Systèmes multimodaux avec l'API d'OpenAI

Synthèse vocale

response = client.audio.speech.create(
    model="gpt-4o-mini-tts",
    voice="onyx",
    input=translated_reply)

response.stream_to_file("audio_reply.mp3")

La voix Onyx représentée comme une assistante virtuelle.

Systèmes multimodaux avec l'API d'OpenAI

Récapitulatif de l'étude de cas

Étude de cas – récapitulatif

Systèmes multimodaux avec l'API d'OpenAI

Prochaines étapes

Ajouter de la mémoire au clavardeur

Systèmes multimodaux avec l'API d'OpenAI

Passons à la pratique !

Systèmes multimodaux avec l'API d'OpenAI

Preparing Video For Download...