Introduction aux données audio en Python

Traitement de la langue parlée en Python

Daniel Bourke

Machine Learning Engineer/YouTube Creator

Gérer des fichiers audio en Python

  • Différents types de fichiers audio

    • mp3
    • wav
    • m4a
    • flac
  • Les sons numériques sont mesurés en fréquence (kHz)

    • 1 kHz = 1 000 unités d'information par seconde
Traitement de la langue parlée en Python

Exemples de fréquences

  • Les pistes en flux ont une fréquence de 32 kHz
  • Les livres audio et la parole se situent entre 8 et 16 kHz

  • On ne peut pas « voir » l'audio ; il faut d'abord le transformer

import wave
Traitement de la langue parlée en Python

Ouvrir un fichier audio en Python

  • Fichier audio enregistré comme good-morning.wav
    # Importer le fichier audio comme objet wave
    good_morning = wave.open("good-morning.wav", "r")
    
# Convertir l'objet wave en octets
good_morning_soundwave = good_morning.readframes(-1)
# Afficher le fichier wav sous forme d'octets
good_morning_soundwave
b'\xfd\xff\xfb\xff\xf8\xff\xf8\xff\xf7\...
Traitement de la langue parlée en Python

Travailler l'audio, c'est différent

  • Il faut convertir l'audio en données utiles
  • Un petit échantillon audio = beaucoup d'information
Traitement de la langue parlée en Python

Passons à la pratique !

Traitement de la langue parlée en Python

Preparing Video For Download...