Introduction à l’analyse exploratoire des données

Réflexion statistique en Python (Partie 1)

Justin Bois

Teaching Professor at the California Institute of Technology

Analyse exploratoire des données

  • Processus d’organisation, de visualisation et de synthèse d’un jeu de données
Réflexion statistique en Python (Partie 1)

 

« L’analyse exploratoire ne peut pas tout expliquer, mais rien d’autre ne peut en être la pierre angulaire. » — John Tukey

Réflexion statistique en Python (Partie 1)

Résultats des États pivots américains en 2008

ch1-1.006.png

1 Données récupérées sur Data.gov (https://www.data.gov/)
Réflexion statistique en Python (Partie 1)

Résultats des États pivots américains en 2008

import pandas as pd
df_swing = pd.read_csv('2008_swing_states.csv')
df_swing[['state', 'county', 'dem_share']]
    state              county  dem_share
0      PA         Erie County      60.08
1      PA     Bradford County      40.64
2      PA        Tioga County      36.07
3      PA       McKean County      41.21
4      PA       Potter County      31.04
5      PA        Wayne County      43.78
6      PA  Susquehanna County      44.08
7      PA       Warren County      46.85
8      OH    Ashtabula County      56.94
1 Données récupérées sur Data.gov (https://www.data.gov/)
Réflexion statistique en Python (Partie 1)

Résultats des États pivots américains en 2008

ch1-1.009.png

1 Données récupérées sur Data.gov (https://www.data.gov/)
Réflexion statistique en Python (Partie 1)

Passons à la pratique !

Réflexion statistique en Python (Partie 1)

Preparing Video For Download...