Moyennes mobiles et totaux

Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Michel Semaan

Moving averages

Vue d’ensemble

  • Moyenne mobile (MM) : Moyenne des dernières n périodes
    • Exemple : La moyenne mobile sur 10 jours des unités vendues correspond à la moyenne des unités vendues au cours des 10 derniers jours
    • Utilisée pour indiquer la dynamique/les tendances
    • Également utile pour éliminer la saisonnalité
  • Total des mouvements : Somme des n dernières périodes
    • Exemple : Somme des médailles remportées lors des trois derniers Jeux Olympiques
    • Utilisé pour indiquer les performances ; si la somme diminue, les performances globales diminuent
Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Tableau source

Requête

SELECT
  Year, COUNT(*) AS Medals
FROM Summer_Medals
WHERE
  Country = 'USA'
  AND Medal = 'Gold'
  AND Year >= 1980
GROUP BY Year
ORDER BY Year ASC;

Résultat

| Year | Medals |
|------|--------|
| 1984 | 168    |
| 1988 | 77     |
| 1992 | 89     |
| 1996 | 160    |
| 2000 | 130    |
| 2004 | 116    |
| 2008 | 125    |
| 2012 | 147    |
Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Moyenne mobile

Requête

WITH US_Medals AS (...)

SELECT
  Year, Medals,
  AVG(Medals) OVER
    (ORDER BY Year ASC
     ROWS BETWEEN
     2 PRECEDING AND CURRENT ROW) AS Medals_MA
FROM US_Medals
ORDER BY Year ASC;

Résultat

| Year | Medals | Medals_MA |
|------|--------|-----------|
| 1984 | 168    | 168.00    |
| 1988 | 77     | 122.50    |
| 1992 | 89     | 111.33    |
| 1996 | 160    | 108.67    |
| 2000 | 130    | 126.33    |
| 2004 | 116    | 135.33    |
| 2008 | 125    | 123.67    |
| 2012 | 147    | 129.33    |
Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Total des mouvements

Requête

WITH US_Medals AS (...)

SELECT
  Year, Medals,
  SUM(Medals) OVER
    (ORDER BY Year ASC
     ROWS BETWEEN
     2 PRECEDING AND CURRENT ROW) AS Medals_MT
FROM US_Medals
ORDER BY Year ASC;

Résultat

| Year | Medals | Medals_MT |
|------|--------|-----------|
| 1984 | 168    | 168       |
| 1988 | 77     | 245       |
| 1992 | 89     | 334       |
| 1996 | 160    | 326       |
| 2000 | 130    | 379       |
| 2004 | 116    | 406       |
| 2008 | 125    | 371       |
| 2012 | 147    | 388       |
Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

ROWS vs RANGE

  • RANGE BETWEEN [START] AND [FINISH]
    • Fonctionne comme ROWS BETWEEN
    • RANGE traite les doublons dans la sous-clause ORDER BY de OVER comme une seule entité

Tableau

| Year | Medals | Rows_RT | Range_RT |
|------|--------|---------|----------|
| 1992 | 10     | 10      | 10       |
| 1996 | 50     | 60      | 110      |
| 2000 | 50     | 110     | 110      |
| 2004 | 60     | 170     | 230      |
| 2008 | 60     | 230     | 230      |
| 2012 | 70     | 300     | 300      |
  • ROWS BETWEEN est presque toujours utilisé à la place de RANGE BETWEEN
Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Passons à la pratique !

Statistiques récapitulatives et fonctions de fenêtrage PostgreSQL

Preparing Video For Download...