Medie e totali mobili

Statistiche riepilogative e funzioni finestra in PostgreSQL

Michel Semaan

Moving averages

Panoramica

  • Media mobile (MA): media degli ultimi n periodi
    • Esempio: la MA a 10 giorni delle unità vendute è la media degli ultimi 10 giorni
    • Indica momentum/tendenze
    • Utile anche per eliminare la stagionalità
  • Totale mobile: somma degli ultimi n periodi
    • Esempio: somma delle medaglie delle ultime 3 Olimpiadi
    • Indica la performance; se la somma scende, cala la performance complessiva
Statistiche riepilogative e funzioni finestra in PostgreSQL

Tabella di origine

Query

SELECT
  Year, COUNT(*) AS Medals
FROM Summer_Medals
WHERE
  Country = 'USA'
  AND Medal = 'Gold'
  AND Year >= 1980
GROUP BY Year
ORDER BY Year ASC;

Risultato

| Year | Medals |
|------|--------|
| 1984 | 168    |
| 1988 | 77     |
| 1992 | 89     |
| 1996 | 160    |
| 2000 | 130    |
| 2004 | 116    |
| 2008 | 125    |
| 2012 | 147    |
Statistiche riepilogative e funzioni finestra in PostgreSQL

Media mobile

Query

WITH US_Medals AS (...)

SELECT
  Year, Medals,
  AVG(Medals) OVER
    (ORDER BY Year ASC
     ROWS BETWEEN
     2 PRECEDING AND CURRENT ROW) AS Medals_MA
FROM US_Medals
ORDER BY Year ASC;

Risultato

| Year | Medals | Medals_MA |
|------|--------|-----------|
| 1984 | 168    | 168.00    |
| 1988 | 77     | 122.50    |
| 1992 | 89     | 111.33    |
| 1996 | 160    | 108.67    |
| 2000 | 130    | 126.33    |
| 2004 | 116    | 135.33    |
| 2008 | 125    | 123.67    |
| 2012 | 147    | 129.33    |
Statistiche riepilogative e funzioni finestra in PostgreSQL

Totale mobile

Query

WITH US_Medals AS (...)

SELECT
  Year, Medals,
  SUM(Medals) OVER
    (ORDER BY Year ASC
     ROWS BETWEEN
     2 PRECEDING AND CURRENT ROW) AS Medals_MT
FROM US_Medals
ORDER BY Year ASC;

Risultato

| Year | Medals | Medals_MT |
|------|--------|-----------|
| 1984 | 168    | 168       |
| 1988 | 77     | 245       |
| 1992 | 89     | 334       |
| 1996 | 160    | 326       |
| 2000 | 130    | 379       |
| 2004 | 116    | 406       |
| 2008 | 125    | 371       |
| 2012 | 147    | 388       |
Statistiche riepilogative e funzioni finestra in PostgreSQL

ROWS vs RANGE

  • RANGE BETWEEN [START] AND [FINISH]
    • Funziona quasi come ROWS BETWEEN
    • RANGE tratta i duplicati nell'ORDER BY di OVER come un'unica entità

Tabella

| Year | Medals | Rows_RT | Range_RT |
|------|--------|---------|----------|
| 1992 | 10     | 10      | 10       |
| 1996 | 50     | 60      | 110      |
| 2000 | 50     | 110     | 110      |
| 2004 | 60     | 170     | 230      |
| 2008 | 60     | 230     | 230      |
| 2012 | 70     | 300     | 300      |
  • ROWS BETWEEN è quasi sempre preferito a RANGE BETWEEN
Statistiche riepilogative e funzioni finestra in PostgreSQL

Passiamo alla pratica !

Statistiche riepilogative e funzioni finestra in PostgreSQL

Preparing Video For Download...