Interpretacja wyników i porównywanie modeli

Bayesowska analiza danych w Pythonie

Michal Oleszak

Machine Learning Engineer

Powrót do uruchamiania modelu

formula = "num_clicks ~ clothes_banners_shown + sneakers_banners_shown"

with pm.Model() as model_1:
    pm.GLM.from_formula(formula, data=ads_aggregated)
    trace_1 = pm.sample(draws=1000, tune=500)
Bayesowska analiza danych w Pythonie

Powrót do uruchamiania modelu

formula = "num_clicks ~ clothes_banners_shown + sneakers_banners_shown"

with pm.Model() as model_1:
    pm.GLM.from_formula(formula, data=ads_aggregated)
    trace_1 = pm.sample(draws=1000, tune=500, chains=4)
  • Liczba parametrów: 4
  • Liczba próbek dla każdego parametru: 1000 $\times$ 4 = 4000
Bayesowska analiza danych w Pythonie

Wykres śladu

pm.traceplot(trace_1)

Siatka ośmiu wykresów w dwóch kolumnach i czterech wierszach. Lewa kolumna zawiera cztery wykresy gęstości, a prawa — cztery wykresy liniowe, każdy dla jednego parametru modelu.

Bayesowska analiza danych w Pythonie

Wykres śladu: zbliżenie na jeden parametr

 

Dwa wykresy obok siebie: lewy to wykres gęstości, prawy — wykres liniowy próbek parametru.

Bayesowska analiza danych w Pythonie

Wykres leśny

pm.forestplot(trace_1)

Wykres przedstawiający rozkład próbek dla każdego parametru modelu w postaci poziomej.

Bayesowska analiza danych w Pythonie

Podsumowanie śladu

pm.summary(trace_1)
                         mean     sd  hdi_3%  hdi_97%  mcse_mean  mcse_sd  \
Intercept               1.307  0.886  -0.305    2.962      0.018    0.013   
clothes_banners_shown   0.103  0.031   0.043    0.160      0.001    0.000   
sneakers_banners_shown  0.104  0.032   0.045    0.163      0.001    0.001   
sd                      2.654  0.157   2.382    2.970      0.003    0.002   

                        ess_mean  ess_sd  ess_bulk  ess_tail  r_hat  
Intercept                 2346.0  2318.0    2351.0    2083.0    1.0  
clothes_banners_shown     2085.0  2085.0    2089.0    1868.0    1.0  
sneakers_banners_shown    2105.0  1953.0    2122.0    1869.0    1.0  
sd                        2615.0  2590.0    2646.0    1834.0    1.0
Bayesowska analiza danych w Pythonie

Dopasowanie kolejnego modelu

formula = "num_clicks ~ clothes_banners_shown + sneakers_banners_shown + weekend"

with pm.Model() as model_2:
    pm.GLM.from_formula(formula, data=ads_aggregated)
    trace_2 = pm.sample(draws=1000, tune=500)
Bayesowska analiza danych w Pythonie

Powszechnie Stosowane Kryterium Informacyjne (WAIC)

comparison = pm.compare({"trace_1": trace_1, "trace_2": trace_2}, 
                        ic="waic", scale="deviance")
print(comparison)
        rank     waic   p_waic    d_waic    weight       se      dse warning  \
trace_2    0   -362.8   5.1576         0  0.513792  9.37269        0    True   
trace_1    1 -362.926  4.13318  0.126236  0.486208  9.48352  1.50682    True   

        waic_scale  
trace_2        log  
trace_1        log
Bayesowska analiza danych w Pythonie

Wykres porównawczy

pm.compareplot(comparison)

Wykres wizualizujący wartości WAIC dla dwóch modeli.

Bayesowska analiza danych w Pythonie

Czas na porównywanie modeli!

Bayesowska analiza danych w Pythonie

Preparing Video For Download...