Överlevnadsanalys i Python
Shae Wang
Senior Data Scientist
En metod för statistisk inferens
Nollhypotes $H_0$: t.ex. att invånare i Kalifornien och Nevada har samma genomsnittsinkomst.
Alternativhypotes $H_1$: t.ex. att invånare i Kalifornien och Nevada har olika genomsnittsinkomst.
P-värde: hur sannolikt är det att data hade uppstått om nollhypotesen vore sann?

$H_0$: $S_A(t)=S_B(t)$
$H_1$: $S_A(t)\neq S_B(t)$
Flera överlevnadskurvor

from lifelines.statistics import logrank_testlogrank_test(durations_A, durations_B, event_observed_A, event_observed_B)
.print_summary().p_value.test_statisticPåverkar programmet när spädbarn börjar prata?
t.head(2)
id duration observed
0 1 12 0
1 4 6 1
c.head(2)
id duration observed
0 0 11 1
1 2 14 0
lrt = logrank_test(
durations_A = t['duration'],
durations_B = c['duration'],
event_observed_A = t['observed'],
event_observed_B = c['observed'])
lrt.print_summary()
<lifelines.StatisticalResult: logrank_test>
null_distribution = chi squared
degrees_of_freedom = 1
test_name = logrank_test
test_statistic p -log2(p)
0.09 0.77 0.38
lifelines måste data vara höger-censurerade (t.ex. individ 3)pairwise_logrank_test() eller multivariate_logrank_test()
Överlevnadsanalys i Python