统计思维案例研习
Justin Bois
Lecturer, Caltech
"探索性数据分析永远不可能讲完全部故事,但没有任何其他方法能作为基石、作为第一步。"
——John Tukey

np.mean(nuclear_incident_times)
87.140350877192986

数据的重采样数组
# 带放回地重采样 nuclear_incident_times
bs_sample = np.random.choice(
nuclear_incident_times,
replace=True,
size=len(inter_times)
)




"自助法重复统计":由一个自助样本计算得到的统计量
从数据集中抽取自助法重复统计的函数
# 从 nuclear_incident_times 抽取 10000 个均值重复统计
bs_reps = dcst.draw_bs_reps(
nuclear_incident_times, np.mean, size=10000
)

若我们反复测量,观测值中有 p% 会落在 p% 置信区间内
np.percentile(bs_reps, [2.5, 97.5])
array([ 73.31505848, 102.39181287])
统计思维案例研习