其他樹的選項與混淆矩陣的建立

R 的信用風險建模

Lore Dirick

Manager of Data Science Curriculum at Flatiron School

`rpart()` 其他常用引數

  • rpart()
    • weights:加入個案權重
  • rpart() 的控制引數(rpart.control)中
    • minsplit:嘗試分裂所需的最少觀測數
    • minbucket:葉節點的最少觀測數
R 的信用風險建模
pred_undersample_class = predict(ptree_undersample, newdata = test_set, type ="class")
1     2     3    ...   29073 29079 29084 29090 29091
0     0     0    ...     1     0     0     0     0

pred_undersample = predict(ptree_undersample, newdata = test_set)
          0         1
1     0.7382920 0.2617080
2     0.5665138 0.4334862
3     0.5992366 0.4007634
          ...          ... 
29084 0.7382920 0.2617080
29090 0.7382920 0.2617080
29091 0.7382920 0.2617080
R 的信用風險建模

建立混淆矩陣

table(test_set$loan_status, pred_undersample_class)
pred_undersample_class
       0    1
  0 8314  346
  1  964   73
R 的信用風險建模

一起來練習吧!

R 的信用風險建模

Preparing Video For Download...