R로 배우는 트리 기반 Machine Learning
Sandro Raabe
Data Scientist
$\Rightarrow$ 예측이 실제와 얼마나 떨어졌는지 측정

MAE = 빨간 막대의 평균 길이
$$MAE = \frac{1}{n} \sum_{i=1}^n\left| actual_i - predicted_i \right|$$
$$\quad MSE = \quad \frac{1}{n} \sum_{i=1}^n\left( actual_i - predicted_i \right)^2$$
$$MAE = \frac{1}{n} \sum_{i=1}^n\left| actual_i - predicted_i \right|$$
$$RMSE = \sqrt{\frac{1}{n} \sum_{i=1}^n\left( actual - predicted \right)^2}$$
# parsnip과 yardstick은 tidymodels에 포함됩니다
library(tidymodels)
# 예측을 생성하여 테스트 데이터에 추가 predictions <- predict(model, new_data = chocolate_test) %>%bind_cols(chocolate_test)
# A tibble: 358 x 7
.pred final_grade review_date cocoa_percent company_location
<dbl> <dbl> <int> <dbl> <fct>
1 2.5 2.75 2013 0.7 France
2 3.64 3.25 2014 0.8 France
3 3.3 3.5 2012 0.7 France
4 3.25 3.5 2011 0.72 Fiji
# ... with 354 more rows, and 2 more variables: bean_type <fct>, broad_bean_origin <fct>
# mae()로 평가 mae(predictions,estimate = .pred,truth = final_grade)
# A tibble: 1 x 2
.metric .estimate
<chr> <dbl>
1 mae 0.363
# rmse()로 평가
rmse(predictions,
estimate = .pred,
truth = final_grade)
# A tibble: 1 x 2
.metric .estimate
<chr> <dbl>
1 rmse 0.457
R로 배우는 트리 기반 Machine Learning