Standardizace

Preprocessing pro Machine Learning v Pythonu

James Chapman

Curriculum Manager, DataCamp

Co je standardizace?

 

Standardizace: transformace spojitých dat tak, aby měla normální rozdělení

  • Modely scikit-learn předpokládají normálně rozdělená data
  • Nenormální trénovací data mohou vnést zkreslení
  • V tomto kurzu: logaritmická normalizace a škálování příznaků
  • Aplikuje se na spojitá numerická data
Preprocessing pro Machine Learning v Pythonu

Kdy standardizovat: lineární vzdálenosti

  • Model v lineárním prostoru

 

Příklady:

  • k-Nearest Neighbors (kNN)
  • Lineární regrese
  • K-Means Clustering

Příklad kNN.

Preprocessing pro Machine Learning v Pythonu

Kdy standardizovat: vysoký rozptyl

  • Model v lineárním prostoru

 

Příklady:

  • k-Nearest Neighbors (kNN)
  • Lineární regrese
  • K-Means Clustering

 

  • Příznaky datasetu mají vysoký rozptyl

Příklad kNN.

Preprocessing pro Machine Learning v Pythonu

Kdy standardizovat: různá měřítka

 

  • Příznaky jsou v různých měřítkách

 

Příklad:

  • Predikce cen nemovitostí pomocí počtu ložnic a poslední prodejní ceny

 

  • Předpoklady linearity
Preprocessing pro Machine Learning v Pythonu

Pojďme si procvičit!

Preprocessing pro Machine Learning v Pythonu

Preparing Video For Download...