Introduktion till k-means-klustring

Oövervakad inlärning i R

Hank Roark

Senior Data Scientist at Boeing

k-means-algoritmen

  • Första av två klustringsalgoritmer i kursen
  • Delar upp observationer i ett fördefinierat antal kluster

två grupper

Oövervakad inlärning i R

k-means i R

# k-means algorithm with 5 centers, run 20 times
kmeans(x, centers = 5, nstart = 20)
  • En observation per rad, ett särdrag per kolumn
  • k-means har en slumpmässig komponent
  • Kör algoritmen flera gånger för att öka chansen att hitta den bästa modellen
Oövervakad inlärning i R

Första övningarna

  • Första övningen använder syntetiska data
  • Syntetiska data genererade från 3 undergrupper
  • Välj optimalt antal undergrupper för k-means
  • Exempel med mer intressanta data senare i kapitlet
Oövervakad inlärning i R

Nu kör vi en övning!

Oövervakad inlärning i R

Preparing Video For Download...