Python 中的聚类分析
Shaumik Daityari
Business Analyst
kmeans(obs, k_or_guess, iter, thresh, check_finite)
obs:标准化观测值k_or_guess:簇数iter:迭代次数(默认:20)thres:阈值(默认:1e-05)check_finite:是否检查观测值均为有限数(默认:True)返回两个对象:簇中心、总体畸变

vq(obs, code_book, check_finite=True)
obs:标准化观测值code_book:簇中心check_finite:是否检查观测值均为有限数(默认:True)返回两个对象:簇标签列表、各点畸变列表
kmeans 返回单个畸变值vq 返回畸变列表# Import kmeans and vq functions
from scipy.cluster.vq import kmeans, vq
# Generate cluster centers and labels
cluster_centers, _ = kmeans(df[['scaled_x', 'scaled_y']], 3)
df['cluster_labels'], _ = vq(df[['scaled_x', 'scaled_y']], cluster_centers)
# Plot clusters
sns.scatterplot(x='scaled_x', y='scaled_y', hue='cluster_labels', data=df)
plt.show()

Python 中的聚类分析