博客
关于我
【sklearn】KMeans 计算样本质心
阅读量:339 次
发布时间:2019-03-04

本文共 1268 字,大约阅读时间需要 4 分钟。

文章目录


KMeans质心介绍

一个簇中所有数据的均值μ(j),通常被称为这个簇的“质心(centroids)”,j表示第j个簇。在二维平面中,质心的坐标是该簇数据点坐标均值的合成。同理可推广至高维空间。

m一个簇中样本的个数,j每个样本的编号。这个公式被称为簇内平方和(cluster Sum of Square),又叫做 Inertia。将所有簇的簇内平方和相加得到Total InertiaTotal Inertia越小,数据聚类效果越好。

KMeans追求的是使Inertia最小化的质心。质心不断迭代更新时,Total Inertia逐渐减小。当Total Inertia达到最小值时,质心不再改变。这就将KMeans的求解过程转化为一个优化问题。


计算质心

质心的计算方法是对每个簇的数据点坐标分别求均值。例如,在二维平面中,质心的横坐标是该簇数据点横坐标的均值,纵坐标是纵坐标的均值。

def cal_Cmass(data):      '''输入:数据样本 ndarray      输出:质心坐标 ndarray      '''      return np.mean(data, axis=0)

例如,计算质心:

cmass = cal_Cmass([[8,8,8], [7,7,7], [9,9,9]])  # 返回值: [8. 8. 8.]

计算样本间距离

import numpy as np  def distance(x, y, p=2): '''输入:x(ndarray) - 第一个样本坐标 y(ndarray) - 第二个样本坐标 p(int):1为曼哈顿距离,2为欧氏距离 输出:距离 float ''' dis2 = np.sum(np.abs(x - y) ** p) dis = np.power(dis2, 1/p) return dis

计算两点间距离的方法如下:


计算每个样本到质心的距离并排序

def sorted_list(data, Cmass):      '''输入:data(ndarray) - 数据样本                 Cmass(ndarray) - 数据样本质心      输出:距离列表 sorted_list(list) - 排序后的样本到质心的距离      '''      dis_list = []      for i in range(len(data)):          dis_list.append(distance(Cmass, data[i][:]))      dis_list = sorted(dis_list)      return dis_list

例如,计算各样本到质心的距离并排序:

list = sorted_list([[8,8,8],[7,7,7],[9,9,9]], cmass)  # 返回值: [0.0, 1.7320508075688772, 1.7320508075688772]

转载地址:http://oueq.baihongyu.com/

你可能感兴趣的文章
Numpy.ndarray对象不可调用
查看>>
Numpy如何使用np.umprod重写range函数中i的python
查看>>
numpy数组索引-ChatGPT4o作答
查看>>
numpy转PIL 报错TypeError: Cannot handle this data type
查看>>
NUUO网络视频录像机 css_parser.php 任意文件读取漏洞复现
查看>>
oauth2-shiro 添加 redis 实现版本
查看>>
OAuth2.0_JWT令牌-生成令牌和校验令牌_Spring Security OAuth2.0认证授权---springcloud工作笔记148
查看>>
OAuth2.0_JWT令牌介绍_Spring Security OAuth2.0认证授权---springcloud工作笔记147
查看>>
OAuth2.0_介绍_Spring Security OAuth2.0认证授权---springcloud工作笔记137
查看>>
OAuth2.0_完善环境配置_把资源微服务客户端信息_授权码存入到数据库_Spring Security OAuth2.0认证授权---springcloud工作笔记149
查看>>
OAuth2.0_授权服务配置_Spring Security OAuth2.0认证授权---springcloud工作笔记140
查看>>
OAuth2.0_授权服务配置_令牌服务和令牌端点配置_Spring Security OAuth2.0认证授权---springcloud工作笔记143
查看>>
OAuth2.0_授权服务配置_客户端详情配置_Spring Security OAuth2.0认证授权---springcloud工作笔记142
查看>>
OAuth2.0_授权服务配置_密码模式及其他模式_Spring Security OAuth2.0认证授权---springcloud工作笔记145
查看>>
OAuth2.0_授权服务配置_资源服务测试_Spring Security OAuth2.0认证授权---springcloud工作笔记146
查看>>
OAuth2.0_环境介绍_授权服务和资源服务_Spring Security OAuth2.0认证授权---springcloud工作笔记138
查看>>
OAuth2.0_环境搭建_Spring Security OAuth2.0认证授权---springcloud工作笔记139
查看>>
oauth2.0协议介绍,核心概念和角色,工作流程,概念和用途
查看>>
OAuth2授权码模式详细流程(一)——站在OAuth2设计者的角度来理解code
查看>>
OAuth2:项目演示-模拟微信授权登录京东
查看>>