k均值算法 聚类算法 k-means

首先我们导入科学计算的库

python 复制代码
import numpy as np
import matplotlib.pyplot as plt

直接我们生成一组数据,为了保证每次的数据是一致的,我们设置一个随机种子。

python 复制代码
np.random.seed(0)
X=np.random.rand(100,2)
print(X)

结果

然后我们就要开始写K-means算法

写一个模块函数

python 复制代码
def k_means(X,K,max_iters=100):
    #随机选择k个初始中心
    centroids=X[np.random.choice(X.shape[0],K,replace=False)]
#X.shape[0]告诉np.random.choice函数需要从0到数据点总数之间随机选择索引。
#K是指选择几个 replace指选择不重复的 然后用np.random.choice函数来从X里面选择几个不重复的
    
    for _ in range(max_iters):
    #1.分配每个数据点到最近的中心
        distances=np.linalg.norm(X[:,np.newaxis]-centroids,axis=2)#计算距离
        labels=np.argmin(distances,axis=1)#分配标签
                #2.更新中心
        new_centroids=np.array([X[labels==k].mean(axis=0) for k in range(K)])


        #如果中心不再变化,则停止
        if np.all(centroids==new_centroids):
            break
        centroids=new_centroids
    return labels,centroids
        
python 复制代码
K=3 #簇的数量
labels,centroids=k_means(X,K)

设置一下簇的数量,k-means算法每次都要设置k值

然后把最后的中心点和分类后的数据用matplotlib画出来

python 复制代码
plt.scatter(X[:,0],X[:,1],c=labels,cmap='viridis',marker='o')#绘制数据点
plt.scatter(centroids[:,0],centroids[:,1],c='red',marker='x',s=200)#绘制中心点
plt.title('k-means Clustering')
plt.xlabel('Feature 1')
plt.ylabel('Feature 2')
plt.show()
相关推荐
飞Link几秒前
零基础:离散数据积分与 Python 实现保姆级教程
python·算法
淡海水16 分钟前
11-03-Unity-List-T-和Dictionary-TKey-TValue-的性能调优实战
算法·unity·c#·list·dictionary
土司大王20 分钟前
LeetCode hot100——394.字符串解码:Java 双栈模拟
java·算法·leetcode
a1879272183127 分钟前
【算法】双指针与滑动窗口(三):相向双指针——比较、排除、收缩
算法·leetcode·双指针·滑动窗口·原理·相向双指针·算法讲解
AI 小老六1 小时前
Agent 记忆系统难在取舍
人工智能·算法·架构·agent·memory·harness
大熊背1 小时前
《Color constancy by characterization of illumination chromaticity》之色度色域最大化算法(一)
数码相机·算法·白平衡·色度色域
不会就选b1 小时前
算法日常・每日刷题--<贪心>13
算法
带多刺的玫瑰1 小时前
Leecode#35刷题之搜索插入位置
java·python·算法
我不会起名字3221 小时前
万字总结Golang入门项目
数据结构·经验分享·算法·golang·项目实战·复盘
6Hzlia1 小时前
【Classic 150 刷题计划】 LeetCode 14. 最长公共前缀 | C++ 纵向扫描法与防越界细节
c++·算法·leetcode