金融机器学习方法:K-均值算法

目录

1.算法介绍

2.算法原理

3.python实现示例


1.算法介绍

K均值聚类算法是机器学习和数据分析中常用的无监督学习方法之一,主要用于数据的分类。它的目标是将数据划分为几个独特的、互不重叠的子集或"集群",以使得同一集群内的数据点彼此相似,而不同集群的数据点则尽可能不同。

2.算法原理

  1. 选择K个初始质心,这些质心可以是随机选取的数据点或其他方法得到的。
  2. 根据每个数据点到质心的距离,将其分配给最近的质心,形成K个集群。
  3. 重新计算每个集群的质心。
  4. 重复上述步骤,直到质心不再发生变化或达到一定的迭代次数

3.python实现示例

python 复制代码
import numpy as np
from sklearn.cluster import KMeans
import matplotlib.pyplot as plt

# 随机生成数据
np.random.seed(0)
points = np.vstack([
    np.random.normal(0, 0.5, size=(100, 2)),
    np.random.normal(1, 0.25, size=(100, 2)),
    np.random.normal(2, 0.6, size=(100, 2))
])

# 使用KMeans进行聚类
kmeans = KMeans(n_clusters=3)
kmeans.fit(points)
labels = kmeans.predict(points)
centroids = kmeans.cluster_centers_

# 可视化结果
plt.scatter(points[:, 0], points[:, 1], c=labels)
plt.scatter(centroids[:, 0], centroids[:, 1], color='red', marker='X')
plt.show()

结果图:


相关推荐
梦想三三13 小时前
Python从零实现AI Agent电商客服(Qwen/Ollama+SQLite源码解析)
人工智能·python·sqlite
鹿鹿学长13 小时前
国赛工业应用数学题:从31省规上工业数据到生产排程,四类高频赛题的破题打法
python·自动化
笨鸟先飞,勤能补拙13 小时前
密码学深度指南 — SecOps 工程师实战手册
人工智能·vscode·python·安全·github·密码学·visual studio
淼澄研学13 小时前
PyTorch核心实操:从张量计算到混合精度训练的5个关键步骤
人工智能·pytorch·python
梦想三三13 小时前
Qwen Function Calling实战:重构电商客服AI Agent
人工智能·python·langchain·大模型·rag
05664613 小时前
agent学习Day23——文件上传与 Embedding 语义检索
python·学习·embedding
leisoo809713 小时前
筹码分布数据分析实战:用Python构建主力建仓成本分析系统
python·数据挖掘·数据分析
淼澄研学13 小时前
PyTorch 2.0 核心机制解析与5个实操方法
人工智能·pytorch·python
rogabet-note14 小时前
cef3和tkinter网页浏览器
python
半兽先生14 小时前
MinerU + LibreOffice 混合架构:搞定 .doc/.ppt 旧格式文档解析与切片
人工智能·python·机器学习·ai·架构