技术栈
聚类评估
xianghongtao0116
15 天前
大数据
·
无监督学习
·
近似算法
·
聚类评估
·
轮廓系数
·
pps 采样
聚类评估的二次壁垒之战:可扩展轮廓系数近似算法深度解读
这篇论文第一次为"轮廓系数"这个用了近 40 年、却始终被 Θ(n2)\Theta(n^2)Θ(n2) 复杂度锁死的经典聚类评估度量,给出了带有严格概率保证、且可突破二次壁垒的采样近似算法——不仅覆盖全局轮廓 s(C)s(\mathcal{C})s(C),还覆盖此前几乎无人敢碰的"逐元素局部轮廓 s(e)s(e)s(e) 的同时估计",并配套了常数轮、亚线性本地内存的分布式实现。
阿钱真强道
4 个月前
python
·
分类
·
聚类
·
监督学习
·
无监督学习
·
层次聚类
·
聚类评估
29 Python 聚类:什么是聚类?它和分类到底有什么区别?
在机器学习入门阶段,很多人最先接触的是分类。比如:这类任务有一个共同特点:数据是有标签的。 也就是说,我们事先知道每条数据属于哪一类,模型要做的是学习这些标签背后的规律,然后对新数据进行预测。
我是有底线的