层次聚类
-
层次聚类与K-Means:聚类分析算法的全面对比
层次聚类与K-Means:聚类分析算法的全面对比 上周三凌晨两点,我盯着屏幕上的轮廓系数,0.18。这是我第三次用K-Means跑用户分群,K值从5试到15,标准化做了两遍,结果依然像随机分堆。业务方第二天要方案,我说“再给我一小时”,然后切到层次聚类,同样的数据,树状图一出来,我立刻意识到问题在哪:我的数据根本不是凸球形分布,而是层层嵌套的消费层级结构。 这不是一个调参问题。这是一个选算法的问题…
-
聚类分析入门:从概念到核心算法全解析
接触过上百个真实业务场景后,我越发确信一件事:聚类分析从来都不是一个纯粹的技术问题,而是一道用算法翻译业务语言的阅读理解题。 半年前,一家连锁零售品牌的运营总监找到我,甩过来一张表:“我们有300万会员的消费数据,你把用户分成高价值、中等价值和低价值三类,我好做精准营销。”听起来很简单,对吧?随便跑个K-means,K=3,完事。 结果那天晚上,我的K-means模型吐出来的三个“用户群”把他给气…