机器学习-Sklearn（第三版） - 拜师教育 - 师徒制教育平台|人工智能培训|大数据培训|JAVA培训|PYTHON培训|

一、概述

1、无监督学习：训练时只需要一个特征矩阵x，不需要标签y，例如PCA

2、聚类（无监督分类）VS 分类

1）在已经知晓的类别上，给未知的样本标上标签（分类）；在完全不知道标签的情况下，探索分布上的分类（聚类）

2）分类结果确定，聚类结果不确定

3、sklearn中的聚类算法（类和函数两种表现形式）输入数据可以是标准特征矩阵，也可以是相似性矩阵（行和列都是n_samples)，可以使用sklearn.metric.pairwise模块中函数获取相似性矩阵

4、簇中所有数据坐标均值为这个簇的质心坐标，簇k是一个超参数，kmeans追求的是能让簇内平方和inertia最小的质心（最优化问题，逻辑回归也是最优化问题）

5、KMeans算法时间复杂度为O（k*n*T),k为簇数，n为样本数，T为迭代次数，但这种算法很慢，但是最快的聚类算法，

有一些算法天生没有损失函数（衡量拟合效果）

RFM模型，漏斗分析，AARRR模型