分类:根据文本的特征或属性,划分到已有的类别中。也就是说,这些类别是已知的,通过对已知分类的数据进行训练和学习,找到这些不同类的特征,再对未分类的数据进行分类。
聚类:不知道数据会分为几类,通过聚类分析将数据或者说用户聚合成几个群体。聚类不需要对数据进行训练和学习。
分类属于监督学习,聚类属于无监督学习。
常见的分类算法:决策树分类算法、贝叶斯分类算法等
常见的聚类算法:系统聚类,K-means均值聚类
链接:https://www.zhihu.com/question/42044303/answer/102223996
来源:知乎
著作权归作者所有。商业转载请联系作者获得授权,非商业转载请注明出处。