数据挖掘中的分类技术-CDA数据分析师官网

数据挖掘中的分类技术

2018-02-27

数据挖掘中的分类技术

KNN（K最近邻算法）

算法核心：如果一个样本在特征空间中K个最相似的样本中的大多数属于一个类别，则该样本也属于这个类别，并具有这个类别的特征

在确定分类时只依靠最邻近的一个或几个样本的类别来决定待分样本所属类别，在做决策时只与极少数的相邻样本有关

由于KNN方法主要依靠周围有限的临近样本，而不是依靠判别类域的方法来确定样本所属类别。对于类域交叉或重叠较多的待分样本集来说，KNN方法较其他方法更合适

决策树

决策树要解决的问题是用哪些属性充当这棵树的各个节点的问题，决策树按分裂标准不同可以分为基于信息论的方法和基于最小GINI指标方法

神经网络

神经网络的学习是一个过程，并按照一定的规则（学习算法）调整各层的权值矩阵，待网络各层权值都收敛到一定值，学习过程结束

支持向量机（SVM）

尽量把样本中从更高维度看起来在一起的样本合在一起

支持向量机的目的是找到一个最优超平面，使分类间隔最大。最优超平面就是要求分类面不但能将两类正确分开，而且使分类间隔最大

在两类样本中离分类面最近且位于平行于最优超平面上的点就是支持向量，为找到最优超平面，只要找到所有的支持向量即可

对于非线形支持向量机，通常做法为把线形不可分转换成线形可分，通过一个非线形映射将低维输入空间中的数据特征映射到高维。

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试详情；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试详情；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

KNN 决策树支持向量机特征神经网络特征空间 SVM 数据挖掘

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇R描述性统计分析

下一篇建立数据感性认识

数据挖掘中的分类技术

CDA考试动态

CDA报考指南

热门栏目

最新资讯

【CDA干货】互联网运营必看：私域用户质量数据分析 ...

【CDA持证人案例分享】用 Excel 精准监控电商及推广 ...

【CDA持证人干货分享】13年国企财务：如何借助DeepS ...

【CDA持证人案例分享】Excel动态报表设计：基于业务 ...

【CDA干货】字节大佬：如何通过动态分级快速提升转 ...

Windows 系统和 MacOS 系统下的 Anaconda 安装教程 ...

数据运营的工作内容、技能要求及发展前景 ...

【干货】字节大佬：教培行业销售运营全景作战地图【 ...

四大一线城市约50%人口租房，数据分析能挖出哪些 “ ...

Python 实战案例 —RFM 客户价值分析模型 ...

【案例】奥利奥坚果新品与蒙牛“数字牧场”的成功经 ...

美关税政策下的全球金融市场动荡：深度数据分析与洞 ...

【重磅】苹果捐赠3000万给浙大这专业，透露未来就业 ...

非专业，怎么才能证明自己的数据分析能力？ ...

保姆级教程！一文读懂数据分析师的职业发展路径 ...

【干货】用DeepSeek三步骤搞定Excel数据清洗，效率 ...

被统计公式劝退？这门极简课程让你14天学会用Python ...

【干货】如何用RFM模型精准识别高价值客户？ ...

CDA数据分析师就业班3月29日开班，仅剩1个名额 ...

【案例】网飞Netflix流量漏斗分析案例 ...