K近邻的距离度量表示法 我们看到,K近邻算法的核心在于找到实例点的邻居,这个时候,问题就接踵而至了,如何找到邻居,邻居的判定标准是什么,用什么来度量。这一系列问题便是下面要讲的距离度量表示 ...
2014-11-29什么是K近邻算法_数据分析师 何谓K近邻算法,即K-Nearest Neighbor algorithm,简称KNN算法,单从名字来猜想,可以简单粗暴的认为是:K个最近的邻居,当K=1时,算法便成了最近邻算法,即寻找最近的那个邻居 ...
2014-11-29数据挖掘中所需的概率论Landon的推导(九)_数据分析师 Landon的推导(1941) 第三条道是一位电气工程师,Vernon D. Landon 给出的。1941年,Landon 研究通信电路中的噪声电压,通过分析经验数据他发 ...
2014-11-29数据挖掘中所需的概率论与数理统计知识(十) 正态分布和最大熵 还有一条小径是基于最大熵原理的,物理学家E.T.Jaynes在最大熵原理上有非常重要的贡献,他在《概率论沉思录》里面对这个方法有描述和 ...
2014-11-29数据挖掘中所需的概率论(八)Herschel(1850)和麦克斯韦(1860)的推导 Herschel(1850)和麦克斯韦(1860)的推导 第二条小径是天文学家John Hershcel和物理学家麦克斯韦(Maxwell)发现的。1850年,天文 ...
2014-11-29数据挖掘中所需的概率论 高斯的推导(七)数据分析师 论道正态,正态分布的4大数学推导 如本blog内之前所说:凡是涉及到要证明的东西.理论,便一般不是怎么好惹的东西。绝大部分时候,看懂一个东西不难, ...
2014-11-29数据挖掘中所需的概率论与数理统计知识(六 ) 高斯导出误差正态分布 事实上,棣莫弗早在1730年~1733年间便已从二项分布逼近的途径得到了正态密度函数的形式,到了1780年后,拉普拉斯也推出了中心极 ...
2014-11-29数据挖掘中所需的概率论与数理统计知识(五) 拉普拉斯的工作 在1772-1774年间,拉普拉斯也加入到了寻找误差分布函数的队伍中。与辛普森不同,拉普拉斯不是先假定一种误差分后去设法证明平均值的优良性 ...
2014-11-29大数据流程处理“三要”“三不要”_数据分析师 大数据时代处理数据的三大转变:要全体不要抽样,要效率不要绝对精确,要相关不要因果。 具体的大数据处理方法确实有很多,但是根据笔者长时间的实践,总结 ...
2014-11-28大数据时代_大数据分析将走向何方_数据分析师 现阶段关于大数据的未来,下一步是什么,我们如何利用数据在更深的层面提取有意义的消费者信息来超越我们现在的程度?最标准的答案是从比以往更 多的设备上实 ...
2014-11-28大数据实践 基础架构先行_数据分析师 大数据被认为是下一个创新、竞争和生产力的前沿,谁率先抓住大数据的先机即意味着能够在未来市场竞争之中取得杆位。当前大数据市场除了传统厂商之外,还同时涌现出一大批 ...
2014-11-28解读让大数据价值圆满实现的四条建议 大数据分析可创造出大量的价值。正如大多数有价值的工作一样,大数据值得我们投入时间和精力去挖掘其中的价值。 基于这种经验,笔者在下方给出了四条建议,用于 ...
2014-11-28【连载5】如何用spss做加权最小二乘回归及岭回归 上一节我们讲到一般多元线性回归的操作方法。本节要介绍的是多元线性回归的其他几种情况。包括适用于含有加权变量的加权最小二乘回归方程等。然后继续讨论上 ...
2014-11-28【连载4】 如何用spss做一般(含虚拟变量)多元线性回归 回归一直是个很重要的主题。因为在数据分析的领域里边,模型重要的也是主要的作用包括两个方面,一是发现,一是预测。而很多时候我们就要通过回归来进 ...
2014-11-28【连载3】如何使用spss做非参数检验 非参数检验是一个相当宏大的命题。由于实际情况的复杂多变,因此非参数检验包括了许多的各种各样的检验方法。之前我们提过,参数检验的使用条件是被检验的样本总体服从正 ...
2014-11-28【连载2】如何用spss做均值比较分析 上一篇文章我们分享了如何用spss做相关性分析,主要包括双变量相关分析,偏相关分析,以及比较偏门的距离相关分析。其中双变量相关分析又包括三种不同的分析方法。如果忘 ...
2014-11-28机器学习-大数据的关键_数据分析师 Splunk的用户大会已经接近尾声。三天时间的会议里,共进行了160多个主题研讨,涵盖了从安全、运营到商业智能,甚至包括物联网,会议中一遍又一遍出现相同的中心主题:大 ...
2014-11-28【连载一】spss中做相关分析 相关分析是很基础的一种分析方法,接触spss的同学很快就会学习到想相关分析。虽然他很基础,但是在做很多高级分析之前,都要进行相关分析。这篇问文章就系统的和大家分享一下spss ...
2014-11-28Cisco ASA 防火墙 大文件传输问题的解决方法 asa由于在传输大容量文件时,因为连接的时间太长,会time out,可以这样解决。 解决办法: access-list vertas_in extended permit tcp object-group x.x.x. ...
2014-11-28Cisco Pix防火墙 fixup protocol的用途是什么 fixup命令作用是启用,禁止,改变一个服务或协议通过pix防火墙,由fixup命令指定的端口是pix防火墙要侦听的服务。 例1. Pix525(config)#fixup protocol ftp ...
2014-11-28“最近复购率一直在下降,我们的营销力度不小啊,为什么用户还是走了?” “是不是广告投放的用户质量不高?还是我们的产品问题 ...
2025-02-21以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-19在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31