异常值,又称离群点,是指那些在数据集中存在的不合理的值,需要注意的是,不合理的值是偏离正常范围的值,不是错误值。比如人的身高为-1m,人的体重为1吨等,都属于异常值的范围。虽然异常值不常出现,但是又会对 ...
2020-07-01相信做数据分析的小伙伴一定都听说过啤酒与尿布的故事,超市把有关联的东西放在一起,以方便顾客购买,这个故事体现的就是关联规则。关联规则又被称为关联分析,它的目的是在一堆事物中找出具有关联的事物。经常被 ...
2020-07-01协同过滤(CollaborativeFiltering)是推荐算法中最经典、应用最广泛的类型,主要的功能是预测和推荐。它的原理是通过了解用户与物品之间的关系进行推荐,物品本身的属性不考虑在内。主要由线的协同和离线的过滤两部 ...
2020-07-01异常值是指样本中的个别值,其数值明显偏离它(或它们们)所属样本的其余观测值。异常值分析目的是检验是否有录入错误的数据以及是否含有不合常理的数据时。如果对异常值的存在忽视不见,在数据的计算分析过程中把异 ...
2020-06-30R语言是一种用来进行数据探索、统计分析、绘图的解释型语言。它具有丰富的数据类型、以及数量众多的算法功能包、以及非常灵活多样的作图功能。是目前各行各业的数据分析师都在实使用的一种语言,受到众多企业以及 ...
2020-06-30数据倾斜是数据挖掘过程中的常见问题,尤其是在需要处理的数据量过于庞大时,我们可能会需要花费几周甚至更长时间去处理。小编今天就来跟大家分享一下数据倾斜的表现以及产生原因,希望对各位小伙伴有所帮助。 ...
2020-06-30作者:挪亚·吉夫特(Noah Gift) 来源:大数据DT(ID:hzdashuju) 内容摘编自《人工智能开发实践:云端机器学习导论》 导读:本文介绍Python中的常见控制结构。 传统Python语言的主要控制结构是for ...
2020-06-30文章来源:数据分析与统计学之美 作者:黄伟呢 1.概述 python字符串应该是python里面最重要的数据类型了,因此学会怎么处理各种各样的字符串,显得尤为重要。 我们不仅要学会怎么处理单个字符串, ...
2020-06-30python现在在各行各业都有十分广泛的应用,而且近几年的市场需求也不断扩大,未来的发展前景也十分广阔,许多小伙伴想要去学习python来提高自己的职场竞争力。python学习难吗?应该怎样规划学习路线?下面跟小编一起 ...
2020-06-30无监督学习是机器学习里的一种学习方式,下面将给大家具体解释一下无监督学习到底是什么? 首先我们可以对照监督学习来对比理解一下无监督学习的概念。 机器学习中,监督学习是一种明确的训练方式,你能够很 ...
2020-06-30在机器学习中经常会遇到两个概念:线性、非线性。今天就让我们一起来看以下线性与非线性的。 一、一般在线性代数中,线性有以下两个特征: 齐次性:f(a*x)=a*f(x); 可叠加行:f(x+y)=f(x)+f(y)。 只要 ...
2020-06-30二八原则,又叫帕累托原则,二八定律,是世界上有一种公认的企业定律,20%的人掌握着80%的财富,源出处就是80/20帕累托法则。在进行商业分析过程中,最常用到的就是一种模型。 从商业分析方面来说,二八原则的 ...
2020-06-30客户价值一词大家都不陌生,指的是客户对企业的创利能力,那么应该如何来评估客户价值呢?经常用到的客户价值评估模型有以下三种。 一、RFM模型 RFM模型可以说是最简单、最实用的一种评估客户价值的方法了, ...
2020-06-30作者:莫凡 来源:大数据DT(ID:hzdashuju) 导读:12306为什么要设置那么复杂的验证码机制呢?就是因为OCR。 今天聊OCR。 OCR是人工智能、机器学习特别是深度学习,在图像识别方向最为重要的应用之一。 ...
2020-06-29PowerBI是微软推出的一种的交互式报表工具,能够把的静态数据报表转换为效果酷炫的可视化的报表,还能够根据filter条件,动态筛选数据,对数据进行不同层面和维度的分析。通俗点来说,Power BI本质是一款数据分析 ...
2020-06-29文章来源:数据分析与统计学之美 作者:黄伟呢 目录 1.scipy库中各分布对应的方法 from scipy import stats # 正态分布 stats.norm # 卡方分布 stats.chi2 # t分布 stats.t # F分布 ...
2020-06-29RFM模型,在众多的商业分析的客户细分模型中,是应用最广泛的一种模型。RFM模型,是根据客户活的跃程度和交易额的贡献来衡量客户价值和客户创利能力的重要工具和手段。 据美国数据库营销研究所Arthur Hughes的 ...
2020-06-29函数大家都知道,那么窗口函数呢?窗口是标准的SQL术语,用来描述SQL语句内OVER子句划定的内容,这个内容就是窗口函数的作用域。下面就跟小编一起来看窗口函数的具体内容吧。 窗口函数是 SQL 中一类特别的函数, ...
2020-06-29科技创新是经济发展的根本动力。在如今这一时代,AI人工智能就是推动经济发展的最重要的科技动力。特别是近些年来行业与AI人工智能的结合,释放了行业的潜力,重塑着人们的日常工作和生活。在AI人工智能备受关注、 ...
2020-06-29相信大家在一定有接触过偏态分布这一概念,在统计学偏态分布,是指统计数据峰值与平均值不相等的频率分布。根据峰值小于或大于平均值可分为正偏函数和负偏函数,其偏离的程度可用偏态系数刻画。在数据预处理过程中 ...
2020-06-29数据分析的前景无疑非常广阔,随着技术的发展以及各行业对数据的需求激增,越来越多的企业和组织意识到数据分析的重要性。本篇文 ...
2024-09-18撰写一份高质量的数据分析报告是每个数据分析师需要掌握的核心技能。无论是为公司决策层提供支持,还是为技术团队提供指导,一份 ...
2024-09-18大数据领域的就业前景非常广阔,随着技术的不断发展和应用范围的扩大,相关岗位的需求量也在不断增加。根据多方面的证据,我们可 ...
2024-09-18大数据专业是一个多学科交叉领域,主要研究数据的收集、存储、管理、分析和应用。该专业的学生将学习如何利用大数据技术来 ...
2024-09-18人工智能(Artificial Intelligence, AI)是计算机科学的一个分支,它试图理解智能的实质,并生产出一种新的能以人类智能相似 ...
2024-09-18在数据分析领域,35岁常被视为一个职业发展的关键节点。随着年龄的增长,数据分析师可能会面临职业瓶颈或者寻找新的职业方向。本 ...
2024-09-18对于想要成为数据分析师的人来说,有许多在线课程和资源可以帮助他们起步和提升技能。以下是一些推荐的在线课程和资源: &n ...
2024-09-18数据分析师是一个适合对数据分析感兴趣、具有较强逻辑思维能力、并愿意在数据领域发展的人士的职业。无论是计算机、统计学、数学 ...
2024-09-18数据分析师在大数据行业中的日常工作内容通常包括以下几个方面: 1. 数据收集:数据分析师需要从各种内 ...
2024-09-18在现代金融机构中,数据分析岗位扮演着至关重要的角色。银行通过数据分析来获取洞察、优化业务流程、提升客户体验,并作出更加精 ...
2024-09-18作者:CDA持证人居喻 一、瑞幸从数字造假到逆袭翻盘 8月《黑神话:悟空》受到了包括央媒在内的广泛肯定,显示出中国数字经济和 ...
2024-09-18大数据管理与应用就业方向及前景 大数据行业的职业发展路径多样,可以根据个人的兴趣、技能和职 ...
2024-09-18女生做金融分析师是一个充满挑战和机遇的职业选择。随着社会观念的变革和性别平等意识的提升,越来越多的女性开始在金融领域崭露 ...
2024-09-18大数据培训班毕业后的就业前景是非常广阔的。随着大数据技术在各行各业的广泛应用,对于大数据专业人才的需求日益增长。大数据专 ...
2024-09-18CDA数据分析师认证考试内容根据不同等级有所差异,以下是各等级的考试内容概览: 1. **CDA LEVEL I**(业务数据分析师): &nbs ...
2024-09-18数据分析师的报考条件根据不同的认证机构和证书等级会有所不同。以下是一些常见的数据分析师认证及其报考条件的概述: ...
2024-09-18随着信息技术的飞速发展,大数据已成为推动社会进步和产业升级的重要力量。大数据管理与应用作为新兴领域,不仅为企业提供了前 ...
2024-09-18数据分析是一项涉及数据收集、处理、分析和呈现的复杂过程,对于新手来说,入门需要掌握一系列基础知识和技能。以下是一份详细的 ...
2024-09-18在当今这个数据驱动的时代,统计学作为数据分析的核心基础学科之一,正以前所未有的速度融合并影响着各行各业的发展。对于有志 ...
2024-09-18Python作为一种强大且易学的编程语言,广泛应用于数据分析、人工智能(AI)开发等多个领域。本文将详细介绍Python在这些领域的应 ...
2024-09-18