数据在四个层面上的价值思考
1、思考一下,数据是什么?
“掌握数据就掌握一切”,已经成为大部分互联网公司的基本认识,你只要有用户数据,行为数据,关系链数据,就可以在此基础上衍生出很多新的玩法,新的服务等等甚至之前不存在的产品。
那么数据是什么呢?
我理解的数据其实就是我们个人和社会活动中所有状态和行动的记录。这种记录可以是连续的,也可以是离散的。可以是单点的,也可以是关联的。
数据可以由数字构成,也可以由简单的标签构成,可以是复杂的图像,也可以仅仅由“YES” or “NO” 两种形态。
关键的是,你如何定义这个数据,以及如何使用这些数据。
如果只是将其存储在物理的计算机存储器中,这些数据就是历史,是对资源的浪费。
2、数据在四个层面上的价值分析
数据价值的分析可以从多个角度进行,应用层面,行业层面,小到个人体重管理,大到国家国际战略决策,都可以阐述数据价值。这篇文章,主要是从数据关系和处理方法角度来看数据有哪些价值,以及为实现这些价值,需要做哪些准备和之前遇到的一些坑。
第一层:孤立数据
孤立数据,也可以看成是一个单点数据,其实就是最基本的表示一个状态或者一个记录。这种数据当然也是有价值的,比如:多个孤立的数据可以刻画一个具体的事物,一个人,一个企业等等,都可以通过单点的数据来进行基本描述。
孤立数据是一切数据分析的前提。对于孤立数据,我想表达的一个思考就是,尽可能的标准化。在数据产品设计的时候,或者在数据表的开发时,就需要讲这些孤立的数据定义青清楚。那个字段,通过哪种标识方式,代表哪个含义。同时这种定义,越广泛的范围采用,孤立数据的价值越大。比如:男/女 这种性别定义就非常简单,估计在全球范围内,都可以通用。
第二层:统计数据
我们在大学时代所学的统计学,概率论基本都是对数据的统计处理方法。统计数据是对一定时间或空间维度的数据进行分布计算,在此基础上,发现一些规律和特征,同时依照这种规律进行未来的预测。
最近有个很有意思的现象,国家在严格控制房产价格,各地政府为了保住乌纱帽,无不在统计数据上做文章,抑制中心地区的高价房出售,同时又大量放出郊区低价房。结果不到一个月,全国房价上涨得到有效控制,有些城市还出现大幅下跌。于是,各地官媒喜大普奔,报道房价下跌,政府有功。
“统计数据会撒谎”也是一个大多数人的认识。我们在应用统计数据的时候,首先需要定义如何统计,统计的目标和价值衡量标准在哪里?
比如:我想看下一个月之内,会员在某一个场景下各个时段的操作频次。这个时候就要问一下自己,一个月的数据是否能真实的反应你所想要的市场规律,是不是要扩大到一个季度或者一年。同时如果你是想分析用户转化,那么是不是多加几个场景纵向比较,以确认在哪个场景去投入更多资源等等。
第三层:关联数据
关联数据就开始深入到多维度上面去了,对一个主体的多维数据进行计算,以发现维度之间的关系,是互相促进的,还是互相抑制的。最优组合点以及价值临近点在哪里?
作为数据挖掘的一个重要方法,关联分析在推进系统里面使用很多。关联数据,可以有效的进行服务打包,商品打包。从海量的销售数据中进行关联数据分析,可以发现很奇特的组合。比如有段时间,我在分析会员来电情况,我们会发现,询问A问题的用户,通常会在电话结束后进行B操作,这种关联性,然我们优化了服务流程,在同类用户中,我们通过对A类来电进行B类服务的推荐,很好的进行了服务推广。达到非常好的效果。
第四层:智能数据
智能数据,就是指通过复杂的机器学习算法进行计算得出的数据,这种数据有时候是无法解释其内在原因的,但是智能化是未来的方向,并且速度越来越快。
我所理解的智能数据,是通过大量的数据训练,来实现内在模式的底层规律建设,在此基础上,对新数据的判断和结果产出。就比如最近很热门的Master 大战人类围棋高手,就是在Master进行了大量围棋基本规则定义,以及无数围棋落子模式训练后,形成的一种具有自我判断和计算意识的围棋模式。它之所以能战胜,更多胜在其计算能力和学习深度上面。比人类有了更多层的预测,并在此基础上判断了每一步的胜率。
智能数据是未来进行决策辅助的重要环节,它将像一个先知一样,协助人类预测未来,警示我们在现有模型下的发展结果。从这个角度上看,恐惧大可不必。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-19在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31本人基本情况: 学校及专业:厦门大学经济学院应用统计 实习经历:快手数据分析、字节数据分析、百度数据分析 Offer情况:北京 ...
2025-01-30