DT数据时代,数据本身才是问题所在
最近和一些互联网企业交流,无论所在什么细分行业,在数据分析方面的动向可以总结为两类:或在寻找专业的第三方数据分析产品,或在寻找能lead组建数据分析团队的候选人。看来马云说的“人类正从IT时代走向DT (Data Technology) 时代”,所言不假。毋庸置疑,数据的重要性正在逐渐被认识到。而谈起数据分析团队耗时最多的一件事情,无它,唯独数据的采集、清洗、整理。是的,太多采集到的数据需要整理,另外还有更多的数据需要去采集。
很多企业将大量时间花费在数据收集和整理上,总体来看有两方面的原因:数据需求的不可预见性,不同业务数据的独立性。
很多互联网企业的业务都在飞速发展中,业务规模和产品都有很大的变更,产品经理或者数据分析师都很难在当下预测下个月甚至下一周的数据需求,要看数据的时候没有数据,而采集数据需要耗费业务人员与工程人员较高的沟通成本,更甚者还涉及产品的版本发布协调排期;或者产品已经上线,但发现采集的数据是错误的,对于众多app来说,只能等下次发版。总之,数据的供给总不是满足不了业务的需求。以上场景还只是管中窥豹,但可以充分说明一点,数据的采集,清洗和处理已经耗费了大量时间,而数据源头的堵塞又会进一步影响需要需要数据来支撑的业务决策的效率。
从另一个维度来看,企业内部会有销售、市场、产品、运营、财务等不同部门,不同的部门在使用着传统ERP、CRM或各类SaaS软件,这些数据在不同的软件里流动,相互之间完全断裂,数据大而不可通用。最近GrowingIO的一些客户反馈,他们内部有完善的后端交易数据,客户属性数据,这些还是具有远见的老大在早期就开始筹备和收集,但是一段涉及到客户进行数据分析的时候,同样只得无奈,因为这些相对更新频次较低的后台数据无法实时反馈客户当前的情况,对于一个半年前已经购买SaaS产品的客户,如何能了解到他当前的使用状况和对产品的满意程度?后端数据需要与更实时的用户行为数据结合才能反映实际问题。是的,前后端的数据需要打通,更大的价值才能产生。
越来越廉价的硬件,以及云的逐渐普及,使得拥有大量的数据对很多企业来说并不是难事。TB、PB这些曾经的海量数据单位,很多企业已经轻松跨越。但事实是,大量的企业将无数的时间、人力投入在海量数据的清洗整理和不同平台数据的聚合上。要知道原始数据是混乱和无效的,并不能直接地传达信息,更不代表决策和洞察。所以数据量越大,清洗和数据整理反而成了一项极其浩大而低价值的工作。而真正的价值,数据的分析,商业的洞察又必须建立在完成这些数据采集,清洗,管理,存储等等一系列浩大的工程之后。
大部分企业将90%的时间花在埋点、标签规范、数据存储、管理、ad-hoc分析等低价值但是费时费力的事情上,而真正产生数据价值的业务分析只需要10%的时间,但是鲜有企业能够达到。
或者即便达到,却需要经过一段长期的煎熬,无法快速达到数据分析反哺业务的阶段。这产生的后果是灾难性的,因为大量的决策是凭着直觉和经验做出来的。但是今天互联网圈的竞争和发展速度一日千里,无论是企业的高层管理者还是一线的PM,业务人员都需要快速地通过数据来反哺业务,做出有效的决策并快速行动。前段时间拜访某大型互联网公司负责人,作为创始人兼CEO的大佬开玩笑谈到:“回想过去几年的发展,仿佛是闭着眼睛开飞机,而且边开还要边修飞机,能快速发展到今天是幸运的。未来继续做大做强,一定要合理的通过数据来决策。”
绝大部分的企业,在意识到要用数据驱动业务之后,数据量开始从B到TB,甚至到PB的增长,但却反而淹没在大量的数据中。这并不是方向错误,而是真正搭建一个好的数据分析基础太难,从技术架构,平台搭建,业务梳理,数据采集,商业分析,知识和技术跨度巨大,就像金字塔,每爬一个台阶都需要大量的投入。然而即便勤奋也是不够的,因为你需要一个了解技术框架,能理解业务以及具备强大数据分析能力的人来领导这样一个团队。但这样的人才,在国内拿望远镜也找不到。千兵易得,一将难求。
在美国,数据分析是一个相对成熟的产业。在每个环节——数据采集,不同来源的数据聚合整理,BI可视化,甚至市场、销售、产品等每个维度,都有许许多多的公司能提供专业性服务。根据产业研究公司Wikibon在国外的数据研究显示,在企业对数据工具投资当中,有52%的资金流向了用于采集和组织数据的技术之上,让数据的获取和分析变得更容易。但在国内,一定是远远达不到这样的数据。一方面是企业对数据的认识,数据驱动业务的实践摸索当中,企业负责人的认识还不够成熟,另一方面是真正能够提供专业服务的公司还不如美国成熟,缺乏专业的产品和服务。
DT时代来临,企业应持具有远见的战略眼光迎接这个时代,充分利用数据的价值来驱动企业的健康和持续成长,但同时也应该意识到,“大”的数据本身也是问题。如何乘势而上,需要借助专业外部产品和团队,尽可能地解决可以通过外部解决的问题,让数据分析师和业务人员将更多精力花在业务分析和数据决策以及行动上。
数据分析咨询请扫描二维码
统计学基础 - 理解统计学的基本概念和方法是数据分析师必备的技能之一。统计学为他们提供了处理数据、进行推断和建模的基础。 数 ...
2024-11-25数据分析师在如今信息爆炸的时代扮演着至关重要的角色。他们不仅需要具备扎实的数据分析技能,还需要不断学习和适应不断发展的技 ...
2024-11-25数据分析师的工作职责涉及多个关键方面,从数据的获取到处理、分析再到可视化,旨在为企业的决策提供有力支持。让我们深入了解数 ...
2024-11-25数据分析师:洞察力量的引擎 数据分析师的兴起 数据分析师行业目前正处于快速发展阶段,市场需求持续增长,薪资水平也有所提升。 ...
2024-11-25数据收集与整理 - 从各种来源收集数据,清洗和整理以确保数据质量和可用性。 数据分析与建模 - 运用统计学方法和机器学习模型对 ...
2024-11-25数据分析是当今社会中不可或缺的一项技能,涵盖了广泛的工具和技术。其中,掌握各种数据处理函数对于数据分析师至关重要。本文将 ...
2024-11-25“大数据治理”是一个涵盖广泛的复杂概念,其核心在于确保大规模、多样化的数据资源能够被有效管理和利用。不仅涉及数据的采集、 ...
2024-11-25一、引言 背景介绍 随着信息技术的快速发展和互联网的普及,大数据已经成为现代社会的重要资产。大数据的兴起不仅推动了各行各业 ...
2024-11-25《Python数据分析极简入门》 第2节 7 Pandas分组聚合 分组聚合(group by)顾名思义就是分2步: 先分组:根据某列数据的值进行 ...
2024-11-25数据分析需要学习的内容非常广泛,涵盖了从理论知识到实际技能的多个方面。以下是数据分析所需学习的主要内容: 数学和统计学 ...
2024-11-24数据分析师需要具备一系列多方面的技能和能力,以应对复杂的数据分析任务和业务需求。以下是数据分析师所需的主要能力: 统计 ...
2024-11-24数据分析师需要学习的课程内容非常广泛,涵盖了从基础理论到实际应用的多个方面。以下是根据我搜索到的资料整理出的数据分析师需 ...
2024-11-24《Python数据分析极简入门》 第2节 6 Pandas合并连接 在pandas中,有多种方法可以合并和拼接数据。常见的方法包括append()、conc ...
2024-11-24《Python数据分析极简入门》 第2节 5 Pandas数学计算 importpandasaspdd=np.array([[81,&n ...
2024-11-23数据分析涉及多个方面的学习,包括理论知识和实践技能。以下是数据分析需要学习的主要方面: 基础知识: 数据分析的基本概念 ...
2024-11-22数据分析适合在多个单位工作,包括但不限于以下领域: 金融行业:金融行业对数据分析人才的需求非常大,数据分析师可以从事经 ...
2024-11-22数据分析是一种涉及从大量数据中提取有用信息和洞察力的过程。其工作内容主要包括以下几个方面: 数据收集与整理:数据分析师 ...
2024-11-22数据分析师需要掌握多种技能,以确保能够有效地处理和分析数据,并为业务决策提供支持。以下是数据分析师需要掌握的主要技能: ...
2024-11-22数据开发和数据分析是两个密切相关但又有所区别的领域。以下是它们的主要区别: 定义和目标: 数据开发:数据开发涉及数据的 ...
2024-11-22数据架构师是负责设计和管理企业数据架构的关键角色,其职责涵盖了多个方面,包括数据治理、数据模型设计、数据仓库构建、数据安 ...
2024-11-22