为什么数据分析计划总是失败
强大的数据分析是一项数字业务命令式——这一切都始于智能数据治理实践,以及对质量和环境的重视。
高管们谈论的大多是普通数据的价值,但Navient Solutions公司的企业数据情报总监Michele
Koch却可以计算出公司数据的实际价值。事实上,Koch可以用实际的美元计算出公司的各种数据元素所带来的收入增加和成本下降。因此,她明白,Navient的数据中存在能够损害其企业底线的问题。例如,客户档案中的关键数据字段中的一个错误就可能意味着该公司无法以最低的成本处理贷款。
“由于这里涉及金钱,因此我们需要一个数据质量仪表板,用以跟踪所有的、我们追踪的、实际的、潜在的价值。”Koch说。
另外,首席数据管理员兼财务副总裁Barbara
Deemer表示,位于特拉华州威尔明顿的一家资产管理和业务处理服务公司Navient内部的一项早期数据相关举措展露了风险。2006年的举措侧重于提高营销数据质量,并产生720万美元的投资回报率,并从增加贷款量和减少运营支出中获得回报。
Koch说,从那以后,Navient公司的高管们都承诺支持强有力的数据治理计划,这是成功分析工作的关键部分。Navient的治理计划包括长期公认的最佳实践,例如标准化数据字段的定义和确保干净的数据。它为大约2600个企业数据元素分配所有权。所有权属于数据字段最初产生的业务领域,要么转到特定数据字段是其流程更不可或缺的业务领域。
该公司还有一个数据质量计划,积极监测领域的质量,以确保不断满足高标准。该公司还推出了数据治理委员会(2006年)和分析数据治理委员会(2017年),以解决持续存在的问题或疑虑,在整个企业做出决策,不断改进数据操作以及数据如何为公司的分析工作提供支持。
Koch说“数据对于我们的商业计划和新的商业机会非常重要,我们希望将重点放在改进支持我们分析程序的数据上。”
根据数据治理方案公司Erwin和UBM的数据治理,大多数高管都认为以合规、客户满意度和更好的决策为主要驱动力的数据治理是至关重要的。然而,报告发现,近40%的响应组织没有单独的数据治理预算,约46%的组织没有正式的数据治理策略。该项调查结果基于包括CIO、CTO、数据中心经理、IT人员和顾问等在内的118个受访者的问题。
鉴于这些数据,专家表示,许多企业数据项目中存在弱点并不意外,下面是7个此类问题的数据实践。
把数据整合在一起,但不是真正的整合
数据治理专业组织的通信副总裁Anne Buff说,在当今的数据和分析领域中,集成是最重要的挑战之一。
诚然,许多组织将所有数据集中在一个地方。但在现实中,他们并没有整合来自多个数据源的各个部分。因此,来自一个系统的Bill Smith与其他系统产生的数据(以及它完整的变化)都没有关系,这给业务带来了多个不完整的定义。
共存数据与集成该数据不同,你必须有一种方法来匹配来自不同来源的记录,你需要做到当这一切都结合在一起时,它应该创造更大的观点,并且利用一些东西来作为连接点。
不同的数据集成技术可以实现这一点,选择、实现和执行正确的工具对于避免过多的手工工作或重复做相同的工作是至关重要的。
此外,整合正变得越来越重要,因为数据科学家正在寻找数据中的模式,以获得能够产生突破、竞争优势等方面的洞见。
“但是,如果你不能把从前从未合并过的数据组合在一起,你就找不到这些模式。”北卡罗纳州Cary的SAS资讯业务解决方案经理Anne Buff说到。
没有实现业务单位有独特的需求
是的,整合的数据对于一个成功的分析程序至关重要。但一些商业用户可能需要不同版本的数据。一种形式的数据不能满足整个组织内每个人的需求。
相反,它需要考虑数据供应,即提供由业务用户或业务部门确定的业务案例所需的数据。
以一家金融机构的不同需求为例。虽然一些部门可能需要整合数据,但欺诈检测部门可能希望其数据科学家使用不受约束的数据,这样他们就可以搜索到危险信号。他们可能想在同一个地址搜索某人,使用他们个人身份信息的细微变化来申请多个贷款。
“你将会看到类似的数据元素,但有一些变量,所以你不想把这些差异弄得太大,把它弄得太干净,”Anne Buff解释说。另一方面,她还表示,金融机构的营销部门希望有正确的客户名称、地址和合适的目标通信。
只招聘数据科学家,而不是数据工程师
随着公司试图超越基本商业智能,以预测和规范分析,以及机器学习和人工智能,它们需要提高数据团队的专业水平。这使得数据科学家的地位受到了关注,另外数据工程师也同样重要,他们需要手机数据来完成数据科学家的工作,但到目前为止,这在许多企业中受到的关注都较少。
Bain & Co.旧金山办公室的合伙人、高级分析和数字实践的领导者Lori Sherer说,这种情况一直在改变。“我们看到,对数据工程师的需求增长大约是数据科学家需求增长的两倍,”Sherer说。
美国联邦劳工统计局(federal Bureau of Labor Statistics)预计,未来10年,对数据工程师的需求将继续快速增长,2016年至2026年,美国经济将增加44,200个职位,平均年薪已达135,800美元。
然而,就像许多关键岗位一样,专家们表示,没有足够的数据工程师来满足需求——这使得IT部门现在才刚刚开始招聘或培训招聘岗位。只招聘数据科学家,而不是数据工程师。
将数据保存在初始状态,而不是管理它的生命周期
在过去的十年中,存储成本急剧下降,使其能够更轻松地存储大量的数据,比以前任何时候都要长。考虑到目前数据的容量和速度以及对数据的分析需求的增加,这似乎是个好消息。
不过,佛罗里达州Apollo Beach咨询公司Eagle Consulting的联合创始人Penny
Garbus表示,尽多人都对拥有大量数据的价值表示欢迎,这往往都是好事。Garbus说,太多的企业对数据持有的时间太长。她说:“你不仅要为它付费,而且如果它存储超过10年,那么信息就很可能脱离时代了。”“我们鼓励人们在上面写注明时间表。”
Garbus说,数据的截止日期不仅从组织到组织,每个部门都不同。零售公司的库存部门可能只需要相对较近期的数据,而市场营销可能需要数年的数据来跟踪趋势。
如果是这样的话,它需要实现架构,将数据的正确时间框架交付到正确的位置,以确保每个人的需求得到满足,并且旧数据不会损坏及时的分析程序。
正如Garbus指出的那样,仅仅因为你必须保存(旧数据),并不意味着你必须把它放在你的核心环境中。你只要拥有它就行了。
Bain & Co.旧金山办公室的合伙人、该公司高级分析和数字实践的领导者Lori
Sherer说,这种情况一直在改变。我们看到,对数据工程师的需求增长大约是数据科学家需求增长的两倍。美国联邦劳工统计局(federal
Bureau of Labor
Statistics)预计,未来10年,对数据工程师的需求将继续快速增长,2016年至2026年,美国经济将增加44,200个职位,平均年薪已达135,800美元。
然而,就像许多关键岗位一样,专家们表示,没有足够的数据工程师来满足需求——这使得IT部门现在才刚刚开始招聘或培训招聘岗位。
专注于量,而不是目标相关性
IT咨询公司Booz Allen Hamilton的高级副总裁Steve Escaravage说:“我们仍在构建模型,并使用最有效的数据进行分析,而不是使用最相关的数据。”
他说,组织经常错误地认为他们应该捕捉并添加越来越多的数据集。他们认为“也许有些东西我们没有找到,而不是怀疑数据的正确性”
考虑到许多机构通过分析大量数据来寻找异常现象来判断欺诈行为。在一个重要的活动中,领先的机构也会分析更有针对性的数据集,从而产生更好的结果。在这种情况下,他们可能会关注那些产生某种交易的个人或机构,这些交易可能预示着麻烦。或者,医疗机构在分析病人的结果时,可能会考虑到医生在提供病人护理时的轮班时间。
Escaravage表示,组织可以从创建一个数据愿望清单开始。尽管这一过程从业务方面开始,“捕获它并使其可用的机制,这是CIO、CTO或首席数据官的领域。”
提供数据,但忽略它来自哪里
今天的一个大主题是“分析偏见”,它可以扭曲结果,甚至产生错误的结论,导致糟糕的商业决策或结果。Escaravage说,在企业分析程序中,产生偏差的问题存在于许多不同的领域,包括如何处理数据本身。
他说,通常情况下,追踪数据来源的工作做得不够好。
“如果你不知道这一点,它就会影响你的模型的性能,”Escaravage说,他注意到数据来源的不可见性,以及数据来源如何使得控制偏见变得更加困难。
“了解数据来自哪里以及发生了什么,是我们的责任。”在数据管理方面有如此多的投资,但也应该有一个元数据管理解决方案。
提供数据,但不能帮助用户理解上下文
Escaravage说,它不仅应该有一个强大的元数据管理程序,它可以跟踪数据的来源,以及它如何在系统中运行,它应该为用户提供对某些历史的洞察,并为一些通过分析产生的结果提供上下文。
“我们对自己能创造的东西感到非常兴奋。”我们认为我们有很好的数据,特别是没有被分析的数据,我们可以建立一个关于这些数据价值的新型模型。“但是,尽管过去5年的分析方法令人惊讶,但这些技术的结果比过去在数据挖掘后应用业务规则时的解释要少,而且很容易解释数据。”
Escaravage解释说,较新的深度学习模式提供了见解和可操作的建议。但这些系统通常不会提供对最佳决策有用甚至至关重要的上下文。例如,它不提供关于概率的信息和基于数据的确定性。
Escaravage说,需要更好的用户界面来提供这种环境。
“技术问题是人们如何与这些模型交互。从透明的角度来看,关注UI/UX是非常重要的。因此,如果有人看到了来自人工智能平台的推荐,他们能在多大程度上深入了解潜在的数据来源,等等?”他说。“CIO们将不得不问如何在他们的系统中建立这样的透明度。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
持证人简介:贺渲雯 ,CDA 数据分析师一级持证人,互联网行业数据分析师 今天我将为大家带来一个关于用户私域用户质量数据分析 ...
2025-04-18一、CDA持证人介绍 在数字化浪潮席卷商业领域的当下,数据分析已成为企业发展的关键驱动力。为助力大家深入了解数据分析在电商行 ...
2025-04-17CDA持证人简介:居瑜 ,CDA一级持证人,国企财务经理,13年财务管理运营经验,在数据分析实践方面积累了丰富的行业经验。 一、 ...
2025-04-16持证人简介: CDA持证人刘凌峰,CDA L1持证人,微软认证讲师(MCT)金山办公最有价值专家(KVP),工信部高级项目管理师,拥有 ...
2025-04-15持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。在实际生活中,我们可能会 ...
2025-04-14在 Python 编程学习与实践中,Anaconda 是一款极为重要的工具。它作为一个开源的 Python 发行版本,集成了众多常用的科学计算库 ...
2025-04-14随着大数据时代的深入发展,数据运营成为企业不可或缺的岗位之一。这个职位的核心是通过收集、整理和分析数据,帮助企业做出科 ...
2025-04-11持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。 本次分享我将以教培行业为 ...
2025-04-11近日《2025中国城市长租市场发展蓝皮书》(下称《蓝皮书》)正式发布。《蓝皮书》指出,当前我国城市住房正经历从“增量扩张”向 ...
2025-04-10在数字化时代的浪潮中,数据已经成为企业决策和运营的核心。每一位客户,每一次交易,都承载着丰富的信息和价值。 如何在海量客 ...
2025-04-09数据是数字化的基础。随着工业4.0的推进,企业生产运作过程中的在线数据变得更加丰富;而互联网、新零售等C端应用的丰富多彩,产 ...
2025-04-094月7日,美国关税政策对全球金融市场的冲击仍在肆虐,周一亚市早盘,美股股指、原油期货、加密货币、贵金属等资产齐齐重挫,市场 ...
2025-04-08背景 3月26日,科技圈迎来一则重磅消息,苹果公司宣布向浙江大学捐赠 3000 万元人民币,用于支持编程教育。 这一举措并非偶然, ...
2025-04-07在当今数据驱动的时代,数据分析能力备受青睐,数据分析能力频繁出现在岗位需求的描述中,不分岗位的任职要求中,会特意标出“熟 ...
2025-04-03在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-02最近我发现一个绝招,用DeepSeek AI处理Excel数据简直太爽了!处理速度嘎嘎快! 平常一整天的表格处理工作,现在只要三步就能搞 ...
2025-04-01你是否被统计学复杂的理论和晦涩的公式劝退过?别担心,“山有木兮:统计学极简入门(Python)” 将为你一一化解这些难题。课程 ...
2025-03-31在电商、零售、甚至内容付费业务中,你真的了解你的客户吗? 有些客户下了一两次单就消失了,有些人每个月都回购,有些人曾经是 ...
2025-03-31在数字化浪潮中,数据驱动决策已成为企业发展的核心竞争力,数据分析人才的需求持续飙升。世界经济论坛发布的《未来就业报告》, ...
2025-03-28你有没有遇到过这样的情况?流量进来了,转化率却不高,辛辛苦苦拉来的用户,最后大部分都悄无声息地离开了,这时候漏斗分析就非 ...
2025-03-27