做好这十项便可以开启你的大数据分析之旅
如果你的公司正着手开启你的大数据分析之旅,不要烦恼:你不是一个人,这条船上大有人在。但是你需要加倍努力才能赶上数据分析的领头羊们。
近来2015Teradata合作伙伴大会、2015SAS数据分析大会和CAO(首席分析官)峰会相继举办,而这篇文章是从这些行业大会的讨论中总结出来的十个小窍门。
1. 避免华而不实
现在企业可以从传感器、智能手机中获取比以前多得多的数据,但相应的做出成果的压力也就更大了。陷入热潮特别是一些闪亮的新技术宣传热潮是很容易的。但是靠大数据技术真正获得成功却不是易事,仅仅掌握某项技能是不足以让成功一蹴而就的。今天的大数据领导者们已经在数据分析行业工作长达十年甚至更久,他们有成功的基础。
ThinkBig创始人Ron Bodkin说:“很多时候,落伍者仅仅关注‘银弹’(注:银弹喻指一种极端有效的解决方案),他们希望自己能够掌握一种技术从而各种问题均迎刃而解。这当然是痴人说梦。”他的公司已经在去年被Teradata收购。
2. 不要盲目崇拜数据
据说数据已成为一种新“货币”并展现了自身价值。这样说可能有点夸大其词。数据公司应该只收集其需要的数据来解决业务问题即可,而不是像一头贪婪嗜财的巨龙一样大量囤积数据。
麦肯锡消费市场分析中心的首席营运官Matt Ariker说“数据本身能够成为一种竞争优势,当然你也可能让分析毫无意义。我已经老了,我在宝洁公司开始分析师生涯。那时我们会花费12周来分析两周的促销活动。你真的很需要思考这样几个问题:那些高质量的问题究竟是什么意思,你该如何来整合结构化和非结构化数据以及整理总结你的流程化分析问题的方法。否则你将一无所获。
3. 首先考虑商业案例
一些公司在数据分析之初,会收集所有能到手的数据,然后全部放入自己的数据池中,妄想可以有一种有魔力的算法让自己一键获得业务解决方案。但是他们往往难以有所收获。
Bodkin说“人们往往有这样的误解:数据科学家们的工作就是在周一到办公室之后说‘我又可以无所限制地做些什么有趣的事呢?’而据我所知,没有什么公司会拿出巨额预算进行无限制的数据探索。(他们会参考一些已有商业案例)”
4. 形成数据分析文化
你可以在最纯净的数据集上用最优秀的算法来创造出惊艳的结论,但那毫无意义,除非你的业务伙伴相信你所做的数据分析具有价值,并且相信那些数据和结论。这需要你建立一种数据分析文化。
Teradata实验室主席Oliver Ratzenberger说:“如果你分析那些领先的数据分析竞争者们就会发现,他们花费了过去的10到15年时间来形成自己的数据分析文化。有些公司曾说过自己将在接下来的90年里完成在数据分析项目上从‘爬行’到‘疾跑’的蜕变。这和技术无关,这是在说他们数据分析文化的形成。”
5. 快速失败积累出最终的成功
数据科学是一个往复循环的过程。在你成功把数据变成有价值的结论并实施他们之前,你总会经历各种各样的失败。最近的许多大数据领域的突破性进展,例如Apache Spark都是专注于加速这个过程。
但是大数据从业者不应该为了失败而失败,故意陷入这个失败尝试的循环过程。麦肯锡的Ariker说:“你可以进行多项测试,失败的现实仅仅预示着你会更快的失败。你所有的灵活的数据分析过程都是基于公司支持和假设驱动的。你的失败是为了改进数据分析过程并获得更好的结论,而不是不顾结果地去享受数据分析的过程。
6. 保证最高管理层在数据分析的一环
和管理层分享你的数据分析的成果是必要的,不仅是为了确保他们不会插手你以后的数据分析项目,也是为了保证你在分析管理层关注的问题 。
宝洁公司领导人,商业智能和数据分析领导者David Dittmann在最近的CAO峰会上说:“我们学到的一点是,你必须一直给管理层展现数据价值。而如果你一直缺席管理层的业务讨论会,我想你的工作会出现方向性的根本错误。”
7. 管理很无聊却是必要的
没有什么比一场有关数据分析进程和改变管理方式的讨论更让人犯困了。但是在这样一个快节奏的大数据时代,处理好所有部分不仅仅是细节问题,它更是长期成功的基石。
能够在30天里对一件事保持敏锐是很重要的。Teradata的Ratzenberger说:“但是你需要有能够这么做的基础。包括产品系列,错误处理和版本控制的集成管理是必要的。有些部分在开始的30或90天里是起作用的,但是你还需要保持其在随后依然有效。你有一副好牌在手,就需要你好好把握,一旦你出错一张,随之而来的可能就是满盘皆输。”
8. 保持全程思考
你可能有一个最好的预测模型。但是,除非它可以在现实世界中有效并且有较好的效益,否则它将毫无价值,只是对公司时间和资源的浪费。
麦肯锡的Ariker说:“如果你跑去对经理说‘好消息,我们的大数据平台可以生产很多数据产品,但是我需要再雇1500个人’,那估计你第二天得找份新工作了。你必须一直思考流程化数据处理和效益的平衡,并确保你在研究一个高质量问题的同时考虑好答案。”
9. 积少成多
在大数据领域,一气呵成地处理所有问题听上去是异常诱人的。你想要依据众多变量来建模解决业务问题,所以你去收集了有关各个业务的众多数据,然而你的算法却在剔除合适的结论。想法是美好的,结果却不尽如人意。
肯尼索州立大学的应用统计和数据科学教授Jennifer Lewis Priestley讲了一个故事:有个数学专业的学生建立了一个极好而又极差的模型,这个模型有非常高的准确率,但是产生了2500个预测器。“这毫无意义。你不可能去操作2500个预测器。所以我让那个学生去筛选出四个我可以实际使用的预测器”她在2015SAS数据分析大会上说。
10. 不要去猎取“独角兽”
精通统计学、科技和商业的数据科学家们被称作“独角兽”,因为他们是如此的稀有(事实上并不存在独角兽,因为他们是神话生物,但那是另外的故事了)。
尽管这样的数据科学家确实存在,但这不值得你浪费时间去挖他们来你的公司。ThinkBig的Bodkin说:“我所有的客户都在尝试着挖人。但是你无法从一个人身上就得到想要的价值,你只能从一个团队——一个高效的数据科学团队得到你想要的数据分析结果。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化浪潮中,数据驱动决策已成为企业发展的核心竞争力,数据分析人才的需求持续飙升。世界经济论坛发布的《未来就业报告》, ...
2025-03-28你有没有遇到过这样的情况?流量进来了,转化率却不高,辛辛苦苦拉来的用户,最后大部分都悄无声息地离开了,这时候漏斗分析就非 ...
2025-03-27TensorFlow Datasets(TFDS)是一个用于下载、管理和预处理机器学习数据集的库。它提供了易于使用的API,允许用户从现有集合中 ...
2025-03-26"不谋全局者,不足谋一域。"在数据驱动的商业时代,战略级数据分析能力已成为职场核心竞争力。《CDA二级教材:商业策略数据分析 ...
2025-03-26当你在某宝刷到【猜你喜欢】时,当抖音精准推来你的梦中情猫时,当美团外卖弹窗刚好是你想吃的火锅店…… 恭喜你,你正在被用户 ...
2025-03-26当面试官问起随机森林时,他到底在考察什么? ""请解释随机森林的原理""——这是数据分析岗位面试中的经典问题。但你可能不知道 ...
2025-03-25在数字化浪潮席卷的当下,数据俨然成为企业的命脉,贯穿于业务运作的各个环节。从线上到线下,从平台的交易数据,到门店的运营 ...
2025-03-25在互联网和移动应用领域,DAU(日活跃用户数)是一个耳熟能详的指标。无论是产品经理、运营,还是数据分析师,DAU都是衡量产品 ...
2025-03-24ABtest做的好,产品优化效果差不了!可见ABtest在评估优化策略的效果方面地位还是很高的,那么如何在业务中应用ABtest? 结合企业 ...
2025-03-21在企业数据分析中,指标体系是至关重要的工具。不仅帮助企业统一数据标准、提升数据质量,还能为业务决策提供有力支持。本文将围 ...
2025-03-20解锁数据分析师高薪密码,CDA 脱产就业班助你逆袭! 在数字化浪潮中,数据驱动决策已成为企业发展的核心竞争力,数据分析人才的 ...
2025-03-19在 MySQL 数据库中,查询一张表但是不包含某个字段可以通过以下两种方法实现:使用 SELECT 子句以明确指定想要的字段,或者使 ...
2025-03-17在当今数字化时代,数据成为企业发展的关键驱动力,而用户画像作为数据分析的重要成果,改变了企业理解用户、开展业务的方式。无 ...
2025-03-172025年是智能体(AI Agent)的元年,大模型和智能体的发展比较迅猛。感觉年初的deepseek刚火没多久,这几天Manus又成为媒体头条 ...
2025-03-14以下的文章内容来源于柯家媛老师的专栏,如果您想阅读专栏《小白必备的数据思维课》,点击下方链接 https://edu.cda.cn/goods/sh ...
2025-03-13以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/go ...
2025-03-12以下的文章内容来源于柯家媛老师的专栏,如果您想阅读专栏《小白必备的数据思维课》,点击下方链接 https://edu.cda.cn/goods/sh ...
2025-03-11随着数字化转型的加速,企业积累了海量数据,如何从这些数据中挖掘有价值的信息,成为企业提升竞争力的关键。CDA认证考试体系应 ...
2025-03-10推荐学习书籍 《CDA一级教材》在线电子版正式上线CDA网校,为你提供系统、实用、前沿的学习资源,助你轻松迈入数据分析的大门! ...
2025-03-07在数据驱动决策的时代,掌握多样的数据分析方法,就如同拥有了开启宝藏的多把钥匙,能帮助我们从海量数据中挖掘出关键信息,本 ...
2025-03-06