热线电话:13121318867

登录
首页精彩阅读数据分析师核心技术要点
数据分析师核心技术要点
2016-10-27
收藏

数据分析师核心技术要点

我认为数据分析/数据科学/商业智能(或是其它类似名字)的职业,最核心的部分在于两点:业和术。

"业"更偏向于你的soft skills,你的理解能力,分析能力,沟通能力,mind-set。其中当然包括最重要的一个能力:

将复杂的商业问题转化为数学模型,并利用编程能力进行分析,预测和评估,再转化为合适的Business Plan,执行。

你可以看到,这是一个生态圈,其中并不是只是包含了其它答案所描述的数学模型,统计理论,也不只是包含用什么工具sas,r,excel。总结来说是一种完全设身处地去为商业模型思考的mind-set。这是我很多国内数据从业者身上很少看到的。很多同事更喜欢强调自己的统计模型多好,算法多牛,当然,别理解错,这些优化都是好事,但从一个Business function (我把analytic当作一种服务我们的商业目标的商业职能) 的角度来说,这只是一个从过程中的小部分。这可能是因为很多大型企业,比如银行,电商,IT,智能太细分导致,很少有人能真正退一步去思考我们做分析的意义何在,如何落地,能赚多少钱。

"术"更偏向于你的技术,包括你的数学,统计,编程,硬件的技术。这个技术对很多技术爱好者来说是数据分析最有意思的一部分,但对很多更喜欢business的朋友来说,很乏味。当然,没有好与坏,高级和低级的区别。术业有专攻就是这道理, 而抽象一点去说:

为了解决商业问题所需要的技术,能力。

看到这里你应该明白了,很多时候我们说的数据分析师实则是这个层面的。而再细分,这个技术其实分为三层:

1 统计理论,模型                            

2 数据库查询类编程SQL

3 底层数据存储技术hadoop, hive, spark, etc.

成为一个合格的数据科学家,你需要上面1,2的本事。有能力利用统计模型解决问题,也有能力通过编程将这些模型实现,并且自动化。这里很多人争论SAS,R,Python,SPSS,在我看来,无非只是工具,都是相同的,只要能用就好。而数理统计,则是要同时结合Q quant和P quant(具体请参照数说工作室,具体名字我忘了,一个微信号)。区别在于一个强调随机概率,一个强调根据历史数据的统计。所以,基本理论要知道,比如如何判别模型显著,如何优化模型。基本模型也要会,回归,Clustering, sequence analysis等等。只有精通这些模型,才能知道怎么从统计角度去解决商业文体。

数据分析咨询请扫描二维码

最新资讯
更多
客服在线
立即咨询