他说数据科学家就是做算术的,还说这是件好事
两年前,一项来自LinkedIn的调查结果显示,“统计分析和数据挖掘”是2014年最大的求职法宝。在大数据技术飞速发展的今天,数据科学家成了炙手可热的大红人。
数据科学家是谁?干嘛的?他们好找工作吗?
度娘说,
666的样子啊。不过太严肃了,我都没听懂,and what about you?
还有一种听起来就像人话的多了,
“你擅长数学,会用Python编程,而且还对某个行业了如指掌?如果你拥有这样的技能集,那你就有可能当上数据科学家。”
嗯,“技能集”。技能集?!能吃吗?
是不是对当上数据科学家再不敢奢望,但如果我告诉你,有一些看上去站着说话不腰疼的人说了这样的话,
“ 数据科学家大多只做算术,这是件好事。”
比如这位——在Basecamp(37signals公司旗下一款项目管理软件 )团队工作的Noah。很多时候他被人称为“数据科学家”,但在他自己看来,大部分情况下他只是做做算术,而且他也很喜欢。
这是Noah在过去几周里所做的一些工作,每一项都是为了应对Basecamp在实际业务中面临的问题:
分析来自不同国家用户的对话内容、试用完成度和平均帐单数量 确定人们当人们登录至一个现有帐户时偶然注册Basecamp的比例,以及长期以来这个现象的变化情况 分析和报告一些Basecamp产品的财务业绩 对帐户所有者进行调查并分析 对一项影响Basecamp用户行为特征的AB测试进行分析
在过去的两周里,Noah所做过的最“复杂”的数学是一些有力的分析和重要测试。他工作的大部分是写SQL queries 来获取数据,对数据进行基本的运算(计算差异,百分比等),绘制结果,并写下注释或建议。
注意昂~可没有编码任何算法、构建推荐引擎昂~也没有部署深度学习系统,或是建立一个神经网络昂~
为什么没有?可能因为现在 Basecamp 还不需要那些东西吧。
在繁花似锦的“数据科学”下有个不怎么光彩的小秘密,那就是大多数人谈论的所谓的数据科学,并不是企业实际需要的东西。企业需要的是准确和可操作的信息,来帮助他们决定如何花费他们的时间和资源。通常一个通过机器学习解决业务中小问题的最佳解决方案,往往只需要高质量的数据,以及一个如何使用最简单的方法解决问题的理念。
也行有人会说,Noah描述的价值并不来自“数据科学”,而是“商业智能”或“数据分析”。我没有资格对数据妄下主观定义,但不管你叫它什么 - 它仍然是对那些花费时间从事数据工作的人,最有价值的方式。
在Noah他们那儿,相当多希望进入“数据科学”领域的朋友都给他发来邮件,希望得到一些建议。在这些邮件中不乏这样的问题:
Dear诺亚,我是应该先得到一个硕士学位?还是应该参加一堆Kaggle比赛?
Noah的建议非常简单:兄弟,都不用。你就学习最基础的数学就行了。然后你再知道如何编写基本的SQL查询,了解企业的经营方式,以及想要成功它需要什么。如果你想成为一名对企业有价值的贡献者,就利用你的周末时间真正进入一家小企业“体验生活”,实际工作一把,而不是参加什么数据挖掘竞赛。去与客户交谈,去注意哪些产品畅销,哪些没有。去试着想想推动业务的经济形式,以及你如何能帮助它更得更多的成功。
所以,知道问题是什么才是迈入精英数据科学家梯队的关键一步。但不要那么傻白甜,因为上面说的技能集,该攒还是得攒!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31本人基本情况: 学校及专业:厦门大学经济学院应用统计 实习经历:快手数据分析、字节数据分析、百度数据分析 Offer情况:北京 ...
2025-01-3001专家简介 徐杨老师,CDA数据科学研究院教研副总监,主要负责CDA认证项目以及机器学习/人工智能类课程的研发与授课,负责过中 ...
2025-01-29