大数据先学会取舍 后做分析_数据分析师
关于大数据曾经轰动一时的案例大概是某超市通过分析一位女顾客的购物数据,根据分析结果给这名十七岁的女孩寄来了孕婴童试用品,尽管这一举动让该女顾客的父亲非常生气,但这确实是通过对其购买记录进行分析而形成的真实案例。对此,我们不禁感叹,大数据有时像是一个侦探家,能够拨开重重迷雾,获得”别有洞天”的大价值。而这关键在于,你是否真正懂得如何去驾驭大数据,让它为我们服务。
面对如此浩瀚的数据海洋中,企业该怎样驾驭?在Teradata天睿公司全球合作伙伴计划首席分析官Bill Franks所撰写的《Taming the Big Data Tidal Wave》中可以找到答案。
有效驾驭大数据
该书英文版于2012年4月出版,成为美国亚马逊的大数据主题图书中销量最好的新书,而它的中文版《驾驭大数据》也已由人民邮电出版社在今年年初出版发行,在国内各大网络书店和新华书店等热销。
目前,市面上有很多关于大数据的书籍都是侧重于大数据管理,如何将大数据存储到数据库或者数据仓库中,或如何将非结构化数据进行结构化和分类等,而《驾驭大数据》这本书的侧重点却有所不同,它主要是关于大数据的有效分析,而不是大数据管理本身,它从数据开始,所有的内容均围绕如何做整体决策,如何构建卓越的数据分析中心,以及如何构建数据分析文化等主题。
记者认为,大数据的价值不在数据本身,而是如何通过数据的整合、探索,从而转化为行动,最终为业务服务带来价值。在新书发布会上,Bill Franks表示,“我认为有必要撰写一本以业务为中心的大数据著作,将大数据相关的重要议题集纳在一起,其形式应该让业务人员和分析专家都容易理解。我希望通过本书中提供相关的洞见,同时辅以行之有效的建议和行动步骤,让大数据源和大数据分析为企业服务。”
加工增值大数据
大数据的意义不在于掌握庞大的数据信息,而在于对这些含有价值的数据进行处理,通过数据的“加工”实现数据的“增值”。随着大数据的到来,Hadoop、MapReduce等技术也被广泛被使用,曾有业界专家表示,任何一个单一的产品不能完整解决用户所面临的大数据问题和挑战。的确,大数据的复杂程度难以想象,Bill Franks介绍道,大数据之所以错综复杂是由四个因素造成的,即大数据通常由机器自动生成,而且通常是全新的数据源,假设会有格式设计,这些格式根本也不友好,大数据中很大部分可能并没有多大的价值。
Teradata天睿公司全球合作伙伴计划首席分析官Bill Franks
由于大数据的复杂性,企业在做数据分析、数据挖掘时就要制定相应的策略,在《驾驭大数据》整本书中,Bill Franks指出:许多大数据其实并没有用,如何过滤掉无效的数据才是真正重要的。他在采访时也表示,“在处理大数据时,应该有所取舍,抛弃大部分数据,将其减少到能够驾驭的数据规模,以便能够快速取得大数据分析成果,至于哪些数据需要抛弃取决于公司自身的需求。”
Bill Franks还建议,处理大数据需要改变流程和文化,能够实现文化的转变,允许拿出少量的预算、人力资源、技术资源等做试点,做一些存在一定风险和结果尚未确定的小实验。“驾驭大数据最困难的事情不是技术手段的盘点,而是取决于采用什么样的方法来更好的发挥大数据的价值,并且能够改变它的流程。”
泡沫时代之后的大数据
研究表明,“大数据”炒作已经接近预期最高值,“大数据泡沫”即将破灭。在Bill Franks看来,大数据的炒作确实已经到了顶峰,但是要关注的是在炒作背后的数据价值。正如上世纪九十年代的互联网泡沫一样,待互联网泡沫破裂后,还是会有很多有价值的企业影响着各个行业,使得经济快速发展。“话题的炒作会冷却,但是大数据分析的价值会继续下去,重点是如何采取正确的策略、流程和方法去从大数据分析中获得价值。”
数据分析咨询请扫描二维码
《Python数据分析极简入门》 第2节 5 Pandas数学计算 importpandasaspdd=np.array([[81,&n ...
2024-11-23数据分析涉及多个方面的学习,包括理论知识和实践技能。以下是数据分析需要学习的主要方面: 基础知识: 数据分析的基本概念 ...
2024-11-22数据分析适合在多个单位工作,包括但不限于以下领域: 金融行业:金融行业对数据分析人才的需求非常大,数据分析师可以从事经 ...
2024-11-22数据分析是一种涉及从大量数据中提取有用信息和洞察力的过程。其工作内容主要包括以下几个方面: 数据收集与整理:数据分析师 ...
2024-11-22数据分析师需要掌握多种技能,以确保能够有效地处理和分析数据,并为业务决策提供支持。以下是数据分析师需要掌握的主要技能: ...
2024-11-22数据开发和数据分析是两个密切相关但又有所区别的领域。以下是它们的主要区别: 定义和目标: 数据开发:数据开发涉及数据的 ...
2024-11-22数据架构师是负责设计和管理企业数据架构的关键角色,其职责涵盖了多个方面,包括数据治理、数据模型设计、数据仓库构建、数据安 ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列技能,以确保能够有效地处理、分析和解释数据,从而支持决策制定。以下是数据分析师所需的关键技能: ...
2024-11-22数据分析师需要具备一系列的技能和能力,以确保能够有效地处理、分析和解释数据,从而支持业务决策。以下是数据分析师所需的主要 ...
2024-11-22需求持续增长 - 未来数据分析师需求将持续上升,企业对数据驱动决策的依赖加深。 - 预测到2025年,中国将需要高达220万的数据人 ...
2024-11-22《Python数据分析极简入门》 第2节 4 Pandas条件查询 在pandas中,可以使用条件筛选来选择满足特定条件的数据 importpanda ...
2024-11-22数据分析师的工作内容涉及多个方面,主要包括数据的收集、整理、分析和可视化,以支持商业决策和问题解决。以下是数据分析师的一 ...
2024-11-21数据分析师必须掌握的技能可以从多个方面进行归纳和总结。以下是数据分析师需要具备的主要技能: 统计学基础:数据分析师需要 ...
2024-11-21数据分析入门的难易程度因人而异,总体来看,入门并不算特别困难,但需要一定的学习和实践积累。 入门难度:数据分析入门相对 ...
2024-11-21数据分析是一项通过收集、整理和解释数据来发现有用信息的过程,它在现代社会中具有广泛的应用和重要性。数据分析能够帮助人们更 ...
2024-11-21数据分析行业正在迅速发展,随着技术的不断进步和数据量的爆炸式增长,企业对数据分析人才的需求也与日俱增。本文将探讨数据分析 ...
2024-11-21数据分析的常用方法包括多种技术,每种方法都有其特定的应用场景和优势。以下是几种常见的数据分析方法: 对比分析法:通过比 ...
2024-11-21企业数字化转型是指企业利用数字技术对其业务进行改造和升级,以实现提高效率、降低成本、创新业务模式等目标的过程。这一过程不 ...
2024-11-21数据分析作为一个备受追捧的职业领域,吸引着越来越多的女性加入其中。对于女生而言,在选择成为一名数据分析师时,行业选择至关 ...
2024-11-21