大数据产业发展态势:由“概念”到“价值”的华丽转身
继物联网、云计算之后,大数据已经成为当前信息技术产业最受关注的概念之一。大数据时代的来临,使得领域和行业边界愈加模糊,应用创新超越技术本身,生产模式向服务化转变,数据作为一种资产为企业带来新商业价值,数据开放让政府治理和个人福祉都面临着机遇和挑战……无论个人、企业组织、社会团体,还是国家和经济体,都能藉此实现大数据梦想。
当前,全球大数据产业正处于蓬勃发展的孕育期和机遇期。核心关键技术正在加快发展和更新换代,各类解决方案提供商加大力度宣传造势,尤其是围绕电信、航空、交通、生物、城市管理等重点领域描绘美好蓝图,力求推动行业应用和商业模式创新,抢占产业增长点。与此同时,小微企业和创业者对大数据热情高涨,期望借此机会实现高速成长的梦想。由于整个大数据产业开始转向应用创新阶段,高成长的预期让各方都对未来抱以乐观的态度。
从“技术驱动”转向“应用驱动”
作为一个独立的产业,大数据的产业体系框架表现为“两纵三横”:“两纵”基于技术的基础程度,分为底层技术和应用层技术,前者是共性、基础性技术,如 Hadoop框架、Hbase数据库、Mahout算法集等;后者是“二次开发”行为,包括各类个性化方案、产品与服务。“三横”基于处理的流程顺序,分为基础设施、分析系统和应用工具,也可进一步细化为数据的采集、存储、处理、分析、服务五方面。目前,“两纵三横”的产业体系已经趋于成熟,能够应对绝大多数的产业应用需求。
广义的大数据应用本质上是一种“增值分析”,前景有着近似无限的可能,不受任何行业、资源、地域、用户的约束。从这个层面看,各产业领域未来发展方向几乎都能和大数据挂钩。以“十二五”国家战略性新兴产业发展规划为例,很多技术前沿的描述和布局,均与大数据相一致或关联,或是可以通过大数据实现。如新一代信息技术产业布局了物联网、移动终端设备、云计算、海量数据处理软件;节能环保产业布局了高效储能、节能监测和能源计量;生物医药产业布局了生物资源样本库、基因测序,以及基于物联网的远程健康管理服务等。
由于大数据技术兴起于互联网时代,互联网的快速发展与其持有的开放、共享、合作等观念密切相关,因而大数据技术的创新也引入了互联网的这种价值观。例如有不少大数据技术是开源的,可无偿供给全世界的开发者使用和改进。开源项目、开源社区和开放性创新联盟组织的成熟更是推动了大数据核心技术的发展,催生了多种用于存储、处理和分析大数据的新产品。这一过程有效降低了产业技术的壁垒,推动更多的企业和创业者介入,进一步加快了技术应用转化的过程,有助于产业的迅速成长。
虽然大数据产业的“技术驱动”色彩十分明显,与“应用驱动”阶段尚有一段距离,但这一转变过程正在加速进行。
细化的产业竞争策略逐步成型
大数据产业是典型的知识密集型服务业,除了基础设施环节会带来一定能耗之外,其余环节均为零能耗、高附加值。其在初始资本、法规监管等方面的准入门槛极低,但对人才资源的要求较高。为此,产业竞争呈现出数量大、水平高的特点,企业竞争策略逐步分化。
尽管大数据从业者正在急剧增加——几乎所有的信息技术企业都在此领域布局,同时创业者持续不断地进入,竞争者甚多,然而由此带来的并非过度竞争,而是良性竞争,最终将推动技术的创新和价值的实现。
这主要归功于两个原因:一是高创新的属性。大数据技术是信息技术领域中的高附加值环节,以谷歌、亚马逊等为代表的大数据企业,无论是在技术先进性、创新活跃度还是在市场份额上,都在全球处于领先位置。二是高增长的预期。作为企业个体,在产业急速成长的预期之下,基本都选择了追求专业性的策略,依靠产品性能和服务取胜,而摈弃了追求低成本的策略。
在竞争过程中,不同类型的竞争者各具优势。按照技术的变革性与应用水平,主要分化为三类竞争者:一是“互联网颠覆者”,谷歌以及各类大数据开源项目发展了全新的基础技术与数据库构架,依靠免费、开源的所谓互联网模式,彻底改变了原有的技术标准与游戏规则,颠覆了以往各自为阵的信息技术产业。
二是“初生牛犊”,在新的规则面前,大公司与创业者处在同一条起跑线上,一些拥有核心人才与市场嗅觉的创业企业,在特定工具、专业平台方面迅速抢占先机,填补市场空白,获得快速发展,在产业链中拥有了一席之地。
三是“系统集成商”,像微软、IBM这样的传统IT巨头拥有强大的资金、研发能力和市场资源。他们能够敏锐意识到自我革命的紧迫性并马上采取应对举措,积极收购大数据相关企业,将收购获得的技术产品组装为面向行业的应用解决方案,并加强大数据商业营销。
例如IBM在2006—2013年期间并购了30多家公司,还计划2015年前再支出145亿美元用于大数据并购。目前,IBM的大数据平台包括基于 Hadoop的分析、流计算、数据仓库、整合、可视化、系统管理、治理、咨询服务及业务伙伴应用多个方面,提供软件、硬件和行业解决方案在内的各种服务。
另外,政府也是大数据产业的重要一环,主要体现在政府对公共数据的开放上这将使政府在促进产业发展上扮演更加重要的角色。
2009 年,刚上任的美国总统奥巴马签署的首份总统备忘录即为《透明和开放的政府》,随后建立了统一的政府数据开放门户网站:Data.Gov,逐步开放政府拥有的公共数据,并提供多种应用程序接口,供开发者创建特色应用。截至2014年初,该网站开放的数据集已经超过了85000项,汇集了1200余个应用程序和软件工具、手机插件,其中超过300个是由个人或民间组织开发。新的商业模式和企业随之产生,如FlightCaster公司基于美国交通统计局、联邦航空局交通管制中心警报、美国气象局和航班运行状况信息网站FlightStats的数据,提供航班晚点预报,比航空公司的正式通知早6个小时,且准确率达到85%—90%。
数据驱动型的商业模式创新
数据驱动型的商业模式有如雨后春笋,在全球大量涌现。按照数据的获取、管理、分析、应用环节的区分方式,可以将大数据的商业模式分为数据托管和交易平台、关系挖掘和沉淀价值利用、数据社交和跨界连接三种类型。
数据托管和交易平台模式应用已有数十年之久,是发展最为成熟、最为普遍的大数据商业模式,本质是发挥规模效应,降低单个企业在数据信息存储和寻找上的投入成本。主要业务形态有空间出租托管、数据商店、数据市场等,典型的代表企业为亚马逊、EMC2、DropBox。
近年来引入“云”的概念,从简单的数据存储,逐步扩展到数据聚合平台,最终形成云服务;而以独特数据资源进行的整合朝着纵向产业链上下游整合和横向多种产业整合两个方向发展,促使了一站式数据商店和数据交易平台的出现。如亚马逊、微软等企业均建立了可以交易应用程序和高级数据集的数据商店,目前已有数万亿个数据点、数千个订阅、数百个应用程序。
关系挖掘是媒体热炒的主流大数据商业模式,也是数据科学的主要应用模式。核心是通过数据发现隐藏的相关性,最终用于指导商业、精准化服务与辅助决策。
实现这种模式需要一些先决条件,主要是面向数据的处理分析环节:一是目标领域的完全量化,如互联网广告领域,从广告点击到用户购买行为,均有完整详实的数据记录;二是数据处理能力的大幅提升,要能够处理非关系型数据,并在海量条件下保持实时快速的性能。该模式的难点在于需要颠覆常规的用户思维和需求逻辑,典型类型是沉淀价值的利用,将一些通常无意义的数据甚至是垃圾数据进行利用,最终得出有价值的结论。
例如,谷歌公司利用数十亿用户搜索时的错误拼写记录来提升其拼写检查器的智能性。就目前而言,基于关系挖掘的大数据模式尚未成熟,但承载了社会各界的较高期望:这种模式将有助于驱动产业转型和发展新兴产业,如推动生物医药等研发密集型产业、企业咨询等知识密集型产业向数据密集型产业转型,推动零售、交通等传统服务业向现代服务业转型,推动传统制造业向智能制造业转型等。
与前两种模式不同,数据社交和跨界连接模式直接面向每一个社会个体,本质上是充分挖掘物理世界的个体资源,将其变成虚拟世界的一个节点,与其他的节点进行连接、交互和交易,从而大大降低各类商业化业务的推广成本,并形成新兴业态。这种模式正在走向成熟,最典型的代表就是O2O。
例如微信成为了连接线上线下、开展移动支付的重要入口;打车软件有效降低了供需双方的信息不对称,提升了出租车市场的智能化程度;可穿戴设备将人体的讯息进一步量化,并提供决策建议;苹果Passbook 软件为用户提供了一个智能的电子卡包。推行这种模式也有几个必要条件,主要是针对数据的采集传输环节:移动化,需要带有位置服务、能够发射无线信号的智能终端;稳定连接,需要高速、泛在的外部网络环境;在线支付,依靠用户最终的支付行为实现盈利;持续感知能力,需要先进的传感器技术、低功耗芯片技术以及电池技术作为保障。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
“最近复购率一直在下降,我们的营销力度不小啊,为什么用户还是走了?” “是不是广告投放的用户质量不高?还是我们的产品问题 ...
2025-02-21以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-19在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31