大数据时代喜忧参半,数据发展正面临转折点
近年来,大数据已经覆盖了许多领域,包括互联网领域。许多应用和平台热衷于搜集用户的信息。而在近日举行的SXSW(South by Southwest,西南偏南)大会上,专家们却表达了对于数据会歧视用户的担忧。
会上,独立隐私安全专家Ashkan Soldani提及了IBM的一款能够计算“恐怖主义得分”的软件。这款软件的目的是通过用户数据,计算从叙利亚来到欧洲的人们参与恐怖活动的概率。
大数据(bigdata)一词越来越多地被提及,人们用它来描述和定义信息爆炸时代产生的海量数据,并命名与之相关的技术发展与创新。但是,在大数据发挥重要作用的同时,也产生了一系列问题,给人们造成了困扰。
一、许多软件因数据歧视用户,造成诸多问题
目前,许多企业都会通过软件或应用搜集用户信息。在大数据时代,这种做法是无可厚非甚至是必要的,但是,用户数据可能会使用户遭到歧视,甚至造成滥用。
比如,电脑投放求职广告时,就会产生歧视行为。去年,卡耐基梅隆大学的研究人员通过一款名叫AdFisher的工具,对其第三方网站上的广告定向投放过程进行了追踪。结果表明,当谷歌判定求职者为男性时,为其推送高新主管职位消息的概率远大于同等条件的女性求职者。
记者Julia Angwin说:“你可能并不知道你为什么没有得到那份工作,你或许永远不会知道,其实是因为数据歧视了你”。
对此,AdFisher的开发者表示:“我认为,我们的发现揭露了目前广告生态中开始浮现的诸多歧视和不透明现象。从社会的角度来看,它很值得担忧”。
不仅是在工作方面,就连社交软件都会因为数据歧视用户。美国约会应用Tinder的付费版Tinder Plus推出后,其定价的差异化引发了争议。在美国的用户,18岁到29岁只需9.99美元,但是超过30岁的用户则需支付19.99美元。而处在英国地区的用户,18岁至27岁只需支付3.99英镑,而超过28岁就必须支付14.99英镑。
由于这样的定价,关于Tinder歧视“大龄未婚青年”的言论一时蔓延开来。对此,Tinder副总裁的解释是,年轻用户是高频使用者,但缺乏金钱,定价较低是为了刺激其购买欲。而大龄用户对价格或许敏感度更低,所以愿意购买服务。因此,定价差异化是基于公司测算,并非年龄歧视。
不管这些应用是出于怎样的目的,都或多或少地带有歧视色彩,并且大数据有泄露用户隐私之嫌。一份研究大数据影响的白宫报告中写道:“我们长期坚持的公民权利保护政策对居民信息如何在住房、信用卡、雇佣、健康、教育和交易市场等方面使用有严格的限制,而数据分析技术有可能会击溃这一防线”。
研究者指出,对于企业追踪用户的过程以及投放广告的算法有一定的了解,对人权组织及监管机构来说,是相当重要的。当然,企业也应该采取一些相关的措施,消除数据对用户带来的歧视。
大数据是在互联网时代不可避免的发展趋势,但同时,它产生的问题也让人们有些恐慌。
二、大数据发展正面临转折点,需努力趋利避害
大数据的意义就在于,从庞杂的数据背后挖掘并分析用户的行为习惯与喜好,从而找出更符合用户“口味”的产品和服务,并结合用户需求有针对性地调整和优化自身。
这种作用对于当今企业来说,是极其重要的,其商业价值大致体现在四个方面。
大数据可以实现客户群体细分,并为每个群体量身定制特别的服务;大数据可以对现实环境进行模拟,发掘出新的需求并使投资回报率有所提升;大数据可以加强部门之间的联系,提高生产链条与管理链条的效率;大数据可以使服务成本降低,找出隐藏线索,对产品和服务进行创新。
对于社会来说,大数据的发展也是有诸多好处的。大数据定理表明,在试验不变的条件下,重复试验过程多次。在大量重复中,会呈现出几乎必然的统计特性。
随着计算机处理能力的增强,获得的数据量越大,挖掘出的价值就越多。如果银行能够及时发现风险,社会经济将越发强大;如果医院能够及时发现疾病,我们的身体会更加健康;如果通信公司能够降低成本,我们的话费将更加实惠……
以上情况,都可以通过大数据的不断积累和不断分析实现。通过这一过程,我们可以发现规律,从而实现更好的未来。
但是,任何事物都有两面性,大数据时代所产生的问题也同样不少。
第一,数据不够安全。无论是企业还是个人,在实践过程中都会或多或少地产生数据。这些数据在当今时代并不安全,会有很多方法使它们泄露。
第二,数据泄露产生不平等。对于用户来讲,数据是一笔财富,但是遭到了别人的窃取,而自己并未得到任何收益,这对于用户来说是不公平的。
第三,用户隐私问题。当用户在网上注册信息后,这些信息很有可能已经被扩散,当用户收到一些莫名其妙的邮件、电话、短信时,其实用户的各种信息早已被非法的商业机构贱卖了。
无意中拍的照片,可能会使人一夜成名。用户的想法、行为、都可能被商家记录在案。人们担心身份被盗用,担心数据造假,害怕数据框定,反感数据的不公平造成的歧视。
要解决这些问题,需要克服许多困难,面临巨大的挑战。虽然企业可以更加细致地去检验他们的系统和流程,但是依然不能完全解决问题。通常数据驱动的决策都比较隐蔽,即使产生威胁,也不会被轻易发现。
任何的领域都需要统一,但是大数据行业尚不能立法,因为大数据趋势变化多端,无法掌握立法所面临的全部背景。
业内专家认为,有必要在计算机课程中增加数据伦理教育,并且更改有歧视倾向的计算机程序。尽管不能完全解决问题,但也能起到一定的作用。
马云说:“很多人还没搞清楚什么是PC互联网,移动互联网来了,我们还没搞清楚移动互联的时候,大数据时代又来了”。不管是喜是忧,大数据时代已经降临。
哈佛大学社会学教授加里•金说:“这是一场革命,庞大的数据资源使得各个领域开始了量化进程,无论学术界、商界还是政府,所有领域都将开始这种进程”。现在的大数据领域正面临一个转折点,努力的方向决定着其属性的发展。我们应该尽量消减其负面影响,让大数据发挥其正面作用,从而更好地为人类服务。
数据分析咨询请扫描二维码
《Python数据分析极简入门》 第2节 4 Pandas条件查询 在pandas中,可以使用条件筛选来选择满足特定条件的数据 importpanda ...
2024-11-22数据分析师的工作内容涉及多个方面,主要包括数据的收集、整理、分析和可视化,以支持商业决策和问题解决。以下是数据分析师的一 ...
2024-11-21数据分析师必须掌握的技能可以从多个方面进行归纳和总结。以下是数据分析师需要具备的主要技能: 统计学基础:数据分析师需要 ...
2024-11-21数据分析入门的难易程度因人而异,总体来看,入门并不算特别困难,但需要一定的学习和实践积累。 入门难度:数据分析入门相对 ...
2024-11-21数据分析是一项通过收集、整理和解释数据来发现有用信息的过程,它在现代社会中具有广泛的应用和重要性。数据分析能够帮助人们更 ...
2024-11-21数据分析行业正在迅速发展,随着技术的不断进步和数据量的爆炸式增长,企业对数据分析人才的需求也与日俱增。本文将探讨数据分析 ...
2024-11-21数据分析的常用方法包括多种技术,每种方法都有其特定的应用场景和优势。以下是几种常见的数据分析方法: 对比分析法:通过比 ...
2024-11-21企业数字化转型是指企业利用数字技术对其业务进行改造和升级,以实现提高效率、降低成本、创新业务模式等目标的过程。这一过程不 ...
2024-11-21数据分析作为一个备受追捧的职业领域,吸引着越来越多的女性加入其中。对于女生而言,在选择成为一名数据分析师时,行业选择至关 ...
2024-11-21大数据技术专业主要学习计算机科学、数学、统计学和信息技术等领域的基础理论和技能,旨在培养具备大数据处理、分析和应用能力的 ...
2024-11-21《Python数据分析极简入门》 第2节 3 Pandas数据查看 这里我们创建一个DataFrame命名为df: importnumpyasnpi ...
2024-11-21越老越吃香的行业主要集中在需要长时间经验积累和专业知识的领域。这些行业通常知识更新换代较慢,因此随着年龄的增长,从业者能 ...
2024-11-20数据导入 使用pandas库的read_csv()函数读取CSV文件或使用read_excel()函数读取Excel文件。 支持处理不同格式数据,可指定分隔 ...
2024-11-20大数据与会计专业是一门结合了大数据分析技术和会计财务理论知识的新型复合型学科,旨在培养能够适应现代会计业务新特征的高层次 ...
2024-11-20要成为一名数据分析师,需要掌握一系列硬技能和软技能。以下是成为数据分析师所需的关键技能: 统计学基础 理解基本的统计概念 ...
2024-11-20是的,Python可以用于数据分析。Python在数据分析领域非常流行,因为它拥有丰富的库和工具,能够高效地处理从数据清洗到可视化的 ...
2024-11-20在这个数据驱动的时代,数据分析师的角色变得愈发不可或缺。他们承担着帮助企业从数据中提取有价值信息的责任,而这些信息可以大 ...
2024-11-20数据分析作为现代信息时代的支柱之一,已经成为各行业不可或缺的工具。无论是在商业、科研还是日常决策中,数据分析都扮演着至关 ...
2024-11-20数字化转型已成为当今商业世界的热点话题。它不仅代表着技术的提升,还涉及企业业务流程、组织结构和文化的深层次变革。理解数字 ...
2024-11-20在现代社会的快速变迁中,选择一个具有长期增长潜力的行业显得至关重要。了解未来发展前景好的行业不仅能帮助我们进行职业选择, ...
2024-11-20