大数据正如何帮助拯救地球_数据分析师
在惠普Vertica分析平台的帮助下,国际保育组织正利用图像处理数据监控世界各地热带森林的生物多样性。
一年多以前,国际保育组织(CI)正全力应付一个庞大的大数据问题。
非营利环保组织的使命是保护自然及其生物多样性,但监测和分析物种的健康——尤其是在热带森林中有地球上一半的动植物——是一个费体力和劳动密集的过程。
在跨越四大洲的16个地方,CI已建立1000个相机陷阱网络——当动物通过其视点区域,装配有运动传感器的摄像头就会被触发。每2000多公里设置一个站点,摄像头捕捉经过的动物的图像,并试图综合和了解气候变化和土地利用对热带陆地哺乳动物和鸟类的多样性的影响。
检查星球的生命体征
“你和我去看医生,我们检查生命体征——提问,血压,” 首席科学家CI桑迪·安德尔曼如此说道,“我们需要那些各种各样的地球生命体征,这就是我们在国际保护组织与TEAM[热带生态,评估和监测网络]和其他项目真正想做的。”
“我们所做的是制作相机陷阱,所以听起来有点像偷拍,”她补充道,“在整个森林里制作这种陷阱,如此我们就能够发现动物种类和动物行为。”
由于相机陷阱位于地球上一些更偏远的地方,那些地方没有基础设施。团队必须手动收集陷阱中的数据并上传,最关键的是CI科学家运行一系列的脚本和模型,以确定出现在图像中的不同品种。然后,他们融合气候测量(降水,温度,湿度,太阳辐射等),关于数目的数据(生长,存活,森林砍伐等等)和来自公开渠道的土地利用数据,去创造一个该区域的动物种群健康典范,并且看它们是如何随时间而变化的。
“世界上的一切都是相互关联的,” CI的热带生态评估和监测网络代理执行主任豪尔赫·阿乌马达说道,“自然不会存活于国家之间,而是作为一个整体而存在。如果我们维持这个世界,并且以一种聪明的方式,我们需要能够评估自己应该如何改进并迅速作出反应。 “
但这个过程并不简单。大约一年前,TEAM每年的能收集到一百万张图像数据。现在的数据已经超过200万。他们在CI办公室用电脑碾碎这些数据,然后手动分布许多工作。分析这些数据的进程可能需要数周,数月甚至更长时间。
“如果我们想运行我们的指标之一的迭代,就得花费几周时间,”阿乌马达说,“我们清楚我们必须根据代码和问题的数据科学来做,但我们没有足够的规模来快速实现。”
阿乌马达指出,时间至关重要。热带森林CI监控器的所在地被认为是地球上所有动植物一半的所在地,能产生地球上40%的氧气。但根据联合国环境规划署称,46万公顷的热带森林 ——约18000平方英里——正在逐年消失。
当陷阱数据仍然必须手动收集时,惠普帮助CI进行快于原来9倍的数据分析,并且能做到更准确地引导。惠普企业服务软件工程师建立了野生动物图片指数(WPI)分析系统,一个可视化人性化的项目仪表盘和分析工具,可近实时数据驱动观察。
WPI的分析系统使用Vertica和R分析软件,运用物种存在-消失数据(通过处理原始相机捕获数据)和“协变量”(气候,林缘和人类存在的数据)去估计某一区域的物种种类。
“说真的,在环境科学,我们没有驾驭大数据的能力,”阿乌马达说,“我们需要一个系统,可以无缝集成到有用的信息上。这就是我们与惠普的合作变得非常重要的原因所在。”
数据可以改变世界
“我们已经学到了很多东西[在过去的25年],”阿乌马达补充道,“作为一个非营利性的环保组织,如果我们真的想尝试改变世界,很多传统的做法是与政府共事,并努力通过各种干预措施影响改变。但是如果你想以数据驱动的方式去做,你真的需要收集大量的数据。对我们来说与有此专长的机构合作伙伴非常重要,现在在非营利世界不同组织这种情况正在出现。“
到目前为止,CI的TEAM和惠普地球洞察分析出的数据不太令人乐观。 275个TEAM监视器,其中的60个(22%)检测到现存物种要么是显著降低要么与基线水平相比有所降低。例如,西方大猩猩——在刚果共和国极度濒危的物种,从2009年的基准线来看似乎已经下降了10%。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
“最近复购率一直在下降,我们的营销力度不小啊,为什么用户还是走了?” “是不是广告投放的用户质量不高?还是我们的产品问题 ...
2025-02-21以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-19在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31