对于大数据的处理问题,计算机科学界有两大方向:一是集中式计算,另外一种是分布式计算。小编今天给大家整理的是几种主流的分布式计算框架,希望对大家有所帮助。 Hadoop是基础,它的HDFS能够存储文件,Yarn进 ...
2020-07-10正则表达式(Regular Expression),计算机科学的一个概念,又叫做正规表示法或者常规表示法。 正则表达式描述了一种字符串匹配的模式,能够检查一个串中是不是含有某种子串、替换匹配的子串,将符合某个条件的子 ...
2020-07-10还记得那首火爆全网,根据沙漠骆驼改编的大胆神曲《释放自我》吗? 当时可谓掀起了巨浪,其歌词精炼,一针见血,令人印象最深刻的是“干活的累死累活,有成果那又如何,到头来干不过写PPT的”。 歌词 ...
2020-07-09作者:吴至文 郭叶军 宗炜 李鹏 赵娟 来源:大数据DT(ID:hzdashuju) 内容摘编自《OpenCV深度学习应用与性能优化实践》 导读:本文将介绍OpenCV的源码结构、OpenCV深度学习应用的典型流程,以及深度学习 ...
2020-07-091、Numpy NumPy 是一个 Python 包。 它代表 “Numeric Python”。 它是一个由多维数组对象和用于处理数组的例程集合组成的库。它是Python创建的所有更高层工具的基础。以下是它提供的一些功能: a、N维数组 ...
2020-07-09计算机视觉是一门研究如何让计算机“看”的学科。 简单来说,就是指利用摄影机和电脑等机器,来代替人眼对目标进行识别、跟踪以及测量等,并进一步对图形进行处理,使之成为更适合人眼观察或传送、检测的图像。 ...
2020-07-09上采样(upsampling)或图像插值(interpolating)的主要目的是将源图像放大,从而能够更高分辨率的显示设备上显示。 上采样的原理: 上采样(upsampling),图像放大几乎都是采用内插值方法,即在原有 ...
2020-07-09机器学习中,当原始数据的分类极不均衡,需要对不平衡数据进行处理,而下采样就是处理方法之一。简单来说就是从多数类中随机抽取样本从而减少多数类样本的数量,使数据达到平衡。 下采样,通常适用于 ...
2020-07-09梯度提升决策树(GBDT),全称为Gradient Boosting Decision Tree,是一种迭代的决策树算法,由多棵决策树组成,将所有树的结论累加起来,产出最终答案。 这也就意味着在GBDT中,CART决策树为基学习器,也就是每 ...
2020-07-09前面我们了解了决策树的概念,现在来了解一下决策树剪枝。可能会有人问:为什么要剪枝?答案是:如果一棵决策树完全生长,那么这棵决策树所对应的每一个叶节点中只会包含一个样本,就很有可能面临过拟合问题,因此 ...
2020-07-09决策树(Decision Tree)是机器学习中一种常见的算法,它的思想非常朴素,就像我们平时利用选择做决策的过程。决策树是一种基本的分类与回归方法,当被用于分类时叫做分类树,被用于回归时叫做回归树。 一、决策 ...
2020-07-09XGBoost是诞生于2014年2月的一种专攻梯度提升算法的机器学习函数库,它有很好的学习效果,速度也非常快,与梯度提升算法在另一个常用机器学习库scikit-learn中的实现相比,XGBoost的性能可以提升10倍以上。还有,X ...
2020-07-09用SQL语句添加字段并不难,下面小编整理了SQL添加和修改字段的基本命令,希望对各位小伙伴有所帮助。 增加字段: alter table 表名 add 字段名 type not null default 0 在指定位置插入新字段: alter ...
2020-07-09库: show databases;显示所有数据库 create database <数据库名> ;创建数据库 use <数据库名>;使用数据库 drop <数据库名> 直接删除数据库, 不提醒 show tables; 查看当前数据库中的表 desc na ...
2020-07-09前面小编给大家简单介绍过拟合和欠拟合时,提到了一个概念:学习曲线,我们通过学习曲线能够很清晰的判别出模型现在说出的状态是欠拟合还是过拟合,下面小编具体整理了学习曲线的相关内容,希望对大家有所帮助。 ...
2020-07-09KNN的全称是K-Nearest Neighbors,具体意思为K个最近的邻居。KNN算法可以说是机器学习算法中最简单、最基础的算法了。既能用于分类,也能用于回归。是通过测量不同特征值之间的距离来进行分类。 KNN的基本思路 ...
2020-07-09近来数据记录和规模属性都在急剧增长,由于大多数数据挖掘算法都是直接逐列处理数据,因此导致算法越来越慢。为了保证减少数据列数的同时,丢失的数据信息尽可能少, 数据降维处理算法应运而生。 一、降维的 ...
2020-07-09数据标准化(normalization)是一个常用的数据预处理操作,就是对原始各项指标数据按比例进行缩放,将数据的单位限制去除,转化为无规模、无量纲的纯数值,减少规模、特征、分布差异等对模型的影响,以便于不同单位 ...
2020-07-09今天是2020年7月8日,高考第二天,小编祝各位考生超常发挥,取得好成绩。 对很多人来说,高考都是人生的一次重要转折,但小编觉得,其实应该是高考+志愿填报,才是真正的人生转折点。 高考 ...
2020-07-09目前数据分析行业大火,人人都想学习数据分析,但是是应该把数据分析当成一种工具呢?还是一种职业? 其实小编是比较倾向于:数据分析是一种技能的,下面具体解释一下。 我们先来看一下数据分析的定义: ...
2020-07-08在数据驱动决策的时代,掌握多样的数据分析方法,就如同拥有了开启宝藏的多把钥匙,能帮助我们从海量数据中挖掘出关键信息,本 ...
2025-03-06在备考 CDA 考试的漫漫征途上,拥有一套契合考试大纲的优质模拟题库,其重要性不言而喻。它恰似黑夜里熠熠生辉的启明星,为每一 ...
2025-03-05“纲举目张,执本末从。”若想在数据分析领域有所收获,一套合适的学习教材至关重要。一套优质且契合需求的学习教材无疑是那关 ...
2025-03-04以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/go ...
2025-03-04在现代商业环境中,数据分析师的角色愈发重要。数据分析师通过解读数据,帮助企业做出更明智的决策。因此,考取数据分析师证书成为了许多人提升职业竞争力的选择。本文将详细介绍考取数据分析师证书的过程,包括了解证书种类和 ...
2025-03-03在当今信息化社会,大数据已成为各行各业不可或缺的宝贵资源。大数据专业应运而生,旨在培养具备扎实理论基础和实践能力,能够应 ...
2025-03-03数据分析师认证考试全面升级后,除了考试场次和报名时间,小伙伴们最关心的就是报名费了,报 ...
2025-03-032025年刚开启,知乎上就出现了一个热帖: 2024年突然出现的经济下行,使各行各业都感觉到压力山大。有人说,大环境越来越不好了 ...
2025-03-03大数据分析师培训旨在培养学员掌握大数据分析的基础知识、技术及应用能力,以适应企业对数据分析人才的需求。根据不同的培训需求 ...
2025-03-03小伙伴们,最近被《哪吒2》刷屏了吧!这部电影不仅在国内掀起观影热潮,还在全球范围内引发了关注,成为中国电影崛起的又一里程 ...
2025-03-03以下的文章内容来源于张彦存老师的专栏,如果您想阅读专栏《Python 数据可视化 18 讲(PyEcharts、Matplotlib、Seaborn)》,点 ...
2025-02-28最近,国产AI模型DeepSeek爆火,其创始人梁文峰走进大众视野。《黑神话:悟空》制作人冯骥盛赞DeepSeek为“国运级别的科技成果” ...
2025-02-271.统计学简介 听说你已经被统计学劝退,被Python唬住……先别着急划走,看完这篇再说! 先说结论,大多数情况下的学不会都不是知 ...
2025-02-27“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩稳定, ...
2025-02-26在数据分析工作中,你可能经常遇到这样的问题: 从浏览到消费的转化率一直很低,那到底该优化哪里呢? 如果你要投放广告该怎么 ...
2025-02-25近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的,尤 ...
2025-02-25挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-25在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-25以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-25“最近复购率一直在下降,我们的营销力度不小啊,为什么用户还是走了?” “是不是广告投放的用户质量不高?还是我们的产品问题 ...
2025-02-25