R语言 字符串的处理(解析+案例)
数据分析师的日常工作就是数据预处理,数据预处理最经常遇到的问题就是字符串的处理,这部分很难,我以前看过一些R的书和一些技术博客,现在依旧发现有些细节做不好,下面我就转载别人的一些字符串处理的方法,我会在下面说说我的看法:
字符串分割函数:strsplit( )
字符串连接函数:paste( )
计算字符串长度:nchar( )
字符串截取函数:substr( )及substring( )
字符串替换函数:chartr( )
大小写转换函数:toupper( )、tolower( )及casefold( )
以目前的工作来说,前4个至少每次都可以用到其中的一两个,5和6不经常用。
1:strsplit( )函数用于字符串分割,其中split是分割参数。所得结果以默认以list形式展示。
用法:strsplit("字符串",sep=“”(分隔符,可省略sep=,直接写“”双引号里面的内容))
2:paste( )函数用于字符串连接,其中sep负责两组字符串间的连接;collapse负责一组字符串内部的连接。
用法:paste(..., sep = " ", collapse = NULL) (举例:A<-c(a,b),B<-c(1,2),paste(A,B,sep="_",collapse=":")结果为:A_1:B_2。
3:很好理解,用法+案例:nchar(“abc”)结果为3。n是char的长度计算。
4:substr( )函数和substring( )函数是截取字符串最常用的函数,两个函数功能方面是一样的,只是其中参数设置不同。
substr( )函数:必须设置参数start和stop,如果缺少将出错。用法:substr(“字符串”,start=数字,stop=数字)下同。
substring( )函数:可以只设置first参数,last参数若不设置,则默认为1000000L,通常是指字符串的最大长度。
这个也很少理解:substr("abcd",2,3)结果为bc;substring("abcd",2)结果为bcd。
注意:substr和substring的区别就是最后一个参数:前者是必须存在stop结尾,后者随意。
5:chartr( )函数:将原有字符串中特定字符替换成所需要的字符。
其中参数old表示原有字符串中内容;new表示替换后的字符内容
用法:chartr(old= ,new= ,数据框)
案列:x<-c(abc),chartr(old="b",new="s",x)结果就是asc。
6:toupper( )函数:将字符串统一转换为大写。
tolower( )函数:将字符串统一转换为小写。
casefold( )函数:根据参数转换大小写。
前面2个函数比较简单,说说第三个:casefold(向量,upper=T或FALSE),upper=T全是大写,反之。
写这个有2个好处,1是可以帮助别人,2是自我巩固,当然重点是2自我巩固。
数据分析咨询请扫描二维码
技能需求 数据管理与建模 - 掌握SQL、HiveQL、Spark SQL等数据库语言,进行复杂数据查询和分析。 - 使用数据建模工具如ER/Studio ...
2024-11-27技术技能 - 编程技能 - 掌握SQL、Python、R语言等编程工具是基本要求,可用于数据提取、清洗和分析。 - 数据分析与建模技能 ...
2024-11-27财务数据分析职业展望 - 需求激增: 随着企业信息化和数字化进程的加速,财务数据产生和积累速度急剧增长,推动了财务数据分析需 ...
2024-11-27技术技能 数学与统计技能:数据分析师需要具备扎实的数学基础,包括统计学、概率论、多变量微积分和线性代数等知识,以帮助理 ...
2024-11-27选择适当的工具和软件 选择恰当的工具对于创建出色的数据分析图表至关重要。Excel提供强大的数据可视化功能,R语言的ggplot2包 ...
2024-11-27初级市场分析师在工作中面临着重要任务之一:评估竞争对手的表现。这项工作不仅有助于描绘行业竞争格局,还能帮助企业发现自身的 ...
2024-11-27基础知识的建立 要想在数据分析领域脱颖而出,首先需要打好坚实的基础。 数据分析的基础知识十分重要,其中包括统计学、概率论、 ...
2024-11-27# 要学习Python数据分析 掌握Python基础知识 - 首先需要掌握Python的基础知识,包括基本语法、数据结构(如列表、元组、字典等) ...
2024-11-27学数据分析能在什么单位工作 数据分析的就业领域概述 数据分析专业毕业生广泛应用于各行各业,包括但不限于以下单位: 政府机关 ...
2024-11-27想学数据分析需要学哪些课程 数据分析学习路径推荐 基础课程: 统计学: 统计学作为数据分析的基石,涵盖概率论、描述性统计、 ...
2024-11-27# 现在什么行业发展前景最好 **人工智能与机器学习** - 人工智能技术快速发展,广泛应用于智能家居、自动驾驶等领域。 - 具备巨 ...
2024-11-27# 未来最有前景的行业 **人工智能与机器学习** - 人工智能被认为是未来最具潜力的行业之一,其应用范围广泛,包括智能家居、医 ...
2024-11-27数据分析领域蓬勃发展,成为当今行业中备受追捧的职业之一。作为一个初入此领域的学习者,您可能会困惑于应该学习哪些课程才能打 ...
2024-11-27统计与大数据分析专业的就业前景非常广阔,随着数字化时代的到来,这一领域的专业人才需求量不断增加。以下是关于该专业就业前景 ...
2024-11-27数字经济作为全球经济的重要组成部分,正在迅速发展并深刻改变着经济结构和竞争格局。根据多项证据,数字经济的发展现状和趋势可 ...
2024-11-27数据运营是指通过收集、分析和利用大量数据,为企业决策和业务发展提供支持的工作。其核心任务包括数据的采集、整理、分析、挖掘 ...
2024-11-27数据建模是一种重要的技术,用于有效组织和记录系统数据,旨在满足特定业务需求并确保数据的准确性和一致性。这一过程通过抽象化 ...
2024-11-27《Python数据分析极简入门》 第2节 8-2 Pandas 数据重塑 - 数据堆叠 数据堆叠 df=pd.DataFrame({'专业':np.re ...
2024-11-27数据收集与整理 - 从各种来源收集数据,清洗和整理以确保数据质量和可用性。 数据分析与建模 - 运用统计学方法和机器学习模型对 ...
2024-11-26技术技能 - 编程能力: 数据分析师需要掌握至少一门编程语言,如Python、R或SQL。这些语言对于数据处理、建模和分析至关重要。例 ...
2024-11-26