广告
返回顶部
首页 > 资讯 > 后端开发 > 其他教程 >R语言与格式,日期格式,格式转化的操作
  • 395
分享到

R语言与格式,日期格式,格式转化的操作

2024-04-02 19:04:59 395人浏览 八月长安
摘要

R语言的基础包中提供了两种类型的时间数据,一类是Date日期数据,它不包括时间和时区信息,另一类是POSIXct/POSIXlt类型数据,其中包括了日期、时间和时区信息。 基本总结如

R语言的基础包中提供了两种类型的时间数据,一类是Date日期数据,它不包括时间和时区信息,另一类是POSIXct/POSIXlt类型数据,其中包括了日期、时间和时区信息。

基本总结如下:

日期data,存储的是天;

时间POSIXct 存储的是秒,POSIXlt 打散,年月日不同;

日期-时间=不可运算。

一般来讲,R语言中建立时序数据是通过字符型转化而来,但由于时序数据形式多样,而且R中存贮格式也是五花八门,例如Date/ts/xts/zoo/tis/fts等等。lubridate包(后续有介绍,应用四),timeDate包,都有用。

常见的格式:

as.numeric 转化为数值型
as.logic 转化为逻辑型
as.complex 转化为复数型
as.character 转化为字符型
as.array 转化为数组
as.data.frame 转化为数据框

d<-as.character(z) #将数值向量z<-(0:9)转化为字符向量c("0", "1", "2", ..., "9")。  
as.integer(d)         #将d转化为数值向量  
e <- numeric()     #产生一个numeric型的空向量e  
a=data.frame(a)  #变成R的数据框  
factor()               #变成因子  可以用levels()来看因子个数  

在data.frame中,是可以实现数据集重命名的,比如data.frame(x=iris,y=cars),

也可以实现横向、纵向重命名,data.frame(x=iris,y=cars,row.names=iris)

后续加更内容

应用1——如何通过生日计算年龄

应用2——日期分组

应用三——生成按天的时间序列并进行回归

应用四:灵活处理时间数据—lubridate包(来源TipDM)

应用五:如何在循环、函数中,输出实时时间消耗?

时间的标准格式


mydate = as.POSIXlt('2005-4-19 7:01:00')
names(mydate)

默认情况下,日期之前是以/或者-进行分隔,而时间则以:进行分隔;

输入的标准格式为:日期 时间(日期与时间中间有空隔隔开)

时间的标准格式为:时:分 或者 时:分:秒;

如果输入的格式不是标准格式,则同样需要使用strptime函数,利用fORMat来进行指定。

一、日期型数据——data

1、as.Data函数

在R中自带的日期形式为:as.Date();以数值形式存储;

对于规则的格式,则不需要用format指定格式;如果输入的格式不规则,可以通过format指定的格式读入;其中以1970-01-01定义为第0天,之后的年份会以距离这天来计算。


> x<-as.Date("1970-01-01") 
> unclass(x) 
[1] 0
> 
> unclass(as.Date("1970-02-01")) #19700201代表第31天
[1] 31

代码解读:unclass可以将日期变成以天来计数,比如1970-02-01输出的31,就代表着距离1970-01-01有31天。

as.data中的参数格式:年-月-日或者年/月/日;如果不是以上二种格式,则会提供错误——错误于charTo按照Date(x) : 字符串的格式不够标准明确;

例如这样的数据格式,就常常报错。

19:15.

显示为:2011/1/1 19:15


as.Date('23-2013-1',format='%d-%Y-%m')  
#其中这个%d%Y可以节选其中一个
#%Y%y  大写代表年份四位数,小写代表年份二位数,要注意

2、%d%y%m-基本格式

格式

意义

%d

月份中当的天数

%m

月份,以数字形式表示

%b

月份,缩写

%B

月份,完整的月份名,指英文

%y

年份,以二位数字表示

%Y

年份,以四位数字表示

#其它日期相关函数

weekdays()取日期对象所处的周几;

months()取日期对象的月份;

quarters()取日期对象的季度。

二、时间型——POSIXct与POSIXlt

POSIXct 是以1970年1月1号开始的以秒进行存储,如果是负数,则是1970-01-01年以前;正数则是1970年以后。

POSIXlt 是以列表的形式存储:年、月、日、时、分、秒,作用是打散时间;

1、POSIXlt 格式

主要特点:作用是打散时间,把时间分成年、月、日、时、分、秒,并进行存储。

可以作为时间筛选的一种。


> today<-Sys.time()
> unclass(as.POSIXlt(today))
$sec
[1] 53.27151
 
$min
[1] 38
 
$hour
[1] 20
 
$mday
[1] 6
 
$mon
[1] 5
 
$year
[1] 116
 
$wday
[1] 1
 
$yday
[1] 157
 
$isdst
[1] 0
 
$zone
[1] "CST"
 
$gmtoff
[1] 28800
 
attr(,"tzone")
[1] ""    "CST" "CDT"

代码解读:unclass将时间打散。

2、POSIXct 格式

主要特点:以秒进行存储。


> today<-Sys.time()
> today
[1] "2016-06-06 20:42:22 CST"
> unclass(as.POSIXct(today))
[1] 1465216942

解读:比如今天,unclass之后,代表今天2016-06-06距离1970-01-01为1465216942秒。

#GMT代表时区,德意志时间,CST也代表时区

三、时间运算

1、基本运算函数


Sys.Date()                 #字符串类型
typeof(Sys.Date())   #系统日期类型

2、直接加减

相同的格式才能相互减,不能加。二进列的+法对"Date"、"POSIXt"对象不适用。


> as.Date("2011-07-01") - as.Date(today)
Time difference of -1802 days
> as.POSIXct(today)-as.POSIXct(as.Date("2012-10-25 01:00:00"))
Time difference of 1320.529 days
> as.POSIXlt(today)-as.POSIXlt(as.Date("2012-10-25 01:00:00"))
Time difference of 1320.529 days

相互减之后,一般结果输出的天数。

3、difftime函数——计算时差

不同格式的时间都可以进行运算。并且可以实现的是计算两个时间间隔:秒、分钟、小时、天、星期。

但是不能计算年、月、季度的时间差。


gtd <- as.Date("2011-07-01") 
difftime(as.POSIXct(today), gtd, units="hours")    #只能计算日期差,还可以是“secs”, “mins”, “hours”, “days”

4、format函数——提取关键信息


> today<-Sys.time()
> format(today,format="%B-%d-%Y")
[1] "六月-06-2016"

format函数可以将时间格式,调节成指定时间样式。format(today,format="%Y")其中的format可以自由调节,获取你想要的时间信息。

并且format函数可以识别as.Data型以及POSIXct与POSIXlt型,将其日期进行提取与之后要讨论的split类型。


> today<-Sys.time()
> format(as.Date(today),format="%Y")
[1] "2016"
> format(as.POSIXlt(today),format="%Y")
[1] "2016"
> format(as.POSIXct(today),format="%Y")
[1] "2016"

但是format出来的时间不能直接做减法,会出现错误: non-numeric argument to binary operator

5、strptime函数

该函数是将字符型时间转化为 "POSIXlt" 和"POSIXct"两类。跟format比较相似。

strptime之后的时间是可以直接做减法,因为直接是"POSIXlt" 和"POSIXct"格式了。


> strptime("2006-01-08 10:07:52", "%Y-%m-%d")-strptime("2006-01-15 10:07:52", "%Y-%m-%d")
Time difference of -7 days
> class(strptime("2006-01-08 10:07:52", "%Y-%m-%d"))
[1] "POSIXlt" "POSIXt"

四、遇见的问题

1、常常报错。

错误于charTo按照Date(x) : 字符串的格式不够标准明确。这个错误经常出现,我本来的数据格式是

19:15.

后来换成“2011/1/1”这样的就不会报错了,需要数据库自动改变。


#几种错误汇总
dtV<-data.frame(as.POSIXct(a$b,format="%d.%m.%Y")) #错,读出来都是NA
as.Date(a$b, "%Y年%m月%d日")  #错,读不出来
as.POSIXct(strptime(a$b, "%Y-%m-%d"))  #读不出来

#转化成xts格式也读不出来
install.packages("xts")
library(xts)
as.xts(read.zoo("time.csv",header=T))
a <- as.xts(a, descr='my new xts object')
as.xts(read.zoo("a.csv",header=T))
#错

#转化成数值型也不对
c=as.numeric(sales[,2]) 

2、excel另存为csv时发生的错误。

一位网友说:我以前是在excel里另存为csv格式,百度上说CSV档如果以EXCEL开启,由于计算机档案数据转换的原因,会将其CRC之数值改做科学记号方式储存,而造成档案中的 CRC值发生错误。

应用1——如何通过生日计算年龄

1、format函数


timeformat<-function(x){
  format(as.POSIXct(x),format="%Y")
}
sapply(as.Date(data$birthdate),timeformat)

format只能一个一个操作,可以先写成函数,然后计算得出年份,之后用如今的年份相减得到年龄。

2、字符型——strsplit

先转化为字符型,然后进行分割。


data.frame(sapply(as.character(data$birthdate),function(x){strsplit(x,"-")[[1]][1]}))

注意,其中strsplit中的"-",根据具体时间格式情况来定义。

应用2——日期分组

一种按照日期范围——例如按照周、月、季度或者年——对其进行分组的超简便处理方式:R语言的cut()函数。

假设vector中存在以下示例数据:


vDates <- as.Date(c("2013-06-01", "2013-07-08", "2013-09-01", "2013-09-15")) #as.Data()函数的作用非常重要;如果没有它,R语言会认为以上内容仅仅是数字串而非日期对象
 [1] "2013-06-01" "2013-07-08" "2013-09-01" "2013-09-15" 
vDates.bymonth <- cut(vDates, breaks = "month") 
[1] 2013-06-01 2013-07-01 2013-09-01 2013-09-01
Levels: 2013-06-01 2013-07-01 2013-08-01 2013-09-01
Dates <- data.frame(vDates, vDates.bymonth) 

应用三——生成按天的时间序列并进行回归

如果是生成简单的年度,月度数据,ts函数可以满足,但是如果生成的是每天。因为有闰年缘故,所以zoo包可以很好地解决这个问题。

还有笔者在做一个简单的时间序列回归时候,疑惑:

做关于时间序列的ols最小二乘法回归方程,按年来好说,但是如果是按天,如果进行计算呢?

1、把天变成一排规律递增的数字来代替;

2、ts函数变化之后,也是变成一个递增的数字。

以上两种,做的结果都一样,所以没有什么太大的区别。

关于ts函数by day每一天的时间序列生成,该如何呢?


n=30
t<-ts(1:n,frequency=1,start=as.Date("2010-01-09"))

生成一个按天的时间序列。

应用四:灵活处理时间数据—lubridate包(来源TipDM)

lubridate包是由Garrett Grolemund 和 Hadley Wickham写的,可以灵活地处理时间数据。lubridate包主要有两类函数,一类是处理时点数据(time instants),另一类是处理时段数据(time spans)。

1、时点类函数

主要包括解析、抽取、修改。

2、时段类函数

可以处理三类对象,分别是:

interval:最简单的时段对象,它由两个时点数据构成。

duration:去除了时间两端的信息,纯粹以秒为单位计算时段的长度,不考虑闰年和闰秒,它同时也兼容基本包中的difftime类型对象。

period:以较长的时钟周期来计算时段长度,它考虑了闰年和闰秒,适用于长期的时间计算。以2012年为例,duration计算的一年是标准不变的365天,而period计算的一年就会变成366天。

有了时点和时段数据,就可以进行各种计算了。

3、时区信息

lubridate包提供了三个函数:

tz:提取时间数据的时区

with_tz:将时间数据转换为另一个时区的同一时间

force_tz:将时间数据的时区强制转换为另一个时区

应用五:如何在循环、函数中,输出实时时间消耗?

想知道循环中进行到哪里?这样可以合理安排函数进程。那么怎么办呢?

第一办法:使用Rstudio 1.0版本,里面有一个Profiling with profvis,可以很好的对你函数每一步的耗时进行参看。

R︱Rstudio 1.0版本尝鲜(R notebook、下载链接、sparkR、代码时间测试profile)

当然,这个不能实时输出内容。

第二办法:利用difftime函数


t1 = Sys.time()
for (i in 1:5){
a=a+1
b=a*a
print(difftime(Sys.time(), t1, units = 'sec'))
}

先预设当前时间,然后用difftime+print方式,循环输出。

应用六:因子型数据转化为数值型

因子型转化的时候会发现,譬如10000这个数字,会变为6,也就是因子型里面对应的次序,这样并不是我们想要的。所以,可以先变为字符型as.character:


as.numeric(as.character(data))

以上为个人经验,希望能给大家一个参考,也希望大家多多支持编程网。如有错误或未考虑完全的地方,望不吝赐教。

--结束END--

本文标题: R语言与格式,日期格式,格式转化的操作

本文链接: https://www.lsjlt.com/news/123942.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com    QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑,方便收藏和打印~

下载Word文档
猜你喜欢
  • R语言与格式,日期格式,格式转化的操作
    R语言的基础包中提供了两种类型的时间数据,一类是Date日期数据,它不包括时间和时区信息,另一类是POSIXct/POSIXlt类型数据,其中包括了日期、时间和时区信息。 基本总结如...
    99+
    2022-11-12
  • mysql日期格式化操作
    本篇内容主要讲解“mysql日期格式化操作”,感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷,实用性强。下面就让小编来带大家学习“mysql日期格式化操作”吧!mysql 日期DATE_FORMAT(d...
    99+
    2022-10-18
  • Flex日期格式化的具体格式有哪些
    这篇文章给大家分享的是有关Flex日期格式化的具体格式有哪些的内容。小编觉得挺实用的,因此分享给大家做个参考,一起跟随小编过来看看吧。Flex日期格式化在Flex中在类是datagrid等list控件使用labelFunction格式各种文...
    99+
    2023-06-17
  • Hive常用日期格式转换语法
    目录获取当前时间日期格式转换返回日期中的年,月,日,时,分,秒,当前的周数计算日期差值返回当月或当年的第一天参考汇总获取当前时间 获取当前时间戳 select unix_timestamp() 把时间戳转为正常...
    99+
    2022-06-30
    Hive日期格式转换 Hive格式转换
  • SqlServer 查询时日期格式化语句
    SQL Server中文版的默认的日期字段datetime格式是yyyy-mm-dd Thh:mm:ss.mmm 例如: select getdate() 2004-09-12 11:06:08.1...
    99+
    2022-10-18
  • 日期格式化的最佳实践:如何在Java中处理日期格式化
    文章目录 前言一、使用format()方法二、使用注解@JsonFormat三、使用消息转换器1.定义用户类2.重写DateSerializer 方法3.定义对象映射器:4.定义消息转换器5....
    99+
    2023-09-17
    java 开发语言
  • AngularJS日期格式化常见操作有哪些
    这篇文章主要为大家展示了“AngularJS日期格式化常见操作有哪些”,内容简而易懂,条理清晰,希望能够帮助大家解决疑惑,下面让小编带领大家一起研究并学习一下“AngularJS日期格式化常见操作有哪些”这...
    99+
    2022-10-19
  • C#日期格式化的方法
    这篇文章主要介绍“C#日期格式化的方法”,在日常操作中,相信很多人在C#日期格式化的方法问题上存在疑惑,小编查阅了各式资料,整理出简单好用的操作方法,希望对大家解答”C#日期格式化的方法”的疑惑有所帮助!接下来,请跟着小编一起来学习吧!C#...
    99+
    2023-06-17
  • MySQL日期函数与日期转换格式化函数有哪些
    这篇文章将为大家详细讲解有关MySQL日期函数与日期转换格式化函数有哪些,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。Mysql作为一款开元的免费关系型数据库,用户基础非...
    99+
    2022-10-18
  • MySQL中的日期时间类型与格式化方式
    目录【1】mysql中的日期时间类型① 详细解释② SQL语句实例③ timestamp字段④ 测试实例【2】日期时间类型格式化 ① DATE_FORMAT( )函数② date_format( ) 转换格式③ str_...
    99+
    2022-07-04
    MySQL日期时间类型 MySQL日期格式化 时间日期类型
  • Python MySQL 日期时间格式化作为参数的操作
    我的MySQL中的start_time存储的是2018-03-21 10:55:32格式的时间,我需要按照YYYY-MM-DD格式来查询,我的MySQL中的sql是这样写的: SELECT * from m...
    99+
    2022-05-30
    Python MySQL 日期时间 格式化 参数
  • R语言格式化输出sprintf实例讲解
    用%s替代字符串 name <- 'max' sprintf('my name is %s',name) [1] "my name is max" 用%d替代整数 a...
    99+
    2022-11-11
  • R语言学习代码格式一键美化
    目录RStudio 快捷操作formatR 包配合 Shiny 包使用参考当写R代码时,很多时候写的代码或者看到的代码缩进都很难统一到标准的格式。这时为了规范化代码,我们需要再代码中...
    99+
    2022-11-12
  • 如何转换layUI的数据表格中的日期格式
    这篇文章主要介绍如何转换layUI的数据表格中的日期格式,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!转换layUI的数据表格中的日期格式前端jsp代码 <table...
    99+
    2022-10-19
  • R语言读取xls与xlsx格式文件过程
    目录1. ROOBC2. xlsReadWrite3. XLConnect4. xlsx1)装Java2)装xlsx3)实际使用在数据分析的过程中,第一步就是读取数据。 通常我们遇到...
    99+
    2022-11-12
  • js中时间戳格式化成日期格式的方法有哪些
    这篇文章将为大家详细讲解有关js中时间戳格式化成日期格式的方法有哪些,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。js需要把时间戳转为为普通格式,一般的情况下可能用不到的...
    99+
    2022-10-19
  • Java中SimpleDateFormat格式化日期的使用
    包含在Java的 java.text.SimpleDateFormat;包中 日期和时间格式由 日期和时间模式字符串 指定。在 日期和时间模式字符串 中,未加引号的字母 'A...
    99+
    2022-11-13
  • SpringBoot中Jackson日期格式化的方法
    这篇“SpringBoot中Jackson日期格式化的方法”文章的知识点大部分人都不太理解,所以小编给大家总结了以下内容,内容详细,步骤清晰,具有一定的借鉴价值,希望大家阅读完这篇文章能有所收获,下面我们一起来看看这篇“SpringBoot...
    99+
    2023-06-30
  • Feign 日期格式转换错误的问题
    目录出现的场景报错异常如下问题处理第一种处理方式第二种方式出现的场景 服务端通过springmvc写了一个对外的接口,返回一个json字符串,其中该json带有日期,格式为yyyy-...
    99+
    2022-11-13
  • MySQL中的日期时间类型与格式化方式是什么
    本篇内容介绍了“MySQL中的日期时间类型与格式化方式是什么”的有关知识,在实际案例的操作过程中,不少人都会遇到这样的困境,接下来就让小编带领大家学习一下如何处理这些情况吧!希望大家仔细阅读,能够学有所成!...
    99+
    2022-10-19
软考高级职称资格查询
编程网,编程工程师的家园,是目前国内优秀的开源技术社区之一,形成了由开源软件库、代码分享、资讯、协作翻译、讨论区和博客等几大频道内容,为IT开发者提供了一个发现、使用、并交流开源技术的平台。
  • 官方手机版

  • 微信公众号

  • 商务合作