繁体   English   中英

R 时间序列数据集 - 滞后日期和时间 - 不规则数据周期

[英]R time series dataset - Lag date and time - Irregular data periods

我正在努力处理包含datetime的数据集。 我想建立新的列,例如same_period_previous_weeksame_period_previous_day

我已经在 Stackoverflow 中阅读了几个答案,但无法修复它。

这是重新创建我的数据集的代码:

structure(list(date = structure(c(3L, 3L, 3L, 3L, 2L, 2L, 2L, 1L, 1L, 1L), .Label = c("8/19/2018", "8/25/2018", "8/26/2018" ), class = "factor"), time = c(9L, 10L, 11L, 12L, 10L, 11L, 12L, 10L, 11L, 12L), value = c(2L, 15L, 25L, 35L, 10L, 20L, 30L, 7L, 14L, 21L)), .Names = c("date", "time", "value"), class = "data.frame", row.names = c(NA, -10L))

看起来像这样:

date       time value
8/26/2018   9   2
8/26/2018   10  15
8/26/2018   11  25
8/26/2018   12  35
8/25/2018   10  10
8/25/2018   11  20
8/25/2018   12  30
8/19/2018   10  7
8/19/2018   11  14
8/19/2018   12  21

我尝试使用dplyr ,首先对数据集进行排序,然后对其进行分组并创建一个滞后列。 这是我的代码:

df <- df %>% arrange(date, time)
df_tmp <- df %>% group_by(date, time) %>% mutate(lag_1day = lag(value, n = 1, default = NA))

新列 (lag_1day) 以几个 NA 结束。

我希望得到以下结果:

date    time    value   lag_1day
8/26/2018   9   2       NA
8/26/2018   10  15      10
8/26/2018   11  25      20
8/26/2018   12  35      30
8/25/2018   10  10      7
8/25/2018   11  20      14
8/25/2018   12  30      21
8/19/2018   10  7       NA
8/19/2018   11  14      NA
8/19/2018   12  21      NA

请注意,第一行有一个 NA,因为前一天上午 9 点没有相应的值。

我在第一步中是按升序还是降序排列它们有关系吗?

感谢期待!

像这样尝试。 我想你快到了。

library(dplyr)

df$date <- as.Date(df$date, '%m/%d/%Y')

df %>%
  arrange(time, date) %>% 
  group_by(time) %>%
  mutate(lag_1day = lag(value, n = 1, default = NA)) %>% 
  arrange(desc(date, time))

暂无
暂无

声明:本站的技术帖子网页,遵循CC BY-SA 4.0协议,如果您需要转载,请注明本站网址或者原文地址。任何问题请咨询:yoyou2525@163.com.

 
粤ICP备18138465号  © 2020-2024 STACKOOM.COM