これは私のデータフレームがどのように見えるかです:
ライブラリ (data.table)
df <- fread('
Name EventType Date SalesAmount RunningTotal Runningtotal(prior365Days)
John Email 1/1/2014 0 0 0
John Sale 2/1/2014 10 10 10
John Sale 7/1/2014 20 30 30
John Sale 4/1/2015 30 60 50
John Webinar 5/1/2015 0 60 50
Tom Email 1/1/2014 0 0 0
Tom Sale 2/1/2014 15 15 15
Tom Sale 7/1/2014 10 25 25
Tom Sale 4/1/2015 25 50 35
Tom Webinar 5/1/2015 0 50 35
')
df[,Date:= as.Date(Date, format="%m/%d/%Y")]
最後の列は、過去 365 日間のローリング ウィンドウでの SalesAmount (名前ごと) の累積合計である私の目的の列であり、@6pool の助けを借りてこれを実行しました。彼の解決策は次のとおりです。
df$EventDate <- as.Date(df$EventDate, format="%d/%m/%Y")
df <- df %>%
group_by (Name) %>%
arrange(EventDate) %>%
mutate(day = EventDate - EventDate[1])
f <- Vectorize(function(i)
sum(df[df$Name[i] == df$Name & df$day[i] - df$day >= 0 &
df$day[i] - df$day <= 365, "SalesAmount"]), vec="i")
df$RunningTotal365 <- f(1:nrow(df))
ただし、データフレームが 150 万行を超えるため、df$RunningTotal365 <- f(1:nrow(df)) には長い時間がかかります (これまでのところ 1.5 日以上)。最初の質問で「rollapply」を提案されましたが、この場合の使用方法を理解するのに苦労しました。親切に助けてください。