先ほどの質問に答えようとしたときに、単純なはずなのにわからない問題に出くわしました。
データフレームのリストがある場合:
df1 <- data.frame(a=1:3, x=rnorm(3))
df2 <- data.frame(a=1:3, x=rnorm(3))
df3 <- data.frame(a=1:3, x=rnorm(3))
df.list <- list(df1, df2, df3)
一緒にやりたいrbind
ことは、次のことができます。
df.all <- ldply(df.list, rbind)
data.frame
ただし、各行がどの行から来たかを識別する別の列が必要です。deparse(substitute(x))
メソッド (ここと他の場所) を使用して、関連する名前を取得しdata.frame
、列を追加できると期待していました。これは私がそれにアプローチした方法です:
fun <- function(x) {
name <- deparse(substitute(x))
x$id <- name
return(x)
}
df.all <- ldply(df.list, fun)
どちらが返されますか
a x id
1 1 1.1138062 X[[1L]]
2 2 -0.5742069 X[[1L]]
3 3 0.7546323 X[[1L]]
4 1 1.8358605 X[[2L]]
5 2 0.9107199 X[[2L]]
6 3 0.8313439 X[[2L]]
7 1 0.5827148 X[[3L]]
8 2 -0.9896495 X[[3L]]
9 3 -0.9451503 X[[3L]]
明らかに、リストの各要素には名前が含まれていないと思います。私が期待したものを取得する方法を誰かが提案できますか (以下を参照)。
a x id
1 1 1.1138062 df1
2 2 -0.5742069 df1
3 3 0.7546323 df1
4 1 1.8358605 df2
5 2 0.9107199 df2
6 3 0.8313439 df2
7 1 0.5827148 df3
8 2 -0.9896495 df3
9 3 -0.9451503 df3