1 つの列 (F1) でグループ化し、他の列の平均を取得してデータセットを要約しようとしていますが、他の列は数値レベルと因子レベルに分割されています。ddply を使用して F2 の数値を要約することはできますが、F3 の因子レベルに対して同じことを行う方法がわかりません。グループごとに最も繰り返される因子レベルを取得しようとしましたが、これは機能していません。
再現可能な例
library(plyr)
set.seed(37)
df<-data.frame("F1"=rep(LETTERS[1:5],each = 3),
"F2"= 1:15,
"F3"= sample(c("Yes","No"), 15, replace=TRUE))
df2 <- ddply(df,~F1,summarise,
mF2=mean(F2),
mF3=tail(names(sort(table(df$F3))), 1))
> df
F1 F2 F3
1 A 1 No
2 A 2 Yes
3 A 3 No
4 B 4 Yes
5 B 5 No
6 B 6 No
7 C 7 Yes
8 C 8 Yes
9 C 9 Yes
10 D 10 Yes
11 D 11 Yes
12 D 12 No
13 E 13 Yes
14 E 14 Yes
15 E 15 No
> df2
F1 mF2 mF3
1 A 2 Yes
2 B 5 Yes
3 C 8 Yes
4 D 11 Yes
5 E 14 Yes
代わりに、df2 は次のようになります。
> df2
F1 mF2 mF3
1 A 2 No
2 B 5 No
3 C 8 Yes
4 D 11 Yes
5 E 14 Yes
方法が示されている場合は、dplyr または他の方法を試してみたいと思います。