Ho un dataset grande (ma il seguente è piccolo per esempio). Posso dividere il dataframe e quindi voglio produrre su più file di testo corrispondenti a lavel usato per dividere.Split dataframe in più file di output
mydata <- data.frame (var1 = rep(c("k", "l", "c"), each = 5), var2 = rnorm(5),
var3 = rnorm(5))
mydata
var1 var2 var3
1 k 0.5406022 0.3654706
2 k -0.6356879 -0.9160001
3 k 0.2946240 -0.1072241
4 k -0.2609121 0.1036626
5 k 0.6206579 0.6111655
6 l 0.5406022 0.3654706
7 l -0.6356879 -0.9160001
8 l 0.2946240 -0.1072241
9 l -0.2609121 0.1036626
10 l 0.6206579 0.6111655
11 c 0.5406022 0.3654706
12 c -0.6356879 -0.9160001
13 c 0.2946240 -0.1072241
14 c -0.2609121 0.1036626
15 c 0.6206579 0.6111655
ora Split
> spt1 <- split(mydata, mydata$var1)
> spt1
$c
var1 var2 var3
11 c 0.5406022 0.3654706
12 c -0.6356879 -0.9160001
13 c 0.2946240 -0.1072241
14 c -0.2609121 0.1036626
15 c 0.6206579 0.6111655
$k
var1 var2 var3
1 k 0.5406022 0.3654706
2 k -0.6356879 -0.9160001
3 k 0.2946240 -0.1072241
4 k -0.2609121 0.1036626
5 k 0.6206579 0.6111655
$l
var1 var2 var3
6 l 0.5406022 0.3654706
7 l -0.6356879 -0.9160001
8 l 0.2946240 -0.1072241
9 l -0.2609121 0.1036626
10 l 0.6206579 0.6111655
voglio write.table in nome della outputc
, outputk
e outputl
. Quindi l'output è un prefisso comune seguito dal nome dell'etichetta per la variabile di raggruppamento.
write.table (spt1)
Forse anche degno di nota: l'OP vuole mantenere 'var1' nell'output ma' .SD' non lo contiene. Potresti provare 'c (.BY, .SD)' (non sono sicuro che funzioni) o usare il nuovo metodo 'split.data.table' (attualmente nella versione di sviluppo https://github.com/Rdatatable/data. tavolo/numeri/1389) – Frank