R en utilisant combn avec apply

Sep 04 2020

J'ai une base de données qui a des valeurs en pourcentage pour un certain nombre de variables et d'observations, comme suit:

obs <- data.frame(Site = c("A", "B", "C"), X = c(11, 22, 33), Y = c(44, 55, 66), Z = c(77, 88, 99))

J'ai besoin de préparer ces données comme une liste d'arêtes pour l'analyse de réseau, avec "Site" comme nœuds et les variables restantes comme arêtes. Le résultat devrait ressembler à ceci:

Node1    Node2    Weight  Type
A         B         33     X
A         C         44     X
...
B         C         187    Z       

De sorte que pour "Weight" on calcule la somme de toutes les paires possibles, et ceci séparément pour chaque colonne (qui se termine par "Type").

Je suppose que la réponse à cela doit être d'utiliser applyune combnexpression, comme ici Appliquer la fonction combn () à un bloc de données , mais je n'ai pas tout à fait été en mesure de le résoudre .

Je peux faire tout cela à la main en prenant les combinaisons pour "Site"

sites <- combn(obs$Site, 2)

Ensuite, les colonnes individuelles comme ça

combA <- combn(obs$A, 2, function(x) sum(x)

et lier ces ensembles de données ensemble, mais cela deviendra évidemment ennuyeux très bientôt.

J'ai essayé de faire toutes les colonnes variables en une seule fois comme ceci

b <- apply(newdf[, -1], 1, function(x){
sum(utils::combn(x, 2))
}
)

mais il y a quelque chose qui cloche là-dedans. Quelqu'un peut-il aider s'il vous plaît?

Réponses

2 StephenK Sep 04 2020 at 21:01

Une option serait de créer une fonction, puis mapcette fonction dans toutes les colonnes que vous avez.

func1 <- function(var){
  obs %>% 
    transmute(Node1 = combn(Site, 2)[1, ],
           Node2 = combn(Site, 2)[2, ],
           Weight = combn(!!sym(var), 2, function(x) sum(x)),
           Type = var)
}

map(colnames(obs)[-1], func1) %>% bind_rows()
2 ThomasIsCoding Sep 04 2020 at 21:05

Voici un exemple utilisant combn

do.call(
  rbind,
  combn(1:nrow(obs),
    2,
    FUN = function(k) cbind(data.frame(t(obs[k, 1])), stack(data.frame(as.list(colSums(obs[k, -1]))))),
    simplify = FALSE
  )
)

qui donne

  X1 X2 values ind
1  A  B     33   X
2  A  B     99   Y
3  A  B    165   Z
4  A  C     44   X
5  A  C    110   Y
6  A  C    176   Z
7  B  C     55   X
8  B  C    121   Y
9  B  C    187   Z
1 YuriySaraykin Sep 04 2020 at 21:07

essayez-le de cette façon

library(tidyverse)
obs_long <- obs %>% pivot_longer(-Site, names_to = "type")
sites <- combn(obs$Site, 2) %>% t() %>% as_tibble()
Type <- tibble(type = c("X", "Y", "Z"))

merge(sites, Type) %>% 
  left_join(obs_long, by = c("V1" = "Site", "type" = "type")) %>% 
  left_join(obs_long, by = c("V2" = "Site", "type" = "type")) %>% 
  mutate(res = value.x + value.y) %>% 
  select(-c(value.x, value.y))


  V1 V2 type res
1  A  B    X  33
2  A  C    X  44
3  B  C    X  55
4  A  B    Y  99
5  A  C    Y 110
6  B  C    Y 121
7  A  B    Z 165
8  A  C    Z 176
9  B  C    Z 187