基于群集分配的邻居组很慢

时间:2016-05-08 20:18:07

标签: r performance igraph

我正在使用R中的iGraph进行一些分析,我目前正在进行非常昂贵的计算。我需要在我的图表中的所有节点上执行此操作,因此如果有人知道更有效的方法,我会很感激。

我从图表g开始。我首先在图上做一些社区检测

library(igraph)
adj_matrix <- matrix(rbinom(10 * 5, 1, 0.5), ncol = 8000, nrow = 8000)
g <- graph_from_adjacency_matrix(adj_matrix, mode = 'undirected', diag = FALSE)
c <- cluster_louvain(g)

然后,我基本上将每个群集分配给2个群组中的一个

nc <- length(c)
assignments <- rbinom(nc, 1, .5)

现在,对于每个节点,我想找出它的邻居在给定组中的百分比(由集群分配定义)。我目前以当前的方式做到这一点:

pct_neighbors_1 <- function(g, vertex, c, assignments) { 
  sum(
    ifelse(
      assignments[membership(c)[neighbors(g, vertex)]] == 1, 1, 0)
    )/length(neighbors(g, vertex))
}

然后,假设我有一个数据帧,每行对应一个图中的一个顶点,我用

对所有顶点执行此操作
  data$pct_neighbors_1 <- sapply(1:nrow(data), 
                                 pct_neighbors_1, 
                                 graph = g, community = c,
                                 assignments = assignments)

在这里的某个地方,我可以提高效率吗?谢谢!

1 个答案:

答案 0 :(得分:1)

这应该更快:

library(igraph)

# for reproducibility's sake
set.seed(1234)

# create a random 1000 vertices graph
nverts <- 1000
g <- igraph::random.graph.game(nverts,0.1,type='gnp',directed=FALSE)

# clustering
c <- cluster_louvain(g)

# assignments
nc <- length(c)
assignments <- rbinom(nc, 1, .5)

# precalculate if a vertex belongs to the assigned communities
vertsInAssignments <- membership(c) %in% which(assignments==1)

# compute probabilities
probs <- sapply(1:vcount(g),FUN=function(i){
      neigh <- neighbors(g,i)
      sum(vertsInAssignments[neigh]) / length(neigh)
})