R语言绘制动态网络图Network教程WGCNA

2024-04-23 07:12

本文主要是介绍R语言绘制动态网络图Network教程WGCNA,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

今天分享的笔记是使用NetworkD3对WGCNA的共表达网络进行可视化,创建交互式动态网络图,展示基因之间的相互关系,可以用于转录组或者其他调控网络展示。

加权基因共表达网络分析 (WGCNA, Weighted correlation network analysis)是用来描述不同样品之间基因关联模式的系统生物学方法,可以用来鉴定高度协同变化的基因集,并根据基因集的内连性和基因集与表型之间的关联鉴定候补生物标记基因或治疗靶点。

alt

例如上图展示特异性模块内的基因共表达网络,点的大小和深浅代表该基因在网络中连通性的高低。转录因子用三角形表示, 其他基因用圆形表示。

如何绘制动态网络图?

首先,加载R包和数据,所用到的数据是WGCNA分析得到的输出网络文件,格式是Cytoscape的输入格式,本文的示例数据已上传,留言区回复邮箱,系统自动发送示例数据和全部代码。

library(networkD3)
library(tidyverse)
library(vroom)

df_node <- vroom::vroom("CytoscapeInput-nodes-black.txt")
df_edge <- vroom::vroom("CytoscapeInput-edges-black.txt")

> head(df_node)
# A tibble: 6 × 3
  nodeName  altName   `nodeAttr[nodesPresent, ]`
  <chr>     <chr>     <chr>                     
1 AT1G01010 AT1G01010 black                     
2 AT1G01090 AT1G01090 black                     
3 AT1G01180 AT1G01180 black                     
                  
> head(df_edge)
# A tibble: 6 × 6
  fromNode  toNode    weight direction  fromAltName toAltName
  <chr>     <chr>      <dbl> <chr>      <chr>       <chr>    
1 AT1G69920 AT1G71030  0.445 undirected AT1G69920   AT1G71030
2 AT1G15125 AT1G71030  0.440 undirected AT1G15125   AT1G71030
3 AT1G02920 AT1G71030  0.438 undirected AT1G02920   AT1G71030

df_node文件保存节点信息,df_edge保存边的信息,包括起始位置和结束为止,以及连线的权重大小。这里每个节点可以表示一个基因,节点之间的weight权重值用来表示两个基因之间的关联性。

数据的过滤与筛选

df_edge <- df_edge %>% arrange(-weight) %>% head(100)
# 删除自身和自身相关位点
df_edge <- df_edge[which(df_edge$fromNode != df_edge$toNode),]
networkData <- df_edge[1:2]
simpleNetwork(networkData,linkDistance = 100)

由于基因数量比较多,因此这里先按照权重值进行排序,然后选取前100行,这一步可以根据你的需要设置,也可以按照制定阈值过滤,然后绘制一张简单版本的网络图:

alt

格式转换与重新编码

alt

由于我们WGCNA输出的文件中节点都是通过基因ID来表示,但是绘图时无法直接识别节点ID,需要修改为数字0、1、2...因此,需要对节点进行重新修改。

# 转换格式
df_edge_net <- df_edge[,c(1,2,3)] %>% as.data.frame()
df_node_net <- df_node[,c(1,3)] %>% as.data.frame()

colnames(df_edge_net) <- c("source" ,"target" ,"value")
colnames(df_node_net) <- c("name","group")

# 合并第一列和第二列,并取并集
merged_elements <- union_all(df_edge_net$source,df_edge_net$target) %>% unique()

# 对合并后的元素进行编号
element_numbers <- seq_along(merged_elements)

# 创建一个新的数据框,包含合并的元素和对应的编号
result_df <- data.frame(merged_elements, element_numbers)
result_df$element_numbers <- result_df$element_numbers-1

# 使用映射表更新原始数据框的第一列和第二列
df_edge_net$source <- result_df$element_numbers[match(df_edge_net$source, result_df$merged_elements)]
df_edge_net$target <- result_df$element_numbers[match(df_edge_net$target, result_df$merged_elements)]

经过这一步处理后能够得到两个新的数据框,这就是绘制动态网络图的关键输入数据。在此基础上,我们还可以添加一些额外的信息,比如按照不同的分组将节点赋予不同的颜色,或者根据根据基因之间的正调控和负调控设置连接线的颜色。

# 生成模拟数据
df_edge_net$value <- c(runif(nrow(df_edge_net)/2,0,1),runif(nrow(df_edge_net)/2,0,5))
df_edge_net$color <- c(rep("red",50),rep("green",50))

value值表示节点之间连线的权重大小,可以用来展示两个基因之间的关联程度,该值越大线越粗,关联性越强。

color值可以用来设置连线的颜色,比如设置正调控为红色,负调控为绿色。

除了设置节点与节点之间边的关系,还能设置单个节点的参数,比如通过下面的代码设置节点的大小用来表示基因的表达量,表达量高的基因节点直径越大。还可以用过Type将节点进行分组,比如转录因子为A组,目标基因为B组等等。

df_node_net <- result_df
df_node_net$size <- runif(nrow(df_node_net),0,20)
df_node_net$type <- rep(c("A","B","C"),10000)[1:nrow(df_node_net)]
colnames(df_node_net) <- c("name""group""size","type")

绘制动态网络图

接下来通过调用forceNetwork绘制网络图,将刚刚的两个数据作为输入文件,设置如下参数即可获得结果图。

p <- forceNetwork(Links = df_edge_net, 
             Nodes = df_node_net, 
             Source = "source"
             Target = "target",
             linkColour=df_edge_net$color,
             arrows=TRUE,
             legend=TRUE,
             Value = "value",
             NodeID = "name",
             Group = "type"
             bounded=F,
             opacityNoHover = 0.5,
             linkDistance = 100,
             charge=-500,
             Nodesize='size',
             # radiusCalculation = "Math.sqrt(d.nodesize,2)*5",
             # linkWidth = JS("function(d) { return Math.sqrt(d.value)-4;}"),
             # linkDistance=JS("function(d){return 1/(d.value)*100 }"),
             opacity = 0.9,
             zoom = T,
             fontFamily = "Aril",
             fontSize = 12) 
p
alt

这张图是通过JS实现的,因此支持动态交互,比如将鼠标放在节点上会显示节点名称(基因ID),还可以拖动节点查看与之关联节点。

alt

如果想要将其保存下来,最好的方法是html格式,这样仍具有动态交互属性。

saveNetwork(network = p,file = 'Net.html')

今天分享的内容就到这里,感谢您的阅读,如需本文代码和数据,请把收件邮箱发在评论区,欢迎点赞转发分享。

本文由 mdnice 多平台发布

这篇关于R语言绘制动态网络图Network教程WGCNA的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/928118

相关文章

从基础到高级详解Go语言中错误处理的实践指南

《从基础到高级详解Go语言中错误处理的实践指南》Go语言采用了一种独特而明确的错误处理哲学,与其他主流编程语言形成鲜明对比,本文将为大家详细介绍Go语言中错误处理详细方法,希望对大家有所帮助... 目录1 Go 错误处理哲学与核心机制1.1 错误接口设计1.2 错误与异常的区别2 错误创建与检查2.1 基础

Spring Gateway动态路由实现方案

《SpringGateway动态路由实现方案》本文主要介绍了SpringGateway动态路由实现方案,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随... 目录前沿何为路由RouteDefinitionRouteLocator工作流程动态路由实现尾巴前沿S

全网最全Tomcat完全卸载重装教程小结

《全网最全Tomcat完全卸载重装教程小结》windows系统卸载Tomcat重新通过ZIP方式安装Tomcat,优点是灵活可控,适合开发者自定义配置,手动配置环境变量后,可通过命令行快速启动和管理... 目录一、完全卸载Tomcat1. 停止Tomcat服务2. 通过控制面板卸载3. 手动删除残留文件4.

Python的pandas库基础知识超详细教程

《Python的pandas库基础知识超详细教程》Pandas是Python数据处理核心库,提供Series和DataFrame结构,支持CSV/Excel/SQL等数据源导入及清洗、合并、统计等功能... 目录一、配置环境二、序列和数据表2.1 初始化2.2  获取数值2.3 获取索引2.4 索引取内容2

Go语言中json操作的实现

《Go语言中json操作的实现》本文主要介绍了Go语言中的json操作的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧... 目录 一、jsOChina编程N 与 Go 类型对应关系️ 二、基本操作:编码与解码 三、结构体标签(Struc

python依赖管理工具UV的安装和使用教程

《python依赖管理工具UV的安装和使用教程》UV是一个用Rust编写的Python包安装和依赖管理工具,比传统工具(如pip)有着更快、更高效的体验,:本文主要介绍python依赖管理工具UV... 目录前言一、命令安装uv二、手动编译安装2.1在archlinux安装uv的依赖工具2.2从github

Python绘制TSP、VRP问题求解结果图全过程

《Python绘制TSP、VRP问题求解结果图全过程》本文介绍用Python绘制TSP和VRP问题的静态与动态结果图,静态图展示路径,动态图通过matplotlib.animation模块实现动画效果... 目录一、静态图二、动态图总结【代码】python绘制TSP、VRP问题求解结果图(包含静态图与动态图

C#实现SHP文件读取与地图显示的完整教程

《C#实现SHP文件读取与地图显示的完整教程》在地理信息系统(GIS)开发中,SHP文件是一种常见的矢量数据格式,本文将详细介绍如何使用C#读取SHP文件并实现地图显示功能,包括坐标转换、图形渲染、平... 目录概述功能特点核心代码解析1. 文件读取与初始化2. 坐标转换3. 图形绘制4. 地图交互功能缩放

Python动态处理文件编码的完整指南

《Python动态处理文件编码的完整指南》在Python文件处理的高级应用中,我们经常会遇到需要动态处理文件编码的场景,本文将深入探讨Python中动态处理文件编码的技术,有需要的小伙伴可以了解下... 目录引言一、理解python的文件编码体系1.1 Python的IO层次结构1.2 编码问题的常见场景二

python语言中的常用容器(集合)示例详解

《python语言中的常用容器(集合)示例详解》Python集合是一种无序且不重复的数据容器,它可以存储任意类型的对象,包括数字、字符串、元组等,下面:本文主要介绍python语言中常用容器(集合... 目录1.核心内置容器1. 列表2. 元组3. 集合4. 冻结集合5. 字典2.collections模块