一篇文章看懂Homogeneous Graph与Heterogeneous Graph,以及如何通过DGL定义数据与模型 进行Batch训练

本文主要是介绍一篇文章看懂Homogeneous Graph与Heterogeneous Graph,以及如何通过DGL定义数据与模型 进行Batch训练,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

Homogeneous Graph与Heterogeneous Graph

    • 提供图训练的小知识
    • Homogeneous Graph与Heterogeneous Graph的区别
    • 在DGL(Deep Graph Library) 定义 同构图
    • 在DGL(Deep Graph Library) 定义 异构图

提供图训练的小知识

在一张图进行训练时, 可能由于层数的增加,使得结点可以充分汇聚到其他结点的信息。
layer0: 直接连接的信息被汇聚。
layer1: 间接连接的结点被汇聚。
layer2: …
在这里插入图片描述

Homogeneous Graph与Heterogeneous Graph的区别

  1. Homogeneous Graph(同构图)

同构图是指所有节点和边都是同质的,即节点之间的连接方式相同,边的类型相同。在同构图中,所有节点和边都属于同一种类型。例如,社交网络中的好友关系图就是一个同构图,其中所有节点都代表用户,边代表用户之间的好友关系。
在 DGL 中,使用 dgl.graph() 函数可以创建同构图。同构图的创建可以直接从节点和边的张量数据中构建,所有的节点和边都具有相同的类型。

  1. Heterogeneous Graph(异构图)

异构图是指节点和边可以有不同的类型,节点之间的连接方式和边的类型可以不同。在异构图中,节点和边可以代表不同的实体或关系,具有多样性。例如,电子商务网站中的商品-用户-类别三元关系图就是一个异构图,其中节点分为商品、用户和类别三种类型,边代表商品与用户之间的购买关系以及商品与类别之间的归属关系。
在 DGL 中,使用 dgl.heterograph() 函数可以创建异构图。异构图的创建需要指定不同类型的节点和边,以及它们之间的连接关系。

在DGL(Deep Graph Library) 定义 同构图

  1. 初始化图数据

初始化数据

import dgl
import torch# 初始化图列表
graph_list = []# 构建每组对话的图
for _ in range(batchsize):# 假设每组对话有5个句子num_sentences = 5sentence_features = torch.randn(num_sentences, 768)  # 句子级特征# 添加句子级节点g.add_nodes(num_sentences, {'sentence_feat': sentence_features})g.add_edges([xxxx], [xxxx])  # 添加结点 ([起始结点],[终端结点])# 将图添加到图列表中graph_list.append(g)# 批次化图
batched_graph = dgl.batch(graph_list)
  1. 定义同构图GCN
import dgl
import torch
import torch.nn as nn
import torch.optim as optim
from torch.utils.data import DataLoader# 定义一个简单的GCN模型
class GCN(nn.Module):def __init__(self, in_feats, hidden_size, out_feats):super(GCN, self).__init__()self.conv1 = dgl.nn.GraphConv(in_feats, hidden_size)self.conv2 = dgl.nn.GraphConv(hidden_size, out_feats)def forward(self, g, features):x = torch.relu(self.conv1(g, features))x = self.conv2(g, x)return x

在DGL(Deep Graph Library) 定义 异构图

  1. 初始化图数据

初始化数据

import dgl
import torch# 初始化一个空的异构图列表
hetero_graph_list = []# 遍历每组对话数据,构建异构图
for _ in range(batchsize):# 初始化一个异构图对象 ([xxx], [xxx] 表示 起始结点)g = dgl.heterograph({('结点类型1', '关系', '结点类型2'): ([xxx], [xxx]),('结点类型1', '关系', '结点类型3'): ([xxx], [xxx]),('结点类型2', '关系', '结点类型3'): ([xxx], [xxx]),})# 添加节点特征g.nodes['结点类型1'].data['feat'] = 结点类型1特征g.nodes['结点类型2'].data['feat'] = 结点类型2特征g.nodes['结点类型3'].data['feat'] = 结点类型3特征# 将图对象添加到异构图列表中hetero_graph_list.append(g)# 使用 dgl.batch_hetero() 函数将异构图列表批次化
batched_hetero_graph = dgl.batch_hetero(hetero_graph_list)
  1. 定义异构图网络结构
import dgl
import torch
import torch.nn as nn
import torch.nn.functional as Fclass HeteroGCN(nn.Module):def __init__(self, in_feats, hidden_feats, out_feats):super(HeteroGCN, self).__init__()# 定义每种节点类型的图卷积层self.conv1 = dgl.nn.HeteroGraphConv({'结点类型1': dgl.nn.GraphConv(in_feats['结点类型1'], hidden_feats),'结点类型2': dgl.nn.GraphConv(in_feats['结点类型2'], hidden_feats),'结点类型3': dgl.nn.GraphConv(in_feats['结点类型3'], hidden_feats)})self.conv2 = dgl.nn.HeteroGraphConv({'结点类型1': dgl.nn.GraphConv(hidden_feats, out_feats),'结点类型2': dgl.nn.GraphConv(hidden_feats, out_feats),'结点类型3': dgl.nn.GraphConv(hidden_feats, out_feats)})def forward(self, g, node_features):# 执行第一层异构图卷积h = self.conv1(g, node_features)# 应用激活函数h = {k: F.relu(h[k]) for k in h.keys()}# 执行第二层异构图卷积h = self.conv2(g, h)return h

这篇关于一篇文章看懂Homogeneous Graph与Heterogeneous Graph,以及如何通过DGL定义数据与模型 进行Batch训练的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/903792

相关文章

Nginx中配置使用非默认80端口进行服务的完整指南

《Nginx中配置使用非默认80端口进行服务的完整指南》在实际生产环境中,我们经常需要将Nginx配置在其他端口上运行,本文将详细介绍如何在Nginx中配置使用非默认端口进行服务,希望对大家有所帮助... 目录一、为什么需要使用非默认端口二、配置Nginx使用非默认端口的基本方法2.1 修改listen指令

MySQL按时间维度对亿级数据表进行平滑分表

《MySQL按时间维度对亿级数据表进行平滑分表》本文将以一个真实的4亿数据表分表案例为基础,详细介绍如何在不影响线上业务的情况下,完成按时间维度分表的完整过程,感兴趣的小伙伴可以了解一下... 目录引言一、为什么我们需要分表1.1 单表数据量过大的问题1.2 分表方案选型二、分表前的准备工作2.1 数据评估

MySQL进行分片合并的实现步骤

《MySQL进行分片合并的实现步骤》分片合并是指在分布式数据库系统中,将不同分片上的查询结果进行整合,以获得完整的查询结果,下面就来具体介绍一下,感兴趣的可以了解一下... 目录环境准备项目依赖数据源配置分片上下文分片查询和合并代码实现1. 查询单条记录2. 跨分片查询和合并测试结论分片合并(Shardin

SpringBoot结合Knife4j进行API分组授权管理配置详解

《SpringBoot结合Knife4j进行API分组授权管理配置详解》在现代的微服务架构中,API文档和授权管理是不可或缺的一部分,本文将介绍如何在SpringBoot应用中集成Knife4j,并进... 目录环境准备配置 Swagger配置 Swagger OpenAPI自定义 Swagger UI 底

基于Python Playwright进行前端性能测试的脚本实现

《基于PythonPlaywright进行前端性能测试的脚本实现》在当今Web应用开发中,性能优化是提升用户体验的关键因素之一,本文将介绍如何使用Playwright构建一个自动化性能测试工具,希望... 目录引言工具概述整体架构核心实现解析1. 浏览器初始化2. 性能数据收集3. 资源分析4. 关键性能指

Nginx进行平滑升级的实战指南(不中断服务版本更新)

《Nginx进行平滑升级的实战指南(不中断服务版本更新)》Nginx的平滑升级(也称为热升级)是一种在不停止服务的情况下更新Nginx版本或添加模块的方法,这种升级方式确保了服务的高可用性,避免了因升... 目录一.下载并编译新版Nginx1.下载解压2.编译二.替换可执行文件,并平滑升级1.替换可执行文件

Python进行JSON和Excel文件转换处理指南

《Python进行JSON和Excel文件转换处理指南》在数据交换与系统集成中,JSON与Excel是两种极为常见的数据格式,本文将介绍如何使用Python实现将JSON转换为格式化的Excel文件,... 目录将 jsON 导入为格式化 Excel将 Excel 导出为结构化 JSON处理嵌套 JSON:

一文解密Python进行监控进程的黑科技

《一文解密Python进行监控进程的黑科技》在计算机系统管理和应用性能优化中,监控进程的CPU、内存和IO使用率是非常重要的任务,下面我们就来讲讲如何Python写一个简单使用的监控进程的工具吧... 目录准备工作监控CPU使用率监控内存使用率监控IO使用率小工具代码整合在计算机系统管理和应用性能优化中,监

如何使用Lombok进行spring 注入

《如何使用Lombok进行spring注入》本文介绍如何用Lombok简化Spring注入,推荐优先使用setter注入,通过注解自动生成getter/setter及构造器,减少冗余代码,提升开发效... Lombok为了开发环境简化代码,好处不用多说。spring 注入方式为2种,构造器注入和setter

MySQL进行数据库审计的详细步骤和示例代码

《MySQL进行数据库审计的详细步骤和示例代码》数据库审计通过触发器、内置功能及第三方工具记录和监控数据库活动,确保安全、完整与合规,Java代码实现自动化日志记录,整合分析系统提升监控效率,本文给大... 目录一、数据库审计的基本概念二、使用触发器进行数据库审计1. 创建审计表2. 创建触发器三、Java