【图神经网络】 - GNN的几个模型及论文解析（NN4G、GAT、GCN）|电子爱好者

admin管理员组
文章数量:1623572

图神经网络

图神经网络（Graph Neural Network，GNN）是指使用神经网络来学习图结构数据，提取和发掘图结构数据中的特征和模式，满足聚类、分类、预测、分割、生成等图学习任务需求的算法总称。

Neural Network for Graphs（NN4G）

论文信息

Neural Network for Graphs: A ContextualConstructive Approach

原文地址：ieeexplore.ieee/abstract/do…

摘要

This paper presents a new approach for learning in structured domains (SDs) using a constructive neural network for graphs (NN4G). The new model allows the extension of the input domain for supervised neural networks to a general class of graphs including both acyclic/cyclic, directed/undirected labeled graphs. In particular, the model can realize adaptive contextual transductions, learning the mapping from graphs for both classification and regression tasks. In contrast to previous neural networks for structures that had a recursive dynamics, NN4G is based on a constructive feedforward architecture with state variables that uses neurons with no feedback connections. The neurons are applied to the input graphs by a general traversal process that relaxes the constraints of previous approaches derived by the causality assumption over hierarchical input data. Moreover, the incremental approach eliminates the need to introduce cyclic dependencies in the definition of the system state variables. In the traversal process, the NN4G units exploit (local) contextual information of the graphs vertices. In spite of the simplicity of the approach, we show that, through the compositionality of the contextual information developed by the learning, the model can deal with contextual information that is incrementally extended according to the graphs topology. The effectiveness and the generality of the new approach are investigated by analyzing its theoretical properties and providing experimental results.

本文提出了一种利用构造性神经网络( NN4G )学习结构化领域( SD )的新方法。新模型允许将有监督神经网络的输入域扩展到包括无环/循环、有向/无向标记图的一般图类。特别地，该模型可以实现自适应的上下文转换，从图中学习分类和回归任务的映射。与以往针对具有递归动态结构的神经网络不同，NN4G基于具有状态变量的构造性前馈架构，使用无反馈连接的神经元。通过一个通用的遍历过程将神经元应用到输入图中，该过程放松了先前基于因果关系假设分层输入数据得到的方法的约束。此外，增量方法消除了在系统状态变量的定义中引入循环依赖关系的需要。在遍历过程中，NN4Gunits利用图顶点的(局部)上下文信息。尽管该方法简单，但我们表明，通过学习开发的上下文信息的组合性，该模型可以处理根据图的拓扑结构增量扩展的上下文信息。通过分析其理论性质和提供实验结果，研究了新方法的有效性和通用性。

NN4G模型思想

对于一个输入图，如下图所示：其中，vi表示节点，xi表示每个节点对应的特征信息。

然后通过隐藏层进行特征学习并更新每个节点的特征信息，更新过程如下：

对于第一个隐藏层： 将节点的特征信息更新为，其中layer表示当前是第几层，node表示对应哪个节点。

h = w * x, w为一个权重，x为输入时节点的特征信息。

然后对每个节点都做同样的更新，就得到： 对于其他隐藏层，在第一个隐藏层的基础上再做如下更新：即，先将节点邻居的特征加起来，乘上一个权重W，然后再加上节点本身的特征。

还是对每个节点做同样的更新就可以得到一个隐藏层的表示。

在叠加了多层之后，就可以对节点特征信息进行Readout，来代表整个图的特征信息，做法如下：即，将每个节点对应每一层的特征信息相加求平均值，再乘上一个权重，并相加，就得到最后的结果y。

Graph Attention Network（GAT）

论文信息

GRAPH ATTENTION NETWORKS

原文地址：arxiv/pdf/1710.10…

摘要

We present graph attention networks (GATs), novel neural network architectures that operate on graph-structured data, leveraging masked self-attentional layers to address the short comings of prior methods based on graph convolutions or their approximations. By stacking layers in which nodes are able to attend over their neighborhoods’ features, we enable (implicitly) specifying different weights todifferent nodes in a neighborhood, without requiring any kind of costly matrix operation (such as inversion) or depending on knowing the graph structure upfront.In this way, we address several key challenges of spectral-based graph neural net-works simultaneously, and make our model readily applicable to inductive as wellas transductive problems. Our GAT models have achieved or matched state-of-the-art results across four established transductive and inductive graph benchmarks:the Cora, Citeseer and Pubmed citation network datasets, as well as a protein-protein interaction dataset (wherein test graphs remain unseen during training)

我们提出了图注意力网络( Graph Attention Networks，GATs )，它是一种新颖的神经网络架构，可以在图结构数据上运行，利用掩蔽的自注意力层来解决基于图卷积或其近似的先验方法的缺点。通过将节点能够处理其邻域特性的层进行堆叠，我们可以(隐式地)为邻域中的不同节点指定不同的权重，而不需要任何昂贵的矩阵运算(例如反转)，也不需要预先知道图结构。通过这种方式，我们同时解决了基于谱的图神经网络的几个关键挑战，并使我们的模型易于适用于归纳和转导问题。我们的GAT模型在四个公认的直推式和归纳式图形基准上取得或匹配了最先进的结果：Cora、Citeseer和Pubmed引文网络数据集，以及蛋白质-蛋白质相互作用数据集。

GAT模型思想

对于输入图用h表示每个节点的特征信息：其中，N为节点的数量。

经过一个隐藏层之后，得到一层新的节点特征： 特征信息更新过程如下：

为了获得足够的表达能力，将输入特征通过至少一个可学习的线性变换，转换为更高层次的特征Wi。
通过一个注意力机制，计算得到一个注意力系数：

eij 表示节点j 的特征对节点i 的重要性。a表示注意力机制，是一个单层前馈神经网络。

对节点的每一个邻居计算一个注意力系数（邻居节点对该节点的重要性），然后使用softmax进行归一化处理。 Ni 表示节点i的邻居节点。
得到归一化的注意力系数之后，再通过对邻接节点特征的线性组合经过一个非线性激活函数来更新节点自身的特征作为输出：

Graph Convolutional Networks（GCN）

论文信息

原文地址：arxiv/abs/1609.02…

摘要

We present a scalable approach for semi-supervised learning on graph-structured data that is based on an efficient variant of convolutional neural networks which operate directly on graphs. We motivate the choice of our convolutional archi-tecture via a localized first-order approximation of spectral graph convolutions.Our model scales linearly in the number of graph edges and learns hidden layer representations that encode both local graph structure and features of nodes. Ina number of experiments on citation networks and on a knowledge graph dataset we demonstrate that our approach outperforms related methods by a significant margin.

我们提出了一种可扩展的基于图结构数据的半监督学习方法，该方法基于直接在图上运行的卷积神经网络的有效变体。我们通过谱图卷积的局部一阶近似来激励我们的卷积架构的选择。我们的模型以图边数线性扩展，并学习隐藏层表示，这些表示同时编码局部图结构和节点特征。在引文网络和知识图谱数据集上的大量实验表明，我们的方法优于相关方法。

GCN模型思想

对于一个输入图，他有N个节点，每个节点的特征组成一个特征矩阵X，节点与节点之间的关系组成一个邻接矩阵A，X和A即为模型的输入。

GCN是一个神经网络层，它具有以下逐层传播规则：

其中，

˜A = A + I，A为输入图的领接矩阵，I为单位矩阵。
˜D为˜A的度矩阵，˜Dii = ∑j ˜Aij
H是每一层的特征，对于输入层H = X
σ是非线性激活函数
W为特定层的可训练权重矩阵

经过多层GCN逐层传播，输入图的特征矩阵由X变为Z，但邻接矩阵A始终保持共享，如下图：然后，根据带有标签的节点计算cross-entropy损失：其中，表示具有标签的节点索引的集合。

并采用梯度下降法训练神经网络权值W 。

如何学习大模型 AI ？

由于新岗位的生产效率，要优于被取代岗位的生产效率，所以实际上整个社会的生产效率是提升的。

但是具体到个人，只能说是：

“最先掌握AI的人，将会比较晚掌握AI的人有竞争优势”。

这句话，放在计算机、互联网、移动互联网的开局时期，都是一样的道理。

我在一线互联网企业工作十余年里，指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家，也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑，所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限，很多互联网行业朋友无法获得正确的资料得到学习提升，故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

😝有需要的小伙伴，可以点击下方链接免费领取或者V扫描下方二维码免费领取🆓

第一阶段（10天）：初阶应用

该阶段让大家对大模型 AI有一个最前沿的认识，对大模型 AI 的理解超过 95% 的人，可以在相关讨论时发表高级、不跟风、又接地气的见解，别人只会和 AI 聊天，而你能调教 AI，并能用代码将大模型和业务衔接。

大模型 AI 能干什么？
大模型是怎样获得「智能」的？
用好 AI 的核心心法
大模型应用业务架构
大模型应用技术架构
代码示例：向 GPT-3.5 灌入新知识
提示工程的意义和核心思想
Prompt 典型构成
指令调优方法论
思维链和思维树
Prompt 攻击和防范
…

第二阶段（30天）：高阶应用

该阶段我们正式进入大模型 AI 进阶实战学习，学会构造私有知识库，扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架，抓住最新的技术进展，适合 Python 和 JavaScript 程序员。

为什么要做 RAG
搭建一个简单的 ChatPDF
检索的基础概念
什么是向量表示（Embeddings）
向量数据库与向量检索
基于向量检索的 RAG
搭建 RAG 系统的扩展知识
混合检索与 RAG-Fusion 简介
向量模型本地部署
…

第三阶段（30天）：模型训练

恭喜你，如果学到这里，你基本可以找到一份大模型 AI相关的工作，自己也能训练 GPT 了！通过微调，训练自己的垂直大模型，能独立训练开源多模态大模型，掌握更多技术方案。

到此为止，大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗？

为什么要做 RAG
什么是模型
什么是模型训练
求解器 & 损失函数简介
小实验2：手写一个简单的神经网络并训练它
什么是训练/预训练/微调/轻量化微调
Transformer结构简介
轻量化微调
实验数据集的构建
…

第四阶段（20天）：商业闭环

对全球大模型从性能、吞吐量、成本等方面有一定的认知，可以在云端和本地等多种环境下部署大模型，找到适合自己的项目/创业方向，做一名被 AI 武装的产品经理。

硬件选型
带你了解全球大模型
使用国产大模型服务
搭建 OpenAI 代理
热身：基于阿里云 PAI 部署 Stable Diffusion
在本地计算机运行大模型
大模型的私有化部署
基于 vLLM 部署大模型
案例：如何优雅地在阿里云私有部署开源大模型
部署一套开源 LLM 项目
内容安全
互联网信息服务算法备案
…

学习是一个过程，只要学习就会有挑战。天道酬勤，你越努力，就会成为越优秀的自己。

如果你能在15天内完成所有的任务，那你堪称天才。然而，如果你能完成 60-70% 的内容，你就已经开始具备成为一名大模型 AI 的正确特征了。

这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【`保证100%免费`】

😝有需要的小伙伴，可以Vx扫描下方二维码免费领取==🆓

本文标签：几个神经网络模型论文 GNN

版权声明：本文标题：【图神经网络】 - GNN的几个模型及论文解析（NN4G、GAT、GCN）内容由热心网友自发贡献，该文观点仅代表作者本人，转载请联系作者并注明出处：https://m.elefans.com/dongtai/1728889304a1177914.html，本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容，一经查实，本站将立刻删除。

电子爱好者 - 最新技术资讯及电子产品介绍！

【图神经网络】 - GNN的几个模型及论文解析（NN4G、GAT、GCN）

图神经网络

Neural Network for Graphs（NN4G）

论文信息

摘要

NN4G模型思想

Graph Attention Network（GAT）

论文信息

摘要

GAT模型思想

Graph Convolutional Networks（GCN）

论文信息

摘要

GCN模型思想

如何学习大模型 AI ？

第一阶段（10天）：初阶应用

第二阶段（30天）：高阶应用

第三阶段（30天）：模型训练

第四阶段（20天）：商业闭环

这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

更多相关文章

细说OSI七层协议模型及OSI参考模型中的数据封装过程？

主动领域自适应(Active Domain Adaptation)部分经典论文汇总

【补充知识】生成模型（generative model）和判别模型（discriminative model）、贝叶斯学派和概率学派

TensorRT实战：离线环境配置与模型量化详解(二)

【论文阅读 07】Anomaly region detection and localization in metal surface inspection

CVPR2022最新106篇论文整理｜包含目标检测、动作识别、图像处理等32个方向

论文笔记-------Topological sound

CVPR 2022 最新106篇论文分方向整理｜包含目标检测、动作识别、图像处理等32个方向

Transformer论文翻译与理解

论文速递 | Operations Research 6月文章合集

深度科技探索：从英语词汇到神经网络结构

论文解读：Attention Is All You Need

Transformer论文解读和Bert模型架构

Bi-Branch Vision Transformer Network for EEG Emotion Recognition论文翻译

weak supervised object detection论文阅读

CLIP论文翻译、Learning Transferable Visual Models From Natural Language Supervision翻译

训练神经网络的秘诀

优化｜运筹学应用之顶刊Operations Research论文综述(68(6)期)

论文阅读笔记（11）--- Attention is all you need（Transformer）逐段精读

【论文翻译】Meta R-CNN : Towards General Solver for Instance-level Low-shot Learning

发表评论

推荐文章

【转载】别人是怎么破解你们家无线密码的

esp32 wifi部分总结 sta模式下常用的和能够实现的功能

linux下用dd命令拷贝硬盘

全能ADC，你应该这样用

web登录界面设计_出色的Web界面设计的7条规则

热门文章

如何创建Windows下google Chrome便携版？

7、无线wifi传输视频开发

数据中台，概念炒作还是另有奇效？ | TVP思享

万能pdf阅读器卸载

Excel 之 VBA 入门学习代码详解笔记（2）

U盘被写保护不能重新格式化

用网线给服务器装系统,只用网线从零开始安装系统

少儿编程真是荒谬_建立第一个Web应用程序的6个荒谬想法

win10需要来自计算机管理员的权限才能,Win10明明是管理员却还需要权限怎么办？一招轻松解决它...

Modern Recurrent Neural Networks

最新文章

Ubuntu20.04 安装星火商店安装Windows等应用

UOS 商店已过期试用

破解华强北子腾系统手表应用商店应用和主题商店表盘，实现表盘自由！

Ubuntu软件下载速度慢解决

ubuntu18.04 下载软件速度慢的解决办法

【Android工具】盘点几个有应用历史版本功能的应用商店

关于如何下载干净-无广告的常用软件

华为metebook电脑如何修改应用商店中新应用的默认安装路径

[linux]深度软件中心无法下载软件的临时解决办法

ipa下载安装神器？苹果软件这么容易就被搞定了

Google商店中下载安兔兔评测，后下载3D资源插件，提示“您的设备与此版本不兼容”

解决Microsoft Store无法下载软件问题

应用商店打开服务器错误,应用商店出错的修复方法

windows 没有应用商店，直接安装所需应用的解决方案

如何把microsoft store里面的软件添加到桌面

小米手机肿么还原时钟

15000流明是多少瓦

一般普通投影机功率多大?

苹果绿联转换器有些投影机不能用

这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【`保证100%免费`】

【鬼泣5（Devil May Cry V）v1.0十四项修改】鬼泣5（Devil May Cry V）v1.0十四项修改官方免费下载