论文GAN(GRAPH ATTENTION NETWORKS)阅读笔记

简略版理解

背景

当前的局限性:

CNN数据具有规则的网格结构,但现实数据往往是不规则的(即图结构)

本文的核心思想:

每个节点在计算表示时:对邻居节点进行 attention 加权

GAT 架构

GAT 通过堆叠多个图注意力层构建深层网络,每一层都会对节点及其邻居的特征进行加权聚合

GAT 的计算流程

每一层:

线性变换

对所有节点的输入特征进行一次共享的线性变换

计算邻居 attention

在得到新的特征表示后,模型会为每个节点计算其与邻居节点之间的注意力系数,所有邻居的注意力系数会通过Softmax 函数进行归一化

加权聚合

在得到注意力权重后,节点会对所有邻居节点的特征进行加权求和:

  • 权重越大的邻居,对节点表示的贡献越大

  • 权重较小的邻居影响会被削弱

激活函数

Multi-head attention

用多个 attention:

  • 稳定训练

  • 提高表达能力

GCN:

邻居平均

GraphSAGE:

邻居聚合

GAT:

邻居加权(attention)

相关推荐
WoooChi37 分钟前
DailyTech-20260724
人工智能·科技·业界资讯
zh路西法42 分钟前
【CAM Grad-CAM Grad-CAM++】深度学习模型可解释性:从原理到YOLOv8部署实战
人工智能·深度学习·yolo·yolov8·grad-cam·cam
雨辰AI1 小时前
全集实战:企业级大模型服务化部署全栈指南|FastAPI 封装 + Nginx 负载均衡 + 高可用架构 从单机到生产一步到位
人工智能·ai·负载均衡·fastapi·ai编程
触底反弹1 小时前
Vibe Coding 不写 Git,等于悬崖边飙车
人工智能·git·面试
FoldWinCard1 小时前
D5 Linux 网络及端口命令
linux·运维·服务器
咖啡屋和酒吧2 小时前
健康管理:现代生活的科学守护
人工智能·生活·精选
星栈独行2 小时前
翻完 Pi 源码:它和 Codex、Claude Code 有何不同
开发语言·javascript·人工智能·程序人生
没有梦想的咸鱼185-1037-16632 小时前
AI-Python机器学习与深度学习技术:CNN/Transformer/扩散模型、SHAP可解释及Hermes智能体自动化
人工智能·python·深度学习·机器学习·chatgpt·cnn·transformer
船漏了就会沉2 小时前
Kimi K3 vs DeepSeek-V4:国产大模型的技术路线之争
人工智能
kirs_ur2 小时前
SSD 在 AI 训练中的角色
大数据·服务器·人工智能