图分割 Graph Partition 学习笔记1

文章目录


前言

最近在学习图论划分的方法,碰巧搜索到了这个算是对我而言全新的一个体系,在这里将逐步记载自己的学习资料和进度,希望和大家一起探讨~


一、graph-partition是什么?

图分割是将一个大图均匀的分成一系列的子图去适应分布式应用,每个子图存储在一台机器上,子图之间可以并行化执行,如果当前子图需要其他子图的信息就需要通讯开销,而图分割的质量影响着每台机器存储代价和机器之间通讯代价。

粗略地按照分割的内存开销大小分类,可以分为离线offline和流式streaming两类分割算法。offline是将整个图数据一次性载入内存中然后根据图的结构进行切分 ;streaming是按批次读取图数据,实时的将图的边或者结点分配到指定的子图中。对于大规模图数据来说,单机的内存无法满足分割算法的需求,这个时候流式分割显得尤为重要。

二、具体分类

按照对图数据的切分方式分类,可以分为边分区/点分割 (vertex-partition or edge-cut)和点分区/边分割(edge-partition or vertex-cut)有几个定义要注意下:

  • edge-cut(边分割)= vertex-partition(点分区)
  • vertex-cut(点分割)= edge-partition(边分区)

如下图所示,点分区/边分割 是将图的节点分配到各个子图中,维持结点之间子图的完整性,这个时候可能造成某些节点之间的边被切掉(edge-cut);同理边分区/点分割 是将图的边分配到各个子图中,每组分配的边构成子图,这个时候造成某些结点的冗余(vertex-cut)。对于服从幂律分布power-law的图数据,某些结点的边可能特别多,如果执行点分割会造成大量边的缺失以及边的负载不均匀;而边分割可以处理这类问题。

三、graph-partition的意义

  • 将一个图划分为若干子图以便在分布式系统中运行
  • 图划分的优化目标包括两项:负载均衡和最小割 (cut),二者都是为了提高在分布式系统中运算的性能。其中,负载均衡是为了使分布式系统中的多台计算机有相近的任务负荷,避免少数计算机负载过高。最小割则是为了减少计算机之间的通信代价。同时优化两个目标目前已知是NP困难问题。

参考链接

图分割Graph Partitioning技术总结

图流划分算法综述

【知识】如何区分图论中的点分割和边分割

相关推荐
YuanDaima204817 小时前
队列与单调队列基础原理与题目说明
人工智能·python·算法·leetcode·队列·手撕代码
董董灿是个攻城狮17 小时前
放风的 Claude 你怕不怕
算法
韩楚风17 小时前
PostgreSQL入门与进阶学习,体系化的SQL知识,完成终极目标高可用与容灾,性能优化与架构设计,以及安全策略
sql·学习·postgresql
亚空间仓鼠18 小时前
Python学习日志(四):实例
开发语言·python·学习
sealaugh3218 小时前
react native(学习笔记第二课) 英语打卡微应用(1)-开始构建
笔记·学习·react native
夜瞬18 小时前
NLP学习笔记03:文本分类——从 TF-IDF 到 BERT
笔记·学习·自然语言处理
Fanfanaas18 小时前
Linux 系统编程 进程篇 (二)
linux·运维·服务器·c语言·开发语言·学习
阿杰学AI18 小时前
AI核心知识122—大语言模型之 直接偏好优化(简洁且通俗易懂版)
人工智能·算法·机器学习·ai·强化学习·dpo·直接优化偏好
克里斯蒂亚诺·罗纳尔达18 小时前
智能体学习22——智能体间通信(A2A)
人工智能·学习·ai
kyle~18 小时前
BFS(广度优先搜索)与 DFS (深度优先搜索)
c++·算法·深度优先·宽度优先