基于图的在线社区假新闻检测建模

论文原文:Graph-based Modeling of Online Communities for Fake News Detection

论文代码:GitHub - shaanchandra/SAFER: Repository containing the official code for the paper Graph-based Modeling of Online Communities for Fake News Detection.

  1. 作者构建了一个由两种节点和边组成的异构图,并在半监督图学习设置中将它们建模在一起。2. 作者没有进行用户分析,而是计算社区范围的社交上下文特征,这在之前没有相关工作调查过在线社区在假新闻检测中的作用。3. 为了获得社区的作用,作者仅使用了有关用户网络的信息,而不使用用户个人资料中的个人信息。4. 由于没有使用用户个人资料信息,如地址,种族,性别。因此它们不会学习将特定人群与特定的在线行为联系起来。

方法:

构建community graph

对于每一个数据集,都创建了一个异构community graph,其中包括两种节点:用户节点和文章节点。文章节点由二进制词袋(BOW)向量表示即,其中|v|是词汇的数量,。用户节点由二进制 BOW 向量表示,该向量是在他们共享的所有文章上构造的:,其中|表示逐位与操作,M表示用户分享的文章总数。接下来,我们添加两种类型的无向边:1. 如果用户在推文/转发了文章,则在用户和文章节点之间添加边(因此文章节点可以连接到多个用户节点)2. 如果两个用户节点之间在Twitter上互相关注,则在两个用户节点之间添加无向边。

作者在"最活跃的N个用户"(HealthStory 的 N=20K,GossipCop 的 N=30K)上进行了操作。为了避免频繁使用的用户使模型产生偏见,我们排除了在任一类中分享超过 30 百分比文章的用户。在GossipCop数据集上,最终的图有29962个用户节点,16766个文章节点和超过1.2M条边。

SAFER:虚假新闻检测架构

提出的框架(详见下文,如图 1 所示)在其中采用了两个组件,即基于图形和文本的编码器,其工作可以分为两个阶段:训练和测试。

图1: SAFER 框架的可视化表示。图形和文本编码器是独立训练的,然后是逻辑回归 (LR) 分类器的训练。在推理过程中,文章的文本以及有关其用户社交网络的信息分别由经过训练的文本和图形编码器进行编码。最后,使用经过训练的LR分类器将文章的社会背景和文本特征连接起来进行分类。

训练阶段: 首先在数据集上分别训练图编码器和文本编码器。文本编码器的输入是文章的内容,并且其被训练成一个文章分类器用于区分文章是否是虚假信息。训练后的文本编码器生成基于文章内容的文本特征其中是文本编码器的隐藏维度。图编码器是一个图神经网络,把community graph作为输入。GNN 使用来自文章节点的监督损失进行训练,该损失反向传播到网络的其余部分。经过训练的 GNN 能够生成一组用户嵌入,其中是图编码器的隐藏维度,且m是与文章交互的用户数量。然后,通过归一化和将这些用户表示聚合成一个固定大小的向量,:m:,其中表示表章的社会上下文特征。文章的最终社会上下文感知表示计算为 是串联运算符。这种聚合形式有助于 SAFER 保留每个表示形式编码的有关共享内容不同方面的信息。最终,被用于训练逻辑回归分类器。直观地说,经过训练的文本编码器从内容中捕获对任务至关重要的语言线索。同样,经过训练的图形编码器会根据用户的内容分享模式和社交关系,学习将用户分配到隐式在线社区。

测试阶段: 为了将未知的内容分类为虚假或真实,SAFER将文章的文本以及与之交互的用户网络作为输入。然后,它遵循与上面详述的相同的过程来生成待验证测试文章的社会上下文感知表示,并使用经过训练的 LR 分类器对其进行分类。

文本编码器

作者在SAFER中尝试了两种不同的架构作为文本编码器:

**卷积神经网络(CNN):**作者在文档上采用了句子级编码器Kim(2014)。该模型使用多个不同大小的一维卷积滤波器,这些滤波器通过在文章的长度上滑动来聚合信息。最终的固定长度文章表示是通过对特征图进行最大随时间变化的池化获得的。

**BoBERTa:**作为我们主要的文本编码器,我们微调了transformer编码器结构RoBERTa Liu et al. ( 2019b),并将其用于文章类别分析。RoBERTa 是一种使用动态掩码进行预训练的语言模型。具体来说,我们用它来编码每篇文章的前 512 个token,并使用 cls 标记作为文章嵌入进行分类。

图编码器

我们尝试了六种不同的 GNN 架构来生成用户嵌入,详情如下:

图卷积网络(GCN): GCNs Kipf and Welling (2016)把一个由其邻接矩阵n表示图中节点数,度矩阵D其中,和特征矩阵(包含节点的 m -维特征向量的特征矩阵)定义的图 𝒢 作为输入,GCN 在第i个卷积层的递归传播步长由下式给出:,其中σ表示激活函数,是度归一化的邻接矩阵,是第i层卷积层的权重矩阵,表示前面卷积层的输出, ti是第i层中隐藏单元的个数,其中

Graph Attention Networks (GAT): GAT

GraphSAGE: GraphSAGE

Relational GCN/GAT: https://doi.org/10.48550/arXiv.1703.06103

Hyperbolic GCN / GAT: HGCNHNN

相关推荐
倔强的石头10617 分钟前
【深度学习】神经网络前向传播与反向传播推导
人工智能·深度学习·神经网络
2601_9622955819 分钟前
Python UI自动化测试用例脚本编写指南
python·测试用例·uiautomator2·ui自动化测试·脚本编写
重生之小比特30 分钟前
【Java SE】数据类型与变量
java·开发语言·python
LadenKiller36 分钟前
先分清阶段,再让工具帮量化学习
人工智能·python
WeiXin_DZbishe38 分钟前
基于springboot大学生提问箱系统-计算机毕设【课程设计】72593
javascript·vue.js·spring boot·vscode·python·node.js·php
jsjzsl239 分钟前
独立自由度框架下位置自由度的本体论特征、物理现象与新技术路径
python·flask·fastapi
z_mazin43 分钟前
逆向一种私有二进制序列化格式:从零到字节级解析器
网络·python·网络协议·算法·rpc
威联通安全存储1 小时前
TS-h1290FX 在模具制造设计与CAM场景的部署
python·制造
liliangcsdn1 小时前
IC计算-前向/远期收益计算和代码示例
开发语言·python·pandas
HAHAXX81 小时前
RPA 架构设计详解:大模型集成下,如何融合 NLP、OCR 处理非结构化数据
自然语言处理·ocr·rpa