GRN前沿:STGRNS:一种基于transformer的可解释方法,用于从单细胞转录组数据推断基因调控网络

1.论文原名:STGRNS: an interpretable transformer-based method for inferring gene regulatory networks from single-cell transcriptomic data

2.发表日期:2023.4.2

摘要:

动机:单细胞RNA测序(scRNA-seq)技术提供了一个推断细胞特异性基因调控网络(GRNs)的机会,这是系统生物学中的一个重要挑战。尽管已经开发了许多方法来从scRNA-seq数据推断GRNs,但是处理细胞异质性仍然是一个挑战。结果:为了解决这一难题,我们开发了一种可解释的基于转化子的方法,即STGRNS,用于从scRNA-seq数据中推断GRNs。该算法采用基因表达基序技术,将基因对转化为相邻的子向量,作为Transformer编码器的输入。通过避免网络中缺失阶段特异性调控,基因表达基序可以提高不同类型scRNA-seq数据的GRN推断的准确性。为了评估STGRNS的性能,我们在21个静态和27个时间序列scRNAseq数据集上与一些常用的方法进行了对比实验。实验结果表明,STGRNS方法具有较上级的性能.;此外,STGRNS也被证明比"黑箱"深度学习方法更具可解释性,而"黑箱"深度学习方法以难以清晰解释预测而闻名。

1. 研究背景与动机

  • 单细胞RNA测序(scRNA-seq)技术为在单细胞水平上研究基因调控机制提供了可能,但推断细胞特异性的基因调控网络(GRNs)仍然是系统生物学中的一个重要挑战。

  • 现有的GRNs推断方法分为无监督方法和有监督方法,但这些方法在处理单细胞数据的异质性时存在局限性,例如高稀疏性、噪声和dropout事件,限制了其准确性。

2. STGRNS方法框架

STGRNS的整体框架包括四个主要模块:基因表达模式(GEM)模块、位置编码层、Transformer编码器和分类层。以下是各模块的具体功能和实现方式:

1. 基因表达模式(Gene Expression Motif, GEM)模块

功能

GEM模块的核心功能是将基因对的表达数据转换为适合Transformer编码器输入的格式。它通过将基因表达向量分割为连续的子向量,并将同一基因对的子向量拼接成新的向量,从而保留基因表达的同步性特征。

  • 优势

    • 保留基因表达同步性:通过将基因对的子向量拼接,GEM能够保留基因表达的同步性特征,这对于推断基因调控关系至关重要。

    • 提高模型输入效率:将基因对转换为连续的子向量形式,使得Transformer编码器能够更有效地处理输入数据。

2. 位置编码层

功能

位置编码层的目的是在将基因对输入Transformer编码器时,保留基因表达向量的顺序或时间信息。这对于处理时间序列数据或具有伪时间顺序的单细胞数据尤为重要。

  • 优势

    • 保留时间信息:位置编码能够使模型捕捉到基因表达的时间或顺序信息,这对于推断基因调控网络至关重要。

    • 增强模型性能:通过引入位置信息,模型能够更好地理解基因表达的动态变化,从而提高推断的准确性。

3. Transformer编码器

功能

Transformer编码器的主要功能是计算不同子向量之间的相关性,并关注关键子向量。它通过多头自注意力机制和前馈网络来提取基因对的交互信息。

  • 优势

    • 并行处理:Transformer编码器能够并行处理输入数据,提高计算效率。

    • 全局信息捕捉:多头自注意力机制允许模型在多个不同的投影空间中捕捉基因对的交互信息,从而提高推断的准确性。

    • 关注关键特征:通过自注意力机制,模型能够自动关注对基因调控关系推断更为关键的子向量。

4. 分类层

功能

分类层的目的是根据Transformer编码器的输出,对基因对是否具有调控关系进行分类。它将编码器提取的特征用于最终的调控关系预测。

  • 优势

    • 简洁高效:分类层结构简单,但能够有效地将编码器提取的特征用于最终的调控关系预测。

    • 可解释性:通过分析分类层的输出,可以解释模型的预测结果,例如哪些子向量对最终预测结果的影响最大。

相关推荐
宸津-代码粉碎机5 分钟前
Redis 进阶:跳出缓存局限!7 大核心场景的原理与工程化实践
java·人工智能·redis·python
wan5555cn7 分钟前
AI视频生成技术:从想象到现实的视觉革命
人工智能·笔记·深度学习·算法·音视频
MYZR17 分钟前
蓝牙音箱的技术演进:从便捷到高保真的音频革命
人工智能·物联网·音视频·ssd2351
liaomin41610056912 分钟前
transformers音频实战01-音频概念
人工智能·音视频
IT_陈寒12 分钟前
Python 3.12 性能暴增50%!这5个新特性让老项目直接起飞
前端·人工智能·后端
极客代码19 分钟前
第五篇:后端优化——位姿图的灵魂--从图优化到滑动窗口的联合状态估计
python·深度学习·计算机视觉·视觉里程计·slam·回环检测·地图构建
charieli-fh23 分钟前
LoRA 高效微调大语言模型全流程:从原理、实践到参数调优
人工智能·深度学习·大模型·大语言模型
星川皆无恙31 分钟前
知识图谱之深度学习:基于 BERT+LSTM+CRF 驱动深度学习识别模型医疗知识图谱问答可视化分析系统
大数据·人工智能·深度学习·bert·知识图谱
XIAO·宝5 小时前
深度学习------专题《图像处理项目》终!
人工智能·深度学习
铁手飞鹰6 小时前
从零复现论文:深度学习域适应1
linux·pytorch·python·深度学习·ubuntu·ai·迁移学习