利用MetaNeighbor验证重复性和跨物种分群

进行跨物种研究时,我们经常需要进行注释结果的比较和归类,或者同一物种不同样本之间的注释验证。R语言中有一个包就可以利用直观的热图展示这一需求。

导入包和环境

R 复制代码
library(Seurat)
library(ggplot2)
library(MetaNeighbor)
library(SingleCellExperiment)
library(dplyr)

导入数据

这里以海豚和两个公开人的PFC脑区单细胞转录组数据为例

R 复制代码
hm <- readRDS('human_sci_EXN.rds')
DefaultAssay(hm) <- 'RNA'
hm@meta.data$species <- 'human'
hm2 <- readRDS('human_2_EXN.rds')
DefaultAssay(hm2) <- 'RNA'
hm2@meta.data$species <- 'human'
dp <- readRDS('dolphin_PFC_EXN.rds')
DefaultAssay(dp) <- 'RNA'
dp@meta.data$species <- 'dolphin'

创建比较对象

R 复制代码
# 确保Idents已经正确设置
Idents(hm) <- hm@meta.data$cellType_layer
Idents(hm2) <- hm2@meta.data$subclass.v2
Idents(dp) <- dp@meta.data$sub2

# 提取表达矩阵和元数据
exprs_hm <- GetAssayData(hm)
exprs_hm2 <- GetAssayData(hm2)
exprs_dp <- GetAssayData(dp)

meta_hm <- hm@meta.data
meta_hm2 <- hm2@meta.data
meta_dp <- dp@meta.data

# 提取共有基因
common_genes <- Reduce(intersect, list(rownames(exprs_hm),rownames(exprs_hm2), rownames(exprs_dp)))

# 提取共有基因表达矩阵
exprs_hm_common <- exprs_hm[common_genes, ]
exprs_hm2_common <- exprs_hm2[common_genes, ]
exprs_dp_common <- exprs_dp[common_genes, ]

# 合并表达矩阵
combined_exprs <- cbind(exprs_hm_common, exprs_hm2_common, exprs_dp_common)

# 创建一个新的列数据框,确保使用Idents作为cell_type
new_colData <- data.frame(
  study_id = c(rep('human', ncol(exprs_hm_common)),rep('human2', ncol(exprs_hm2_common)), rep('dolphin', ncol(exprs_dp_common))),
  cell_type = c(Idents(hm), Idents(hm2), Idents(dp))
)

# 创建 SingleCellExperiment 对象
sce_combined <- SingleCellExperiment(assays = list(RNA = combined_exprs), colData = new_colData)

# 检查合并后的对象
sce_combined

检查所有细胞分群比例

R 复制代码
table(sce_combined$cell_type)

相似性分析

R 复制代码
# 选择高可变基因
var_genes <- variableGenes(dat = sce_combined, exp_labels = sce_combined$study_id)

# 运行相似性分析
celltype_NV <- MetaNeighborUS(var_genes = var_genes,
                              dat = sce_combined,
                              study_id = sce_combined$study_id,
                              cell_type = sce_combined$cell_type,
                              fast_version = TRUE)
# 检查前几行
head(celltype_NV)

可视化

R 复制代码
png("heatmap_integrated_3.png", width = 24, height = 24, units = "in", res = 300) 
plotHeatmapPretrained(aurocs = celltype_NV, cex = 1.5, margins = c(25, 25))
dev.off()
相关推荐
_深海凉_10 小时前
LeetCode热题100-搜索二维矩阵
算法·leetcode·矩阵
小白学大数据13 小时前
抖音搜索页数据批量爬取,多关键词同步采集实现
爬虫·python·数据分析
西贝爱学习14 小时前
智能手机规格与价格数据集
数据分析·数据集
计算机毕业编程指导师15 小时前
基于Spark的性格行为数据分析与可视化系统源码 毕业设计 选题推荐 毕设选题 数据分析 机器学习 数据挖掘
大数据·python·数据挖掘·数据分析·spark·毕业设计·性格行为
QDYOKR16816 小时前
OKR管理系统怎么选?2026主流OKR工具深度解析
大数据·人工智能·信息可视化·数据挖掘·数据分析
知识分享小能手19 小时前
R语言入门学习教程,从入门到精通,R语言多维数据可视化(12)
学习·信息可视化·r语言
PaperData1 天前
1988-2025年《中国人口和就业统计年鉴》全年份excel+PDF
数据库·人工智能·数据分析·经管
小王毕业啦1 天前
(1990-2024年)个股交易活跃度、个股换手率
大数据·人工智能·数据挖掘·数据分析·区块链·社科数据
im_AMBER1 天前
手撕hot100之矩阵!看完这篇就AC~
javascript·数据结构·线性代数·算法·leetcode·矩阵
知识分享小能手2 天前
R语言入门学习教程,从入门到精通,R语言时间序列数据可视化(11)
学习·信息可视化·r语言