Sum of Single Effects Linear Regression (susieR):多个因果变异位点的鉴定

使用susieR鉴定多个因果变异位点只需要两个输入文件,一个输入文件是包含Zscore值的SNP位点(zscore.txt),另一个文件是LD matrix(LD.matrix.ld)。

zscore.txt 文件如下所示:

LD.matrix.ld 文件如下所示:

LD.matrix.ld 文件是通过plink生成的,使用到的命令如下:

bash 复制代码
plink --bfile file --r2 --matrix --out LD.matrix

其中,file是指包含zscore.txt文件中所有SNP的plink格式文件。注意,file.bim的SNP顺序要跟zscore.txt的SNP一列的顺序完全一致,不然后面运行susieR的时候会报错。

通过以上命令得到LD.matrix.ld 文件后,即可通过susieR包鉴定多个因果变异位点,如下所示:

r 复制代码
install.packages("susieR")
rm(list=ls())
library(susieR)
library(data.table)
eq=read.table("zscore.txt", sep="\t", stringsAsFactors=FALSE,header=F)
dat <- fread("LD.matrix.ld")
dat1=as.matrix(dat)
fitted_rss3 <- susie_rss(c(eq$zscore), dat1, n=eq$N, L = 10)
susie_plot(fitted_rss3, y="PIP")
summary(fitted_rss3)$cs

运行susie_plot(fitted_rss3, y="PIP")命令后得到如下图像:

其中,真正的因果变量以红色显示。95%的因果集通过三种不同的颜色(绿色、紫色、蓝色)来表示。

运行summary(fitted_rss3)$cs命令后得到如下结果:

复制代码
#   cs cs_log10bf cs_avg_r2 cs_min_r2
# 1  2   4.033879 1.0000000 1.0000000
# 2  1   6.744086 0.9634847 0.9634847
# 3  3   3.461470 0.9293299 0.7545197
#                                                                                                      variable
# 1                                                                                                         653
# 2                                                                                                     773,777
# 3 362,365,372,373,374,379,381,383,384,386,387,388,389,391,392,396,397,398,399,400,401,403,404,405,407,408,415

结果表示这三个因果信号已被三个因果集(CSs)捕获。注意的是,第三个因果集中包含许多变量,包括真正的因果变量403。

相关推荐
leoufung4 分钟前
用三色 DFS 拿下 Course Schedule(LeetCode 207)
算法·leetcode·深度优先
im_AMBER1 小时前
算法笔记 18 二分查找
数据结构·笔记·学习·算法
C雨后彩虹1 小时前
机器人活动区域
java·数据结构·算法·华为·面试
MarkHD2 小时前
车辆TBOX科普 第53次 三位一体智能车辆监控:电子围栏算法、驾驶行为分析与故障诊断逻辑深度解析
算法
苏小瀚2 小时前
[算法]---路径问题
数据结构·算法·leetcode
月明长歌3 小时前
【码道初阶】一道经典简单题:多数元素(LeetCode 169)|Boyer-Moore 投票算法详解
算法·leetcode·职场和发展
wadesir3 小时前
C语言模块化设计入门指南(从零开始构建清晰可维护的C程序)
c语言·开发语言·算法
t198751283 小时前
MATLAB水声信道仿真程序
开发语言·算法·matlab
CoderYanger4 小时前
动态规划算法-简单多状态dp问题:15.买卖股票的最佳时机含冷冻期
开发语言·算法·leetcode·动态规划·1024程序员节
Xの哲學4 小时前
Linux RTC深度剖析:从硬件原理到驱动实践
linux·服务器·算法·架构·边缘计算