基因表达数据的K-M生存曲线的数据处理及绘制

基因表达K-M(Kaplan-Meier )生存曲线是将经典的生存分析与基因表达数据相结合,用于探究特定基因的表达水平高低是否与患者(或其他研究对象)的生存预后(如总体生存期、无病生存期)存在显著关联。

Kaplan-Meier 曲线:一种统计学方法,用于估计在不同时间点患者的生存概率。它能很好地处理在研究结束时部分患者尚未发生终点事件(如死亡)的"删失"数据。

基因表达:通过测序(如RNA-seq)或芯片技术测量得到的基因在细胞中的mRNA水平。表达水平通常是一个连续数值。

简单来说: 将一个连续测量的基因表达值,通过一个阈值(如中位数或最佳截断值)划分为 " 高表达组 " " 低表达组 ",然后比较这两组患者的生存曲线,看是否存在统计学上的显著差异。

本期教程详细介绍了基因表达数据的K-M生存曲线的数据处理及绘制。

一、数据处理与分组:

1.将表达数据按照表达数据的中位数分为高、低的表达组:①单元格G2中,使用公式=MEDIAN(C2:C468)计算得出的表达数据的中位数为588;②单元格E2中用公式=IF(D2<G2,"LOW","HIGH")判断与中位数的大小关系,若小于中位数则为LOW,高于则为HIGH,据此对表达数据进行高低分组。③在单元格F2中,使用公式=IF(C2="Dead",1,0)将C列中的文字状态描述转化为数字描述,1表示Dead,0表示Alive。

2.打开选中组别列,也就是E列,点击右上角的排序与筛选,选择降序,在跳出的对话框选择扩展选定区域。

二、数据分析及绘图

1.打开Graphpad prism软件,安装下右图的格式将生存时间和状态数据按照高、低表达组(High expression & Low expression)两列错位输入;

2.点击左侧的工具栏,选择"New Analysis"选项,在弹出的Analyze Data或Create New Analysis界面中选择Survival analyses,选择Simple survival analysis(Kaplan-Meier);

3.在弹出的参数设置界面按以下图示设置即可;

4.在左侧工具栏中,点击Graphs下的Survival proportions,页面出现图形即为生存曲线图形,需要对其进一步细节美化;

5.双击坐标轴,在跳出的对话框下,分别修改边框大小,数据间隔改为0;

6.双击图形,分别对两条曲线进行修改颜色和大小;

7.添加误差带,点击对话框下的"Change Graph Type",在跳出的对话框,选择将Error bars,选择95%CI;

回到图层设置页面,分别对两条曲线进行修改置信区间的颜色等;

8.接着对其进行其它细节美化,包括字体格式、图例、添加注释等,K-M生存曲线最终效果图如下图所示:

以上就是基因表达数据的K-M生存曲线的数据处理及绘制步骤,根据以上步骤即可绘制出带有置信区间的生存曲线,大家快去试试吧!

------ END ------

相关推荐
觉醒大王20 小时前
哪些文章会被我拒稿?
论文阅读·笔记·深度学习·考研·自然语言处理·html·学习方法
觉醒大王1 天前
强女思维:着急,是贪欲外显的相。
java·论文阅读·笔记·深度学习·学习·自然语言处理·学习方法
张较瘦_1 天前
[论文阅读] AI | 用机器学习给深度学习库“体检”:大幅提升测试效率的新思路
论文阅读·人工智能·机器学习
m0_650108242 天前
IntNet:面向协同自动驾驶的通信驱动多智能体强化学习框架
论文阅读·marl·多智能体系统·网联自动驾驶·意图共享·自适应通讯·端到端协同
m0_650108242 天前
Raw2Drive:基于对齐世界模型的端到端自动驾驶强化学习方案
论文阅读·机器人·强化学习·端到端自动驾驶·双流架构·引导机制·mbrl自动驾驶
快降重科研小助手2 天前
前瞻与规范:AIGC降重API的技术演进与负责任使用
论文阅读·aigc·ai写作·降重·降ai·快降重
源于花海3 天前
IEEE TIE期刊论文学习——基于元学习与小样本重训练的锂离子电池健康状态估计方法
论文阅读·元学习·电池健康管理·并行网络·小样本重训练
m0_650108243 天前
UniDrive-WM:自动驾驶领域的统一理解、规划与生成世界模型
论文阅读·自动驾驶·轨迹规划·感知、规划与生成融合·场景理解·未来图像生成
蓝田生玉1233 天前
LLaMA论文阅读笔记
论文阅读·笔记·llama
*西瓜3 天前
基于深度学习的视觉水位识别技术与装备
论文阅读·深度学习