基因表达数据的K-M生存曲线的数据处理及绘制

基因表达K-M(Kaplan-Meier )生存曲线是将经典的生存分析与基因表达数据相结合,用于探究特定基因的表达水平高低是否与患者(或其他研究对象)的生存预后(如总体生存期、无病生存期)存在显著关联。

Kaplan-Meier 曲线:一种统计学方法,用于估计在不同时间点患者的生存概率。它能很好地处理在研究结束时部分患者尚未发生终点事件(如死亡)的"删失"数据。

基因表达:通过测序(如RNA-seq)或芯片技术测量得到的基因在细胞中的mRNA水平。表达水平通常是一个连续数值。

简单来说: 将一个连续测量的基因表达值,通过一个阈值(如中位数或最佳截断值)划分为 " 高表达组 " " 低表达组 ",然后比较这两组患者的生存曲线,看是否存在统计学上的显著差异。

本期教程详细介绍了基因表达数据的K-M生存曲线的数据处理及绘制。

一、数据处理与分组:

1.将表达数据按照表达数据的中位数分为高、低的表达组:①单元格G2中,使用公式=MEDIAN(C2:C468)计算得出的表达数据的中位数为588;②单元格E2中用公式=IF(D2<G2,"LOW","HIGH")判断与中位数的大小关系,若小于中位数则为LOW,高于则为HIGH,据此对表达数据进行高低分组。③在单元格F2中,使用公式=IF(C2="Dead",1,0)将C列中的文字状态描述转化为数字描述,1表示Dead,0表示Alive。

2.打开选中组别列,也就是E列,点击右上角的排序与筛选,选择降序,在跳出的对话框选择扩展选定区域。

二、数据分析及绘图

1.打开Graphpad prism软件,安装下右图的格式将生存时间和状态数据按照高、低表达组(High expression & Low expression)两列错位输入;

2.点击左侧的工具栏,选择"New Analysis"选项,在弹出的Analyze Data或Create New Analysis界面中选择Survival analyses,选择Simple survival analysis(Kaplan-Meier);

3.在弹出的参数设置界面按以下图示设置即可;

4.在左侧工具栏中,点击Graphs下的Survival proportions,页面出现图形即为生存曲线图形,需要对其进一步细节美化;

5.双击坐标轴,在跳出的对话框下,分别修改边框大小,数据间隔改为0;

6.双击图形,分别对两条曲线进行修改颜色和大小;

7.添加误差带,点击对话框下的"Change Graph Type",在跳出的对话框,选择将Error bars,选择95%CI;

回到图层设置页面,分别对两条曲线进行修改置信区间的颜色等;

8.接着对其进行其它细节美化,包括字体格式、图例、添加注释等,K-M生存曲线最终效果图如下图所示:

以上就是基因表达数据的K-M生存曲线的数据处理及绘制步骤,根据以上步骤即可绘制出带有置信区间的生存曲线,大家快去试试吧!

------ END ------

相关推荐
勤劳的进取家3 天前
论文阅读:GOAT: GO to Any Thing
论文阅读·人工智能·算法·语言模型·自然语言处理
崔高杰3 天前
大模型训练中对SFT和DPO的魔改——PROXIMAL SUPERVISED FINE-TUNING和Semi-online DPO论文阅读笔记
论文阅读·笔记
时时勤拂拭.4 天前
在word以及latex中引用zotero中的参考文献
论文阅读·word
时时勤拂拭.4 天前
设置word引用zotero中的参考文献的格式为中文引用格式或中英文格式
论文阅读·word
川川子溢5 天前
【论文阅读】SegCLIP:用于高分辨率遥感图像语义分割的多模态视觉语言和快速学习
论文阅读·学习
不解风水5 天前
【论文阅读】MotionXpert:基于肌电信号的优化下肢运动检测分类
论文阅读
Junewang06145 天前
【论文阅读】PEPNet
论文阅读·推荐算法
森诺Alyson7 天前
前沿技术借鉴研讨-2025.8.26(多任务分类/预测)
论文阅读·人工智能·经验分享·论文讨论
七元权7 天前
论文阅读-CompletionFormer
论文阅读