STAR 命令参数解释

以这个为例子解释STAR参数含义

STAR 命令参数解释

bash 复制代码
STAR \
--outFilterType BySJout \
--runThreadN 8 \
--outFilterMismatchNmax 2 \
--genomeDir <hg19_STARindex> \
--readFilesIn <un_aligned.fastq> \
--outFileNamePrefix <HEK293> \
--outSAMtype BAM SortedByCoordinate \
--quantMode TranscriptomeSAM GeneCounts \
--outFilterMultimapNmax 1 \
--outFilterMatchNmin 16 \
--alignEndsType EndToEnd
  1. --outFilterType BySJout:

    • 过滤类型,BySJout 表示只输出通过Splice Junction过滤的reads。这对于检测新的剪接位点非常有用。
  2. --runThreadN 8:

    • 使用8个线程进行计算。多线程可以加速处理速度,特别是在多核处理器上。
  3. --outFilterMismatchNmax 2:

    • 每个read允许的最大错配数。如果一个read有超过2个错配,则不会被输出。这个参数控制比对的精确度。
  4. --genomeDir <hg19_STARindex>:

    • 指定参考基因组索引的目录。这里假设是hg19基因组的STAR索引。
  5. --readFilesIn <un_aligned.fastq>:

    • 输入的FASTQ文件,包含待比对的reads。
  6. --outFileNamePrefix <HEK293>:

    • 输出文件的前缀。所有输出文件的名称都会以这个前缀开始。
  7. --outSAMtype BAM SortedByCoordinate:

    • 指定输出文件类型和排序方式。这里输出的文件格式为BAM,并按坐标排序。
  8. --quantMode TranscriptomeSAM GeneCounts:

    • TranscriptomeSAM:输出转录组的比对结果(适用于下游转录组分析工具)。
    • GeneCounts:生成基因计数文件。
  9. --outFilterMultimapNmax 1:

    • 每个read允许的最大多比对数(multimapping)。设为1意味着只保留唯一比对的reads。如果一个read比对到多个位置,则不会被输出。
  10. --outFilterMatchNmin 16:

    • 每个read的最小比对长度。如果一个read比对的长度小于16bp,则不会被输出。这个参数控制比对的质量。
  11. --alignEndsType EndToEnd:

    • 比对模式,EndToEnd 表示全长比对,要求read的两端都比对到参考基因组。

是否保留多比对(multimapping)

根据参数 --outFilterMultimapNmax 1,该设置表明只保留唯一比对的reads。如果一个read比对到多个位置,则不会被输出。因此,该命令配置没有保留多比对的reads,只有唯一比对的reads会被保留和输出。

总结

  • --outFilterMultimapNmax 1 参数设定为1,意味着不保留多比对的reads,只保留唯一比对的reads。
  • 其他参数控制比对的精确度、输出格式和质量过滤标准。

通过这些设置,STAR将只输出那些唯一比对到参考基因组的位置、且质量符合要求的reads。

相关推荐
2401_858936887 分钟前
【Linux C 编程】标准 IO 详解与实战:从基础接口到文件操作实战
linux·c语言
Roc.Chang19 分钟前
Ubuntu 下 VLC 无法启动(Segmentation fault)终极解决方案
linux·ubuntu·vlc·媒体播放
松涛和鸣1 小时前
72、IMX6ULL驱动实战:设备树(DTS/DTB)+ GPIO子系统+Platform总线
linux·服务器·arm开发·数据库·单片机
简单中的复杂1 小时前
【避坑指南】RK3576 Linux SDK 编译:解决 Buildroot 卡死在 host-gcc-final 的终极方案
linux·嵌入式硬件
wVelpro2 小时前
如何在Pycharm 2025.3 版本实现虚拟环境“Make available to all projects”
linux·ide·pycharm
程序员老舅2 小时前
C++高并发精髓:无锁队列深度解析
linux·c++·内存管理·c/c++·原子操作·无锁队列
雨中风华2 小时前
Linux, macOS系统实现远程目录访问(等同于windows平台xFsRedir软件的目录重定向)
linux·windows·macos
爱吃生蚝的于勒3 小时前
【Linux】进程信号之捕捉(三)
linux·运维·服务器·c语言·数据结构·c++·学习
The森3 小时前
Linux IO 模型纵深解析 01:从 Unix 传统到 Linux 内核的 IO 第一性原理
linux·服务器·c语言·经验分享·笔记·unix
翼龙云_cloud3 小时前
腾讯云代理商: Linux 云服务器搭建 FTP 服务指南
linux·服务器·腾讯云