开始使用免费开始使用

探索 fastq 文件

Fastq 文件通常包含成千上万甚至数百万条 reads,文件体积会非常大!在本练习中,您将使用一个包含 500 条 reads 的小型 fastq 子样本,能够轻松装入内存,并可通过 readFastq() 函数完整读取。

原始序列文件来自拟南芥(Arabidopsis thaliana),由 UC Davis Genome Center 提供。登录号为 SRR1971253,下载自 Sequence Read Archive (SRA)。该数据包含叶片组织的 DNA,经合并后在 Illumina HiSeq 2000 上测序。这些序列为单端测序,长度为 50 个碱基对(bp)。

fqsample 是一个 ShortReadQ 对象,包含 reads、质量分数和 id 的信息。现在轮到您来探索它了!

本练习是课程的一部分

R 中的 Bioconductor 入门

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Load ShortRead
___

# Print fqsample
___
编辑并运行代码