สำรวจไฟล์ fastq
ไฟล์ Fastq มักประกอบด้วยรีดหลักพันถึงหลายล้านรายการ และอาจมีขนาดใหญ่มาก สำหรับแบบฝึกหัดนี้ จะใช้ไฟล์ fastq ขนาดเล็กที่มีรีดเพียง 500 รายการ ซึ่งโหลดเข้าหน่วยความจำได้ง่ายและอ่านได้ทั้งหมดด้วยฟังก์ชัน readFastq()
ไฟล์ลำดับต้นฉบับมาจาก Arabidopsis thaliana ซึ่งจัดทำโดย UC Davis Genome Center หมายเลข accession คือ SRR1971253 และดาวน์โหลดมาจาก Sequence Read Archive (SRA) ไฟล์นี้บรรจุข้อมูล DNA จากเนื้อเยื่อใบที่รวบรวมและจัดลำดับด้วย Illumina HiSeq 2000 โดยเป็นลำดับแบบ single-read ที่มีความยาว 50 คู่เบส (bp)
fqsample เป็นออบเจกต์ประเภท ShortReadQ ที่เก็บข้อมูลรีด คะแนนคุณภาพ และ ID ไว้ด้วยกัน ถึงเวลาแล้วที่จะลองสำรวจออบเจกต์นี้!
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Bioconductor เบื้องต้นใน R
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Load ShortRead
___
# Print fqsample
___