Extrahuj vzorek ze souboru fastq
Teď je řada na tobě – vyber část sekvence z většího souboru čtení.
Budeš pracovat se stejným souborem jako v předchozím cvičení. Tento soubor obsahuje 500 čtení, každé o délce 50 bp. Cesta k souboru je uložená v objektu f.
Pomocí FastqSampler(con = file_path, n = length), set.seed() a yield() můžeš ze svého sekvenčního souboru vybrat 100 čtení.
Toto cvičení je součástí kurzu
Úvod do Bioconductoru v R
Pokyny k cvičení
- Načti balíček
ShortRead. - Použij
set.seed()s hodnotou1234. - Použij
FastqSampler()s malým souborem fastq uloženým vfa vyber 100 čtení. - Pomocí
yield()vygeneruj podsekvenci.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Load ShortRead
library(ShortRead)
# Set a seed for sampling
___
# Use FastqSampler with f and select 100 reads
fs <- ___(con = ___, ___ = ___)
# Generate new sample yield
my_sample <- ___
# Print my_sample
___