Ta bort dubbletter
Det är alltid god praxis att kontrollera att dina sekvensreads inte innehåller för många dubbletter.
# Sample med dubbletter av klassen: ShortReadQ
dfqsample
# Hämta reads från dfqsample
mydReads <- sread(dfqsample)
# Räkna dubbletter
table(srduplicated(mydReads))
Hur skulle du gå till väga för att ta bort duplicerade reads i en fil? Tänk på vilket villkor som bör användas i filtret.
Den här övningen är en del av kursen
Introduktion till Bioconductor i R
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen