Standardtrendlinjer
ggplot2 ger oss kraftfulla verktyg för att visualisera data och få en tydlig bild av vad som händer.
Ibland behöver vi dock bearbeta datan för att få ut det vi vill ha.
I den här övningen undersöker du om pendlingsavstånd påverkar sannolikheten att någon åker buss.
Du gör detta genom att sprida ut datapunkterna med geom_jitter() så att de inte överlappar, och sedan lägger till en utjämnad trendlinje med geom_smooth().
Den här övningen är en del av kursen
Generaliserade linjära modeller i R
Övningsinstruktioner
- Använd dataramen
busoch plottaMilesOneWaypå x-axeln ochBus2på y-axeln. - Jittra datapunkterna med bredden
0och höjden0,05. - Sätt etiketter på axlarna. Använd
"Probability of riding the bus"på y-axeln och"One-way commute trip (in miles)"på x-axeln. - Spara diagrammet som
gg_jitteroch lägg sedan tillgeom_smooth().
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a jittered plot of MilesOneWay vs Bus2 using the bus dataset
gg_jitter <- ggplot(data = ___, aes(x = ___, y = ___)) +
geom_jitter(width = ___, height = ___) +
ylab(___) +
xlab(___)
# Add a geom_smooth() to your plot
gg_jitter + ___