Kom igångKom igång gratis

Standardtrendlinjer

ggplot2 ger oss kraftfulla verktyg för att visualisera data och få en tydlig bild av vad som händer. Ibland behöver vi dock bearbeta datan för att få ut det vi vill ha. I den här övningen undersöker du om pendlingsavstånd påverkar sannolikheten att någon åker buss. Du gör detta genom att sprida ut datapunkterna med geom_jitter() så att de inte överlappar, och sedan lägger till en utjämnad trendlinje med geom_smooth().

Den här övningen är en del av kursen

Generaliserade linjära modeller i R

Visa kurs

Övningsinstruktioner

  • Använd dataramen bus och plotta MilesOneWay på x-axeln och Bus2 på y-axeln.
  • Jittra datapunkterna med bredden 0 och höjden 0,05.
  • Sätt etiketter på axlarna. Använd "Probability of riding the bus" på y-axeln och "One-way commute trip (in miles)" på x-axeln.
  • Spara diagrammet som gg_jitter och lägg sedan till geom_smooth().

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create a jittered plot of MilesOneWay vs Bus2 using the bus dataset
gg_jitter <- ggplot(data = ___, aes(x = ___, y = ___)) + 
	geom_jitter(width = ___, height = ___) +
	ylab(___) +
	xlab(___)

# Add a geom_smooth() to your plot
gg_jitter + ___
Redigera och kör kod