Kom igångKom igång gratis

Antal tecken i ryska tweets

I den här övningen har du fått en dataram tweets som innehåller tweets kopplade till Rysslands Internet Research Agency, sammanställda av FiveThirtyEight.

Din uppgift är att skapa ett nytt särdrag, 'char_count', i tweets som beräknar antalet tecken i varje tweet. Beräkna också den genomsnittliga längden på varje tweet. Tweetsen finns tillgängliga i särdragskolumnen content i tweets.

Observera att det här är verklig data från Twitter, och det finns därför alltid en risk att den kan innehålla svordomar eller annat stötande innehåll – i den här övningen och i efterföljande övningar som också använder verklig Twitter-data.

Den här övningen är en del av kursen

Funktionsutveckling för NLP i Python

Visa kurs

Övningsinstruktioner

  • Skapa ett nytt särdrag char_count genom att tillämpa len på särdragskolumnen 'content' i tweets.
  • Skriv ut det genomsnittliga antalet tecken i tweetsen genom att beräkna medelvärdet av särdragskolumnen 'char_count'.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create a feature char_count
tweets['char_count'] = tweets[____].apply(____)

# Print the average character count
print(tweets[____].____)
Redigera och kör kod