Кількість символів у твітах з Росії
У цій вправі вам надано датафрейм tweets, який містить твіти, пов'язані з Інтернет-агентством досліджень Росії, зібрані FiveThirtyEight.
Ваше завдання — створити нову ознаку 'char_count' у tweets, яка обчислює кількість символів для кожного твіта. Також обчисліть середню довжину твіта. Твіти містяться в ознаці content датафрейму tweets.
Зверніть увагу, що це реальні дані з Twitter, тож існує ризик, що вони можуть містити нецензурну лексику або інший образливий контент (у цій вправі та в будь-яких наступних вправах, які також використовують реальні дані з Twitter).
Ця вправа є частиною курсу
Інженерія ознак для NLP у Python
Інструкції до вправи
- Створіть нову ознаку
char_count, застосувавшиlenдо ознаки 'content' уtweets. - Надрукуйте середню кількість символів у твітах, обчисливши середнє значення ознаки 'char_count'.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Create a feature char_count
tweets['char_count'] = tweets[____].apply(____)
# Print the average character count
print(tweets[____].____)