ПочатиПочніть безкоштовно

Створення датафрейму часових рядів

Дані часових рядів використовують, коли потрібно проаналізувати або дослідити зміну показників у часі. Це корисно під час аналізу текстів у Twitter, якщо ви хочете відстежувати поширеність окремого слова або набору слів.

Перший крок — перетворити DataFrame у формат, з яким можна працювати за допомогою методів часових рядів Pandas. Це роблять, змінюючи індекс на тип datetime.

Ця вправа є частиною курсу

Аналіз даних із соцмереж у Python

Переглянути курс

Інструкції до вправи

  • Виведіть перші п'ять рядків стовпця created_at у ds_tweets за допомогою методу .head().
  • Перетворіть цей стовпець на тип datetime за допомогою методу Pandas .to_datetime().
  • Знову виведіть перші п'ять рядків.
  • Встановіть індекс як created_at за допомогою .set_index().

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Print created_at to see the original format of datetime in Twitter data
print(ds_tweets[____].____())

# Convert the created_at column to np.datetime object
ds_tweets[____] = pd.____(____)

# Print created_at to see new format
print(ds_tweets[____].____())

# Set the index of ds_tweets to created_at
ds_tweets = ds_tweets.____(____)
Редагувати та запускати код