Podmíněné list comprehensions pro data s časovými razítky
Skvěle, podařilo se ti extrahovat požadovaná data — konkrétně čas — z pandas DataFrame! Teď to ještě trochu vylepšíme: přidáme podmínku, která upřesní, které záznamy vybrat.
V tomto cvičení použiješ list comprehension k extrakci času z twitterových dat s časovými razítky. Do list comprehension přidáš podmínkový výraz tak, aby se vybraly pouze ty časy, kde entry[17:19] je rovno '19'. Balíček pandas je naimportován jako pd a soubor 'tweets.csv' je načten jako DataFrame df.
Toto cvičení je součástí kurzu
Python Toolbox
Pokyny k cvičení
- Extrahuj sloupec
'created_at'zdfa výsledek ulož do proměnnétweet_time. - Vytvoř list comprehension, které extrahuje čas z každého řádku v
tweet_time. Každý řádek je řetězec reprezentující časové razítko — čas získáš výběrem 12. až 19. znaku tohoto řetězce. Jako proměnnou iterátoru použijentrya výsledek ulož dotweet_clock_time. Přidej také podmínkový výraz, který ověří, zda seentry[17:19]rovná'19'.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Extract the created_at column from df: tweet_time
tweet_time = ____
# Extract the clock time: tweet_clock_time
tweet_clock_time = [____ for ____ in ____ if ____ == ____]
# Print the extracted times
print(tweet_clock_time)