初级的,亲爱的华生!
今天是周五,您即将完成书籍项目的工作。最后一项任务,您将分析阿瑟·柯南·道尔作品的数据。
您发现数据集 books_sh 需要重塑。您注意到有些列可以按前缀分组。您已经确定了可用作唯一 ID 的列。不过,其中一些列包含字符串。在进行宽表到长表转换前,需要先处理这些字符串。您决定对部分字符串进行拆分,以让 DataFrame 更整洁。
数据集 books_sh 已为您准备好。它包含每本书的标题,以及关于 version、number_pages 和 number_ratings 的数据。
本练习是课程的一部分
使用 pandas 重塑数据
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Split main_title by a colon and assign it to two columns named title and subtitle
books_sh[['title', 'subtitle']] = ____[____].____.____(____, ____=____)
# Print books_sh
print(books_sh)