Xác định giá trị cực trị
Bây giờ bạn đã tạo được một DataFrame với tỷ lệ tự nhận dạng là người Hispanic theo bang, hãy khám phá sâu hơn, bắt đầu bằng việc tạo một boxplot bằng seaborn.
Bạn cũng sẽ tìm các bang có tỷ lệ người Hispanic tự nhận là các chủng tộc cụ thể cao nhất hoặc thấp nhất. Để làm điều đó, bạn sẽ dùng phương thức squeeze(). Phương thức này chuyển một DataFrame chỉ có một hàng thành một series (không ảnh hưởng đến DataFrame có nhiều hơn một hàng).
pandas đã được nhập. DataFrame states_hr đã được nạp, chứa phần trăm tự nhận dạng chủng tộc cho 7 nhóm chủng tộc khác nhau.
Bài tập này là một phần của khóa học
Phân tích dữ liệu Điều tra Dân số Hoa Kỳ bằng Python
Hướng dẫn bài tập
- Tạo một boxplot bằng cách đặt tham số
datalà tên của DataFrame. (orient = "h"sẽ vẽ boxplot theo phương ngang — horizontal.) - Dùng
squeezeđể hiển thị bang có giá trị lớn nhất ở cộthispanic_white. - Dùng
squeezeđể hiển thị bang có giá trị nhỏ nhất ở cộthispanic_other. - Lưu ý rằng rất ít người Hispanic tự nhận là Asian, nhưng có một bang là ngoại lệ cao. Dùng
squeezeđể hiển thị bang có giá trị lớn nhất ở cộthispanic_asian.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Import seaborn and matplotlib.plt
import matplotlib.pyplot as plt
import seaborn as sns
sns.set()
# Create a boxplot
sns.boxplot(data = ____, orient = "h")
plt.show()
# Show states with extreme values in various columns
print(states_hr.nlargest(1, ____).squeeze())
print(states_hr.nsmallest(____).____)
print(____)