Sprawdzamy Wikipedia API
Idzie ci świetnie, więc czas na jeszcze jedno API – Wikipedia API (dokumentacja dostępna tutaj). Dowiesz się, jak znaleźć i wyodrębnić informacje ze strony Wikipedii poświęconej pizzy. Sprawa jest o tyle ciekawa, że zapytanie zwróci zagnieżdżone JSONy, czyli JSONy zawierające inne JSONy – Python jednak poradzi sobie z tym bez problemu, tłumacząc je na słowniki w słownikach.
URL wysyłający odpowiednie zapytanie do Wikipedia API wygląda następująco:
https://en.wikipedia.org/w/api.php?action=query&prop=extracts&format=json&exintro=&titles=pizza
To ćwiczenie jest częścią kursu
Importowanie danych w Pythonie – poziom średniozaawansowany
Instrukcje do ćwiczenia
- Przypisz odpowiedni URL do zmiennej
url. - Zastosuj metodę
json()na obiekcie odpowiedziri zapisz otrzymany słownik w zmiennejjson_data. - Zmienna
pizza_extractzawiera kod HTML fragmentu ze strony Wikipedii o pizzy w postaci ciągu znaków – użyj funkcjiprint(), aby wyświetlić ten ciąg w powłoce.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import package
import requests
# Assign URL to variable: url
# Always include a descriptive User-Agent (Wikipedia requires this)
headers = {
"User-Agent": "Checking out the Wikipedia API"
}
# Package the request, send the request and catch the response: r
r = requests.get(url, headers=headers)
# Decode the JSON data into a dictionary: json_data
# Print the Wikipedia page extract
pizza_extract = json_data['query']['pages']['24768']['extract']
____