Utforska datamängden 20 News Groups
I den här övningen får du ett urval från datamängden 20 News Groups, hämtat med funktionen fetch_20newsgroups() från sklearn.datasets, filtrerat till tre klasser: sci.space, alt.atheism och soc.religion.christian.
Datamängden är inläst i variabeln news_dataset. Dess attribut skrivs ut så att du kan utforska dem i konsolen.
Mer information om hur du använder funktionen finns i Sklearns dokumentation.
Du kommer att tokenisera texterna och one-hot-koda etiketterna steg för steg för att förstå hur omvandlingarna går till.
Den här övningen är en del av kursen
Återkommande neurala nätverk (RNN) för språkmodellering med Keras
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# See example article
print(news_dataset.____[5])