Matcha och dela
Vissa tweets i din datamängd laddades ned felaktigt. I stället för mellanslag mellan orden innehåller de konstiga tecken. Du bestämmer dig för att använda reguljära uttryck för att lösa det här problemet. Du skriver ut några av dessa tweets för att förstå vilket mönster du behöver matcha.
Du märker att meningarna alltid separeras av ett specialtecken följt av en siffra, ordet break och sedan ytterligare ett specialtecken, t.ex. &4break!. Orden separeras alltid av ett specialtecken, ordet new och ett vanligt slumpmässigt tecken, t.ex. #newH.
Variabeln sentiment_analysis med texten från en tweet, samt modulen re, är redan inlästa i din session. Du kan använda print(sentiment_analysis) för att visa innehållet i IPython Shell.
Den här övningen är en del av kursen
Reguljära uttryck i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Write a regex to match pattern separating sentences
regex_sentence = ____"____"