5-tuple unice în ordine sortată
O lecție anterioară a prezentat o operație care elimină duplicatele, returnând înregistrări unice. Într-un exercițiu anterior ai obținut 5-tuple frecvente. Vom combina aceste două capabilități pentru a găsi 5-tuplele unice, sortate alfabetic în ordine descrescătoare.
Tabelul text conține primele patru capitole din textul despre Sherlock Holmes. Are următoarele coloane: word, id și part.
Acest exercițiu face parte din cursul
Introducere în Spark SQL în Python
Instrucțiuni pentru exercițiu
- Extrage ultimele zece 5-tuple unice sortate alfabetic în ordine descrescătoare.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Unique 5-tuples sorted in descending order
query = """
SELECT ____ w1, w2, w3, w4, w5 FROM (
SELECT word AS w1,
____(word,____) OVER(PARTITION BY ____ ORDER BY ____ ) AS w2,
____(word,____) OVER(PARTITION BY ____ ORDER BY ____ ) AS w3,
____(word,____) OVER(PARTITION BY ____ ORDER BY ____ ) AS w4,
____(word,____) OVER(PARTITION BY ____ ORDER BY ____ ) AS w5
FROM text
)
ORDER BY w1 DESC, w2 DESC, ____ DESC, w4 ____, ____ ____
LIMIT 10
"""
df = spark.sql(query)
df.show()