Datafiltrering med PySpark
I den här övningen laddar vi upp en fil till ett lakehouse och använder PySpark för att filtrera data. Filen innehåller en lista över tv-spel och deras utgivare. Vi vill begränsa datamängden så att vi bara arbetar med tv-spel från utgivaren Atari.
Obs! Om du får ett felmeddelande om en API-hastighetsgräns beror det oftast på att en tidigare Fabric-uppgift inte har slutförts. Du kan se aktiva Fabric-uppgifter på sidan Monitor (som finns i den vänstra vertikala menyn). Att avbryta gamla Fabric-uppgifter på Monitor-sidan brukar lösa problemet med hastighetsgränsen.
Den här övningen är en del av kursen
Transformera och analysera data med Microsoft Fabric
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen