Kom igångKom igång gratis

Återuppta efter en omstart

Din strömningspipeline på Global Retail Analytics hämtar nya CSV-filer från en Unity Catalog-volym och skriver dem till Delta Lake. Efter ett avbrott under helgen startar klustret om på måndag morgon. Tre nya filer kom in under helgen. Strömmen bearbetar bara dessa tre filer – ingen av filerna från föregående vecka läses in igen.

Vad gör det möjligt för strömmen att hoppa över redan bearbetade filer och fortsätta exakt där den slutade?

Den här övningen är en del av kursen

Datatransformation med Spark SQL i Databricks

Visa kurs

Interaktiv övning med praktiskt arbete

Gör teori till handling med en av våra interaktiva övningar

Starta övningen