Återuppta efter en omstart
Din strömningspipeline på Global Retail Analytics hämtar nya CSV-filer från en Unity Catalog-volym och skriver dem till Delta Lake. Efter ett avbrott under helgen startar klustret om på måndag morgon. Tre nya filer kom in under helgen. Strömmen bearbetar bara dessa tre filer – ingen av filerna från föregående vecka läses in igen.
Vad gör det möjligt för strömmen att hoppa över redan bearbetade filer och fortsätta exakt där den slutade?
Den här övningen är en del av kursen
Datatransformation med Spark SQL i Databricks
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen