or
Toto cvičení je součástí kurzu
Jak zobrazit všechna data a zároveň zajistit, aby divák nepřehlédl to podstatné? V této kapitole se podíváme na to, jak provést diváka daty pomocí barevných zvýraznění a textových popisků. Zároveň si představíme dataset s hodnotami běžných znečišťujících látek ve Spojených státech.
Aktuální cvičení
Barva je ve vizualizaci dat mocný nástroj pro kódování hodnot. Jenže s tou silou přichází i riziko. V této kapitole si ukážeme, jak vybrat vhodnou barevnou paletu podle typu dat, která zobrazuješ.
Nejistota je v datové vědě všudypřítomná, přesto ji ve vizualizacích, kde by být měla, často chybí. Zopakujeme si, co je interval spolehlivosti, a ukážeme, jak ho vizualizovat pro jednotlivé odhady i spojité funkce. Probereme také techniku bootstrap pro posouzení nejistoty a její správnou vizualizaci.
Vizualizace se často vyučuje odděleně od praxe a osvědčené postupy bývají popisovány jen obecně. Ve skutečnosti ale budeš muset pravidla přizpůsobovat různým situacím – od hrubých průzkumných vizualizací až po finální doladění velikostí písma. V této kapitole se ponoříme do toho, jak vizualizace optimalizovat v každé fázi procesu datové vědy.