Wydajność zapytań w Snowflake

Wprowadzenie do modelowania danych w Snowflake

Nuno Rocha

Director of Engineering

Przechowywanie danych

Przechowywanie wierszowe

Wprowadzenie do modelowania danych w Snowflake

Przechowywanie danych (1)

Wierszowe przechowywanie w PostgreSQL

Wprowadzenie do modelowania danych w Snowflake

Przechowywanie danych (2)

Wierszowe przechowywanie w Snowflake

Wprowadzenie do modelowania danych w Snowflake

Masowe przetwarzanie równoległe

Wiele równoległych procesów wykonujących zapytanie

Wprowadzenie do modelowania danych w Snowflake

Rola MPP w przechowywaniu danych

Dane podzielone na mikropartycje

Wprowadzenie do modelowania danych w Snowflake

Rola MPP w przechowywaniu danych (1)

Dane podzielone na regularne partycje

Wprowadzenie do modelowania danych w Snowflake

Wizualizacja czasu wykonania zapytań

Wynik wykonania zapytania

Wprowadzenie do modelowania danych w Snowflake

Wizualizacja czasu wykonania zapytań (1)

Instrukcja wyszukiwania profilu zapytania

Wprowadzenie do modelowania danych w Snowflake

Wizualizacja czasu wykonania zapytań (2)

Strona profilu zapytania

Wprowadzenie do modelowania danych w Snowflake

Przegląd terminologii

  • Massively Parallel Processing (MPP): silnik Snowflake przetwarzający dane równolegle na wielu serwerach.
  • Mikropartycje: małe segmenty przechowywania danych w Snowflake przyspieszające ich pobieranie.
  • Przechowywanie kolumnowe: format zapisu danych, w którym każda kolumna jest przechowywana oddzielnie.
  • Przechowywanie wierszowe: tradycyjny format zapisu danych, w którym wiersze przechowywane są sekwencyjnie.
  • PostgreSQL: otwartoźródłowy relacyjny system baz danych oparty na przechowywaniu wierszowym, często porównywany ze Snowflake pod kątem wydajności.
  • Profil zapytania: funkcja Snowflake umożliwiająca wizualizację kroków i zasobów użytych podczas wykonania zapytania.
Wprowadzenie do modelowania danych w Snowflake

Czas na ćwiczenia!

Wprowadzenie do modelowania danych w Snowflake

Preparing Video For Download...