Micro-particiones y clustering de datos

Arquitectura de Snowflake

Emily Melhuish

Technical Curriculum Developer, Snowflake

Consultar una tabla grande

Ejemplo: Subscription

USER_ID REGISTRATION_DATE USER_NAME
912930 2026-04-01 JANEDOE
912931 2026-04-06 JOHNDOE
912932 2026-04-12 JIMMYDOE
... ... ...

¿Cuántos datos debe leer la consulta de esta tabla?

Arquitectura de Snowflake

Micro-particiones

Ejemplo que muestra micro-particiones y cómo los datos se almacenan con columnas juntas

  • En las micro-particiones, las columnas se almacenan y comprimen por separado
  • Snowflake solo lee las columnas que necesita la consulta
Arquitectura de Snowflake

Metadatos

Ejemplo de micro-particiones con metadatos

  • Snowflake guarda metadatos por cada micro-partición
  • Se almacenan en la capa de servicios en la nube
Arquitectura de Snowflake

Depuración de particiones

Ejemplo de depuración

Arquitectura de Snowflake

Depuración de particiones

Ejemplo de depuración con opción seleccionada

  • Snowflake omite micro-particiones que no pueden contener los datos que necesita tu consulta.
  • Solo lee los fragmentos relevantes = depuración de particiones
Arquitectura de Snowflake

Clustering

Ejemplo que muestra micro-particiones y cómo los datos se almacenan con columnas juntas

  • Las consultas por fecha suelen depurar bien (p. ej., series temporales)

  • La depuración no ayuda si los valores están dispersos entre particiones (p. ej., región)

  • Clustering key: Snowflake organiza las micro-particiones en torno a esa columna

Arquitectura de Snowflake

Clustering key: cuándo usarla

clustering_key_v5.png

Arquitectura de Snowflake

Clustering key: cardinalidad y coste

clustering_key_v5.png

Arquitectura de Snowflake

¡Vamos a practicar!

Arquitectura de Snowflake

Preparing Video For Download...