Introduction à la modélisation des données dans Snowflake
Nuno Rocha
Director of Engineering






SELECT DISTINCT category
FROM allproducts;

SELECT TRIM(category)
FROM allproducts;

SELECT TRIM(f.value)
FROM allproducts,
LATERAL FLATTEN(INPUT => SPLIT(allproducts.category, ',')) f;

CREATE OR REPLACE TABLE categories (
category_id NUMBER(10,0) PRIMARY KEY,
category VARCHAR(255)
);
INSERT INTO : commande SQL pour insérer de nouvelles lignes dans une table.INSERT INTO categories (category_id, category)
___;
INSERT INTO categories (category_id, category)
SELECT
___,
___
FROM allproducts;
INSERT INTO categories (category_id, category)
SELECT
___,
TRIM(f.value)
FROM allproducts,
LATERAL FLATTEN(INPUT => SPLIT(allproducts.category, ',')) f;
INSERT INTO categories (category_id, category)
SELECT
ROW_NUMBER() OVER (ORDER BY TRIM(f.value)),
TRIM(f.value)
FROM allproducts,
LATERAL FLATTEN(INPUT => SPLIT(allproducts.category, ',')) f;
INSERT INTO categories (category_id, category)
SELECT
ROW_NUMBER() OVER (ORDER BY TRIM(f.value)),
TRIM(f.value)
FROM allproducts,
LATERAL FLATTEN(INPUT => SPLIT(allproducts.category, ',')) f
GROUP BY TRIM(f.value);

INSERT INTO : commande SQL pour insérer de nouvelles lignes dans une tableTRIM : fonction SQL pour supprimer les espaces au début et à la fin des valeursLATERAL FLATTEN(INPUT => SPLIT()) : fonction Snowflake pour éclater des valeurs en lignesROW_NUMBER() OVER (ORDER BY) : fonction SQL qui génère un numéro séquentielGROUP BY : clause SQL pour agréger des données ayant les mêmes valeurs-- Remplir une entité avec les données d'un résultat de requête
INSERT INTO table_name (column_name, other_columns)
SELECT
-- Générer une valeur unique à l'aide du numéro de ligne
ROW_NUMBER() OVER (ORDER BY TRIM(alias.value)),
TRIM(alias.value)
FROM another_table,
-- Scinder la valeur textuelle d'un attribut selon un délimiteur
LATERAL FLATTEN(INPUT => SPLIT(another_table.column_name, 'delimiter_value'))alias
-- Agréger les données pour assurer l'unicité des valeurs
GROUP BY TRIM(alias.value);
Introduction à la modélisation des données dans Snowflake