मध्यवर्ती संग्रह फ़ंक्शंस

Snowflake में डेटा पाइपलाइन ऑटोमेशन

Emily Melhuish

Technical Curriculum Developer, Snowflake

ऑर्डर ऑफ ऑपरेशंस

ऑर्डर ऑफ ऑपरेशंस.png

SQL उसी क्रम में नहीं चलता जैसा आप लिखते हैं

  1. Rows: डेटासेट बनाएं
  2. Groups: उसे संक्षेपित करें
  3. Result: आउटपुट का रूप दें
1 * Snowflake लर्निंग सामग्री
Snowflake में डेटा पाइपलाइन ऑटोमेशन

सामान्य एग्रीगेट फ़ंक्शंस

  • COUNT(*) / COUNT(DISTINCT col) — कुल पंक्तियाँ; अद्वितीय मान
  • SUM — कॉलम का योग
  • AVG — औसत
  • MIN / MAX — सीमा
SELECT COUNT(*) AS total_shipments,
       COUNT(DISTINCT carrier_id) AS unique_carriers,
       SUM(delivery_days) AS total_days,
       AVG(delivery_days) AS avg_days
FROM shipments;
Snowflake में डेटा पाइपलाइन ऑटोमेशन

एकाधिक क्वेरी की समस्या

क्षेत्र और वेयरहाउस के अनुसार उपयोग लौटाएँ

SELECT 
region
, warehouse_name
, SUM(credits_used) 
FROM usage 
GROUP BY region, warehouse_name; 

क्षेत्र के उप-योग लौटाएँ

SELECT region
, SUM(credits_used) 
FROM usage GROUP BY region; 

कुल उपयोग लौटाएँ

SELECT 
SUM(credits_used) 
FROM usage;
Snowflake में डेटा पाइपलाइन ऑटोमेशन

GROUPING SETS

इनपुट

SELECT region
, warehouse_name
, SUM(credits_used) AS total 
FROM usage 
GROUP BY GROUPING SETS ( 
  (region, warehouse_name)
  , (region)
  , () 
);

आउटपुट

REGION WAREHOUSE_NAME TOTAL
EMEA harbr_wh_prod 1240.50
EMEA harbr_wh_dev 380.00
EMEA NULL 1620.50
APAC harbr_wh_prod 890.25
APAC NULL 890.25
NULL NULL 2510.75
  • नोट: CASE स्टेटमेंट से NULL में अर्थ जोड़ें
Snowflake में डेटा पाइपलाइन ऑटोमेशन

ROLLUP

इनपुट

SELECT 
region
, warehouse_name
, SUM(credits_used) AS total 
FROM usage 
GROUP BY ROLLUP (region, warehouse_name);

आउटपुट

REGION WAREHOUSE_NAME TOTAL
EMEA harbr_wh_prod 1240.50
EMEA harbr_wh_dev 380.00
EMEA NULL 1620.50
APAC harbr_wh_prod 890.25
APAC NULL 890.25
NULL NULL 2510.75
Snowflake में डेटा पाइपलाइन ऑटोमेशन

CUBE

इनपुट

SELECT 
region
, warehouse_name
, SUM(credits_used) AS total
FROM usage 
GROUP BY CUBE (region, warehouse_name);

आउटपुट

REGION WAREHOUSE_NAME TOTAL
EMEA harbr_wh_prod 1240.50
EMEA harbr_wh_dev 380.00
EMEA NULL 1620.50
APAC harbr_wh_prod 890.25
APAC NULL 890.25 }
NULL harbr_wh_prod 2130.75
NULL harbr_wh_dev 380.00
NULL NULL 2510.75
Snowflake में डेटा पाइपलाइन ऑटोमेशन

GROUPING() और GROUPING_ID()

SELECT region, warehouse_name, SUM(credits_used) AS total_credits, GROUPING(region) AS is_region_agg, GROUPING(warehouse_name) AS is_wh_agg , 
GROUPING_ID(region, warehouse_name) AS grouping_level 
FROM usage 
GROUP BY ROLLUP (region, warehouse_name);

मार्कडाउन तालिका आउटपुट का स्क्रीनशॉट

Snowflake में डेटा पाइपलाइन ऑटोमेशन

¡Vamos a practicar!

Snowflake में डेटा पाइपलाइन ऑटोमेशन

Preparing Video For Download...