Automatyzacja potoków danych w Snowflake
Emily Melhuish
Technical Curriculum Developer, Snowflake

Przewoźnik A

Przewoźnik B


| Kategoria | Typy | Przykład |
|---|---|---|
| Numeryczne | NUMBER, INT, FLOAT | credits_used NUMBER(10,2) |
| Tekstowe | VARCHAR, STRING, TEXT | carrier_name VARCHAR |
| Data / czas | DATE, TIME, TIMESTAMP | dispatch_date DATE |
| Logiczne | BOOLEAN | is_active BOOLEAN |
| Częściowo ustrukturyzowane | VARIANT, OBJECT, ARRAY | event_payload VARIANT |
VARIANT przechowuje dane częściowo ustrukturyzowane bez schematuCOPY INTO shipment_events
FROM @harbr_stage/events/
FILE_FORMAT = (TYPE = 'JSON');

Przykład JSON
{
"shipment_id": "SHP-001",
"carrier": { "name": "FastFreight" },
"stops": [
{ "location": "Rotterdam Port" },
{ "location": "Amsterdam Hub" }
]
}
Nawigacja po JSON
Przechodzenie przez strukturę:
<column>:<level1_element>.<level2_element>
SELECT
event:id::STRING AS shipment_id
, event:carrier.name::STRING AS carrier
, event:stops[0]:location::STRING
AS first_stop
FROM shipment_events;

SELECT
s.event_data:shipment_id::STRING AS shipment_id,
f.value:location::STRING AS stop,
f.value:arrived_at::TIMESTAMP AS arrived_at
FROM shipment_events s,
LATERAL FLATTEN(input => s.event_data:stops) f;

Automatyzacja potoków danych w Snowflake