Automatisering van datapijplijnen in Snowflake
Emily Melhuish
Technical Curriculum Developer, Snowflake

Vervoerder A

Vervoerder B


| Categorie | Typen | Voorbeeld |
|---|---|---|
| Numeriek | NUMBER, INT, FLOAT | credits_used NUMBER(10,2) |
| Tekst | VARCHAR, STRING, TEXT | carrier_name VARCHAR |
| Datum / tijd | DATE, TIME, TIMESTAMP | dispatch_date DATE |
| Booleaans | BOOLEAN | is_active BOOLEAN |
| Semi-gestructureerd | VARIANT, OBJECT, ARRAY | event_payload VARIANT |
VARIANT slaat semi-gestructureerde data ongewijzigd op: geen schema nodigCOPY INTO shipment_events
FROM @harbr_stage/events/
FILE_FORMAT = (TYPE = 'JSON');

Voorbeeld-JSON
{
"shipment_id": "SHP-001",
"carrier": { "name": "FastFreight" },
"stops": [
{ "location": "Rotterdam Port" },
{ "location": "Amsterdam Hub" }
]
}
JSON navigeren
Structuur doorlopen:
<kolom>:<niveau1_element>.<niveau2_element>
SELECT
event:id::STRING AS shipment_id
, event:carrier.name::STRING AS carrier
, event:stops[0]:location::STRING
AS first_stop
FROM shipment_events;

SELECT
s.event_data:shipment_id::STRING AS shipment_id,
f.value:location::STRING AS stop,
f.value:arrived_at::TIMESTAMP AS arrived_at
FROM shipment_events s,
LATERAL FLATTEN(input => s.event_data:stops) f;

Automatisering van datapijplijnen in Snowflake