Snowflakeにおけるデータパイプラインの自動化
Emily Melhuish
Technical Curriculum Developer, Snowflake

キャリア A

キャリア B


| カテゴリ | 型 | 例 |
|---|---|---|
| 数値 | NUMBER, INT, FLOAT | credits_used NUMBER(10,2) |
| テキスト | VARCHAR, STRING, TEXT | carrier_name VARCHAR |
| 日付/時刻 | DATE, TIME, TIMESTAMP | dispatch_date DATE |
| ブール値 | BOOLEAN | is_active BOOLEAN |
| 半構造化 | VARIANT, OBJECT, ARRAY | event_payload VARIANT |
VARIANT は半構造化データをそのまま格納:スキーマ不要COPY INTO shipment_events
FROM @harbr_stage/events/
FILE_FORMAT = (TYPE = 'JSON');

JSONの例
{
"shipment_id": "SHP-001",
"carrier": { "name": "FastFreight" },
"stops": [
{ "location": "Rotterdam Port" },
{ "location": "Amsterdam Hub" }
]
}
JSONのナビゲーション
構造のトラバース:
<column>:<level1_element>.<level2_element>
SELECT
event:id::STRING AS shipment_id
, event:carrier.name::STRING AS carrier
, event:stops[0]:location::STRING
AS first_stop
FROM shipment_events;

SELECT
s.event_data:shipment_id::STRING AS shipment_id,
f.value:location::STRING AS stop,
f.value:arrived_at::TIMESTAMP AS arrived_at
FROM shipment_events s,
LATERAL FLATTEN(input => s.event_data:stops) f;

Snowflakeにおけるデータパイプラインの自動化