Introduction to Data Engineering
Vincent Vankrunkelsven
Data Engineer @ DataCamp

आमतौर पर डेटा का बड़ा संग्रह, तेज़ खोज और पुनर्प्राप्ति के लिए व्यवस्थित.


Structured: database schema
Semi-structured
Unstructured: schemaless, फ़ाइल जैसा

{ "key": "value"}




-- Create Customer Table
CREATE TABLE "Customer" (
"id" SERIAL NOT NULL,
"first_name" varchar,
"last_name" varchar,
PRIMARY KEY ("id")
);
-- Create Order Table
CREATE TABLE "Order" (
"id" SERIAL NOT NULL,
"customer_id" integer REFERENCES "Customer",
"product_name" varchar,
"product_price" integer,
PRIMARY KEY ("id")
);

-- foreign key पर दोनों टेबल्स join करें
SELECT * FROM "Customer"
INNER JOIN "Order"
ON "customer_id" = "Customer"."id";
id | first_name | ... | product_price
1 | Vincent | ... | 10
स्टार schema में एक या अधिक fact tables होती हैं जो कई dimension tables को संदर्भित करती हैं.

Introduction to Data Engineering