Einführung in das Databricks Lakehouse
Gang Wang
Senior Data Scientist
$$

$$
# Default language: Python
df = spark.table("silver_taxi_trips")
display(df)
%sql
SELECT COUNT(*) AS total_trips
FROM silver_taxi_trips
%md
## Analysis notes
Revenue is **highest** in the Northeast region.
$$
| Command | Purpose |
|---|---|
%python |
Python‑Code ausführen |
%sql |
SQL‑Abfragen ausführen |
%scala |
Scala‑Code ausführen |
%r |
R‑Code ausführen |
%md |
Markdown rendern |
%sh |
Shell‑Befehle ausführen |
$$

$$
%run führt ein anderes Notebook im selben Kontext aus$$
# Gemeinsame Helferfunktionen laden
%run /Shared/utils/data_helpers
# Jetzt eine Funktion verwenden,
# die in data_helpers definiert ist
clean_df = clean_nulls(raw_df)
$$
$$

$$
%run lädt Funktionen aus anderen Notebooks in deine SessionEinführung in das Databricks Lakehouse