Введение в Databricks Lakehouse
Gang Wang
Senior Data Scientist
$$

$$
# Default language: Python
df = spark.table("silver_taxi_trips")
display(df)
%sql
SELECT COUNT(*) AS total_trips
FROM silver_taxi_trips
%md
## Analysis notes
Revenue is **highest** in the Northeast region.
$$
| Команда | Назначение |
|---|---|
%python |
Выполнить код Python |
%sql |
Выполнить SQL-запросы |
%scala |
Выполнить код Scala |
%r |
Выполнить код R |
%md |
Отобразить Markdown |
%sh |
Выполнить команды оболочки |
$$

$$
%run выполняет другой ноутбук в том же контексте$$
# Load shared helper functions
%run /Shared/utils/data_helpers
# Now use a function defined
# in data_helpers
clean_df = clean_nulls(raw_df)
$$
$$

$$
%run загружает функции из других ноутбуков в текущий сеансВведение в Databricks Lakehouse