Data-Pipelines mit Airflow aufbauen
Volker Janz
Senior Developer Advocate at Astronomer
@task.bash
def export_data():
return "cp /data/sales.csv /export/sales_{{ ds }}.csv"
{{ ds }} rendert das logische Datum im Format YYYY-MM-DDbash_command, sql)
Lauf 1 (31. März):
Lauf 2 (erneuter 31. März):

staged_rows = SQLExecuteQueryOperator( task_id="get_staged_rows", conn_id="duckdb_default", sql="SELECT * FROM staging WHERE date = '{{ ds }}'", )load = SQLInsertRowsOperator( task_id="load_sales", conn_id="duckdb_default", table_name="sales", columns=["date", "product", "amount"], preoperator="DELETE FROM sales WHERE date = '{{ ds }}';", rows=staged_rows.output, )
$$
UPSERT- oder MERGE-Ansätze


Data-Pipelines mit Airflow aufbauen