Оптимізоване завантаження даних із pandas
Amany Mahfouz
Instructor
SELECT DISTINCTSELECT DISTINCT [column names] FROM [table];
SELECT DISTINCT * FROM [table];
/* Отримати унікальні адреси та боро */
SELECT DISTINCT incident_address,
borough
FROM hpd311calls;
SUMAVGMAXMINCOUNTSUM, AVG, MAX, MINSELECT AVG(tmax) FROM weather;
COUNTSELECT COUNT(*) FROM [table_name];
SELECT COUNT(DISTINCT [column_names]) FROM [table_name];
GROUP BY/* Отримати кількість звернень щодо сантехніки по боро */
SELECT borough,
COUNT(*)
FROM hpd311calls
WHERE complaint_type = 'PLUMBING'
GROUP BY borough;
# Створіть рушій бази даних engine = create_engine("sqlite:///data.db")# Запишіть запит для підрахунку звернень щодо сантехніки по боро query = """SELECT borough, COUNT(*) FROM hpd311calls WHERE complaint_type = 'PLUMBING' GROUP BY borough;"""# Виконайте запит і створіть датафрейм plumbing_call_counts = pd.read_sql(query, engine)
print(plumbing_call_counts)
borough COUNT(*)
0 BRONX 2016
1 BROOKLYN 2702
2 MANHATTAN 1413
3 QUEENS 808
4 STATEN ISLAND 178
Оптимізоване завантаження даних із pandas