Nhập môn Deep Learning với PyTorch
Jasmin Ludolf
Senior Data Science Content Developer, DataCamp
Bộ tối ưu Stochastic Gradient Descent (SGD)
sgd = optim.SGD(model.parameters(), lr=0.01, momentum=0.95)



Đây là một hàm lồi.

Đây là một hàm không lồi.

lr = 0.01 momentum = 0, sau 100 bước tìm được cực tiểu tại x = -1.23 và y = -0.14
lr = 0.01 momentum = 0.9, sau 100 bước tìm được cực tiểu tại x = 0.92 và y = -2.04
$$
| Learning Rate | Momentum |
|---|---|
| Điều khiển độ lớn bước nhảy | Điều khiển quán tính |
| Quá cao → hiệu suất kém | Giúp thoát cực tiểu cục bộ |
| Quá thấp → huấn luyện chậm | Quá nhỏ → bộ tối ưu bị kẹt |
| Khoảng thường dùng: 0.01 ($10^{-2}$) và 0.0001 ($10^{-4}$) | Khoảng thường dùng: 0.85 đến 0.99 |
Nhập môn Deep Learning với PyTorch