使用 PyTorch 高效训练 AI 模型
Dennis Lee
Data Engineer, Amazon



for batch in dataloader:optimizer.zero_grad()inputs, targets = batch inputs = inputs.to(device) targets = targets.to(device)outputs = model(inputs)loss = outputs.lossloss.backward()optimizer.step() scheduler.step()
.to(device)Accelerator 提供分布式训练接口from accelerate import Accelerator
accelerator = Accelerator(
device_placement=True
)
device_placement(bool,默认 True):默认处理设备放置from transformers import AutoModelForSequenceClassification
model = AutoModelForSequenceClassification.from_pretrained(
"distilbert-base-cased", return_dict=True)
Adam 优化模型参数from torch.optim import Adam
optimizer = Adam(params=model.parameters(), lr=2e-5)
from transformers import get_linear_schedule_with_warmup lr_scheduler = get_linear_schedule_with_warmup( optimizer=optimizer,num_warmup_steps=num_warmup_steps,num_training_steps=num_training_steps)
optimizer(obj):PyTorch 优化器,如 Adamnum_warmup_steps(int):线性增大 lr 的步数,设为 int(num_training_steps * 0.1)num_training_steps(int):总训练步数,设为 len(train_dataloader) * num_epochsprepare 方法处理设备放置model, optimizer, dataloader, lr_scheduler = \ accelerator.prepare(model,optimizer,dataloader,lr_scheduler)
for batch in dataloader:optimizer.zero_grad()inputs, targets = batch inputs = inputs.to(device) targets = targets.to(device)
for batch in dataloader:optimizer.zero_grad()inputs, targets = batch
for batch in dataloader:optimizer.zero_grad()inputs, targets = batchoutputs = model(inputs)loss = outputs.loss loss.backward()
for batch in dataloader:optimizer.zero_grad()inputs, targets = batchoutputs = model(inputs) loss = outputs.lossaccelerator.backward(loss)optimizer.step() scheduler.step()
loss.backward 替换为 accelerator使用 Accelerator 之前
inputs.to(device)targets.to(device)loss.backward() 计算梯度使用 Accelerator 之后
accelerator.prepare(model)accelerator.prepare(dataloader)accelerator.backward(loss) 同步梯度使用 PyTorch 高效训练 AI 模型