scaler = torch.amp.GradScaler("cuda") for inputs, targets in loader: optimizer.zero_grad(set_to_none=True) with torch.amp.autocast("cuda"): loss = loss_fn(model(inputs), targets) scaler.scale(loss).backward() scaler.step(optimizer) scaler.update()