PyTorch 深度学习进阶
Michal Oleszak
Machine Learning Engineer

![]()
每个像素包含颜色信息
灰度图:0–255 的整数


期望的目录结构:
clouds_train- cumulus- 75cbf18.jpg - ...- cumulonimbus - ...clouds_test- cumulus - cumulonimbus - ...
clouds_train 和 clouds_testfrom torchvision.datasets import ImageFolder from torchvision import transformstrain_transforms = transforms.Compose([ transforms.ToTensor(), transforms.Resize((128, 128)), ])dataset_train = ImageFolder( "data/clouds_train", transform=train_transforms, )
定义变换:
创建数据集,传入:
dataloader_train = DataLoader(
dataset_train,
shuffle=True,
batch_size=1,
)
image, label = next(iter(dataloader_train))
print(image.shape)
torch.Size([1, 3, 128, 128])
image = image.squeeze().permute(1, 2, 0)
print(image.shape)
torch.Size([128, 128, 3])
import matplotlib.pyplot as plt
plt.imshow(image)
plt.show()

train_transforms = transforms.Compose([transforms.RandomHorizontalFlip(), transforms.RandomRotation(45),transforms.ToTensor(), transforms.Resize((128, 128)), ])dataset_train = ImageFolder( "data/clouds/train", transform=train_transforms, )
数据增强:对原始图像随机变换以生成更多数据

PyTorch 深度学习进阶