Intermediate Deep Learning with PyTorch
Michal Oleszak
Machine Learning Engineer

![]()
每個像素包含顏色資訊
灰階影像:0 - 255 的整數


理想的目錄結構:
clouds_train- cumulus- 75cbf18.jpg - ...- cumulonimbus - ...clouds_test- cumulus - cumulonimbus - ...
clouds_train 與 clouds_testfrom torchvision.datasets import ImageFolder from torchvision import transformstrain_transforms = transforms.Compose([ transforms.ToTensor(), transforms.Resize((128, 128)), ])dataset_train = ImageFolder( "data/clouds_train", transform=train_transforms, )
定義轉換:
建立資料集並傳入:
dataloader_train = DataLoader(
dataset_train,
shuffle=True,
batch_size=1,
)
image, label = next(iter(dataloader_train))
print(image.shape)
torch.Size([1, 3, 128, 128])
image = image.squeeze().permute(1, 2, 0)
print(image.shape)
torch.Size([128, 128, 3])
import matplotlib.pyplot as plt
plt.imshow(image)
plt.show()

train_transforms = transforms.Compose([transforms.RandomHorizontalFlip(), transforms.RandomRotation(45),transforms.ToTensor(), transforms.Resize((128, 128)), ])dataset_train = ImageFolder( "data/clouds/train", transform=train_transforms, )
資料增強:對原始影像隨機套用轉換以產生更多資料

Intermediate Deep Learning with PyTorch