PyTorch学习之路（level2）——自定义数据读取

作者: jiandanjinxin | 来源:发表于2019-10-01 14:02 被阅读0次

PyTorch学习之路（level2）——自定义数据读取
Datawhale 零基础入门CV赛事-Task2 数据读取与数
pytorch自定义数据集的读取
Task 2 数据读取与数据扩增
使用Python进行数据标准化
2019-08-30pytorch 数据加载（三）
图像语义分割实践（二）数据增强与读取
Pytorch 任务四
Pytorch里面某些包的用法
pytorch使用梅尔语谱图实现自动编码器

采用torchvision.datasets.ImageFolder这个接口来读取图像数据，该接口默认你的训练数据是按照一个类别存放在一个文件夹下。但是有些情况下你的图像数据不是这样维护的，比如一个文件夹下面各个类别的图像数据都有，同时用一个对应的标签文件，比如txt文件来维护图像和标签的对应关系，在这种情况下就不能用torchvision.datasets.ImageFolder来读取数据了，需要自定义一个数据读取接口。

继承的类是torch.utils.data.Dataset，主要包含三个方法：初始化init，获取图像getitem，数据集数量 len。init方法中先通过find_classes函数得到分类的类别名（classes）和类别名与数字类别的映射关系字典（class_to_idx）。然后通过make_dataset函数得到imags，这个imags是一个列表，其中每个值是一个tuple，每个tuple包含两个元素：图像路径和标签。剩下的就是一些赋值操作了。在getitem方法中最重要的就是 img = self.loader(path)这行，表示数据读取，可以从init方法中看出self.loader采用的是default_loader，这个default_loader的核心就是用python的PIL库的Image模块来读取图像数据。

class ImageFolder(data.Dataset):
    """A generic data loader where the images are arranged in this way: ::

        root/dog/xxx.png
        root/dog/xxy.png
        root/dog/xxz.png

        root/cat/123.png
        root/cat/nsdf3.png
        root/cat/asd932_.png

    Args:
        root (string): Root directory path.
        transform (callable, optional): A function/transform that  takes in an PIL image
            and returns a transformed version. E.g, ``transforms.RandomCrop``
        target_transform (callable, optional): A function/transform that takes in the
            target and transforms it.
        loader (callable, optional): A function to load an image given its path.

     Attributes:
        classes (list): List of the class names.
        class_to_idx (dict): Dict with items (class_name, class_index).
        imgs (list): List of (image path, class_index) tuples
    """


    def __init__(self, root, transform=None, target_transform=None,
                 loader=default_loader):
        classes, class_to_idx = find_classes(root)
        imgs = make_dataset(root, class_to_idx)
        if len(imgs) == 0:
            raise(RuntimeError("Found 0 images in subfolders of: " + root + "\n"
                               "Supported image extensions are: " + ",".join(IMG_EXTENSIONS)))

        self.root = root
        self.imgs = imgs
        self.classes = classes
        self.class_to_idx = class_to_idx
        self.transform = transform
        self.target_transform = target_transform
        self.loader = loader

    def __getitem__(self, index):
        """
        Args:
            index (int): Index

        Returns:
            tuple: (image, target) where target is class_index of the target class.
        """
        path, target = self.imgs[index]
        img = self.loader(path)
        if self.transform is not None:
            img = self.transform(img)
        if self.target_transform is not None:
            target = self.target_transform(target)

        return img, target

    def __len__(self):
        return len(self.imgs)

稍微看下default_loader函数，该函数主要分两种情况调用两个函数，一般采用pil_loader函数。

def pil_loader(path):
    with open(path, 'rb') as f:
        with Image.open(f) as img:
            return img.convert('RGB')

def accimage_loader(path):
    import accimage
    try:
        return accimage.Image(path)
    except IOError:
        # Potentially a decoding problem, fall back to PIL.Image
        return pil_loader(path)

def default_loader(path):
    from torchvision import get_image_backend
    if get_image_backend() == 'accimage':
        return accimage_loader(path)
    else:
        return pil_loader(path)

看懂了ImageFolder这个类，就可以自定义一个你自己的数据读取接口了。

首先在PyTorch中和数据读取相关的类基本都要继承一个基类：torch.utils.data.Dataset。然后再改写其中的init、len、getitem等方法即可。

下面假设img_path是你的图像文件夹，该文件夹下面放了所有图像数据（包括训练和测试），然后txt_path下面放了train.txt和val.txt两个文件，txt文件中每行都是图像路径，tab键，标签。所以下面代码的init方法中self.img_name和self.img_label的读取方式就跟你数据的存放方式有关，你可以根据你实际数据的维护方式做调整。getitem方法没有做太大改动，依然采用default_loader方法来读取图像。最后在Transform中将每张图像都封装成Tensor。

class customData(Dataset):
    def __init__(self, img_path, txt_path, dataset = '', data_transforms=None, loader = default_loader):
        with open(txt_path) as input_file:
            lines = input_file.readlines()
            self.img_name = [os.path.join(img_path, line.strip().split('\t')[0]) for line in lines]
            self.img_label = [int(line.strip().split('\t')[-1]) for line in lines]
        self.data_transforms = data_transforms
        self.dataset = dataset
        self.loader = loader

    def __len__(self):
        return len(self.img_name)

    def __getitem__(self, item):
        img_name = self.img_name[item]
        label = self.img_label[item]
        img = self.loader(img_name)

        if self.data_transforms is not None:
            try:
                img = self.data_transforms[self.dataset](img)
            except:
                print("Cannot transform image: {}".format(img_name))
        return img, label

定义好了数据读取接口后，怎么用呢？

在代码中可以这样调用。

image_datasets = {x: customData(img_path='/ImagePath',
                                    txt_path=('/TxtFile/' + x + '.txt'),
                                    data_transforms=data_transforms,
                                    dataset=x) for x in ['train', 'val']}

这样返回的image_datasets就和用torchvision.datasets.ImageFolder类返回的数据类型一样.

有了image_datasets，然后依然用torch.utils.data.DataLoader类来做进一步封装，将这个batch的图像数据和标签都分别封装成Tensor。

dataloders = {x: torch.utils.data.DataLoader(image_datasets[x],
                                                 batch_size=batch_size,
                                                 shuffle=True) for x in ['train', 'val']}

另外，每次迭代生成的模型要怎么保存呢？非常简单，那就是用torch.save。输入就是你的模型和要保存的路径及模型名称，如果这个output文件夹没有，可以手动新建一个或者在代码里面新建。

torch.save(model, 'output/resnet_epoch{}.pkl'.format(epoch))

最后，关于多GPU的使用，PyTorch支持多GPU训练模型，假设你的网络是model，那么只需要下面一行代码（调用 torch.nn.DataParallel接口）就可以让后续的模型训练在0和1两块GPU上训练，加快训练速度。

model = torch.nn.DataParallel(model, device_ids=[0,1])

参考

PyTorch使用及源码解读
 Finetuning Torchvision Models
Welcome to PyTorch Tutorials
PyTorch学习之路（level2）——自定义数据读取
 https://github.com/miraclewkf/ImageClassification-PyTorch/blob/master/level2/train_customData.py

pytorch/tutorials

PyTorch学习之路（level2）——自定义数据读取
采用torchvision.datasets.ImageFolder这个接口来读取图像数据，该接口默认你的训练数据...
Datawhale 零基础入门CV赛事-Task2 数据读取与数
2 数据读取与数据扩增本章主要内容为数据读取、数据扩增方法和Pytorch读取赛题数据三个部分组成。 2.1 学...
pytorch自定义数据集的读取
写此文原因网上其实有不少关于pytorch自定义数据集的tutorial，但是之所以要写这个，是因为我发现他们并...
Task 2 数据读取与数据扩增
学习目标 python和pytorch进行图像读取-- 用Pillow来读取图片和显示图片 --这个方法是在单独的...
使用Python进行数据标准化
读取数据首先，加载pandas和numpy库，读取数据。自定义离差标准化函数结果为：也可以通过sklear...
2019-08-30pytorch 数据加载（三）
小白的自我救赎 Dataset类 pytorch数据加载可通过自定义数据集对象实现，数据集对象被抽象为Datase...
图像语义分割实践（二）数据增强与读取
图像语义分割实践（二）数据增强与读取 Pytorch数据加载顺序神经网络模型训练过程需要进行梯度更新，梯度更新可...
Pytorch 任务四
首先用numpy实现： PyTorch实现多层网络引入模块，读取数据构建计算图（构建网络模型）损失函数与优化...
Pytorch里面某些包的用法
torch.utils.data.DataLoader 主要用于数据读取的一个接口，一般在Pytorch中训练模型...
pytorch使用梅尔语谱图实现自动编码器
在上一篇文章-pytorch自定义Dataset实现数据集迭代器[https://www.jianshu.co...