Advertisement

《动手学深度学习》图像增强

阅读量:

图像增广

图像增广(image augmentation)技术通过对训练图像进行一系列随机变换操作来生成与原始图像相似但又有细微区别的新样本数据点以期扩大训练数据集的规模

  1. 对图像采用多样化的切割方法,在使感兴趣的物体处于不同的方位时,可以有效减少模型对于物体所在位置的依赖性。
  2. 通过调节亮度、色调等参数的操作来降低模型对于颜色特性的关注程度。

常用增广方法

我们在这里集成了一个名为torchvision的库来进行图像操作,并通过该库内置了一些图像处理功能。 torchvision.transforms模块中包含了多种图像处理方法,在调用这些方法时将原始图像作为输入即可获取到处理后的Image对象。基本操作方法如下:

复制代码
    import torchvision
    from PIL import Image
    
    img = Image.open('./cat3.jpg')
    img = torchvision.transforms.RandomHorizontalFlip()(img)

我们这里写一个函数方便测试:

复制代码
    def deal_single_img(path, deal_function):
    d2l.set_figsize()
    img2 = Image.open(pa

全部评论 (0)

还没有任何评论哟~