深度学习（PyTorch）——生成对抗网络（GAN)

2023年7月21日下午3:00 • 人工智能 • 阅读 57

一、GAN的基本概念

GAN是由Ian Goodfellow于2014年首次提出，学习GAN的初衷，即生成不存在于真实世界的数据。类似于AI具有创造力和想象力。

GAN有两大护法G和D:

G是generator，生成器: 负责凭空捏造数据出来

D是discriminator，判别器: 负责判断数据是不是真数据

这样可以简单看作是两个网络的博弈过程。在原始的GAN论文里面，G和D都是两个多层感知机网络。GAN操作的数据不一定非是图像数据，在此用图像数据为例解释以下GAN：

上图中，z是随机噪声（随机生成的一些数，也是GAN生成图像的源头）。D通过真图和假图的数据，进行一个二分类神经网络训练。G根据一串随机数就可以捏造出一个”假图像”出来，用这些假图去欺骗D，D负责辨别这是真图还是假图，会给出一个score。比如，G生成了一张图，在D这里评分很高，说明G生成能力是很成功的；若D给出的评分不高，可以有效区分真假图，则G的效果还不太好，需要调整参数。

二、GAN的基本原理

GAN的训练在同一轮梯度反转的过程中可以细分为2步：(1)先训练D；(2)再训练G。注意，不是等所有的D训练好了才开始训练G，因为D的训练也需要上一轮梯度反转中的G的输出值作为输入。

当训练D的时候：上一轮G产生的图片和真实图片，直接拼接在一起作为x。然后按顺序摆放成0和1，假图对应0，真图对应1。然后就可以通过D，x输入生成一个score（从0到1之间的数），通过score和y组成的损失函数，就可以进行梯度反传了。（我在图片上举的例子是batch = 1，len(y)=2*batch，训练时通常可以取较大的batch）

当训练G的时候：需要把G和D当作一个整体，这里取名叫做’D_on_G’。这个整体(简称DG系统)的输出仍然是score。输入一组随机向量z，就可以在G生成一张图，通过D对生成的这张图进行打分得到score，这就是DG系统的前向过程。score=1就是DG系统需要优化的目标，score和y=1之间的差异可以组成损失函数，然后可以采用反向传播梯度。注意，这里的D的参数是不可训练的。这样就能保证G的训练是符合D的打分标准的。这就好比：如果你参加考试，你别指望能改变老师的评分标准。

GAN模型的目标函数如下：

在这里，训练网络D使得最大概率地分对训练样本的标签（最大化log D(x)和log(1—D(G(z))))，训练网络G最小化log(1-D(G(z))），即最大化D的损失。而训练过程中固定一方，更新另一个网络的参数，交替迭代，使得对方的错误最大化，最终，G 能估测出样本数据的分布，也就是生成的样本更加的真实。

三、案例、用GAN对输入的随机数生成手写字体的图片

程序如下：

import torch
import torch.nn as nn
import torch.optim as optim
import torch.nn.functional as F
import numpy as np
import matplotlib.pyplot as plt
import torchvision
from torchvision import transforms
import os
import pandas
os.environ["KMP_DUPLICATE_LIB_OK"]="TRUE"
#&#x5BF9;&#x6570;&#x636E;&#x505A;&#x5F52;&#x4E00;&#x5316;&#xFF08;-1 --- 1&#xFF09;
tranform = transforms.Compose([
    transforms.ToTensor(),             # 0-1&#x5F52;&#x4E00;&#x5316;&#xFF1A;channel,high,width
    transforms.Normalize(0.5,0.5),     #&#x5747;&#x503C;&#xFF0C;&#x65B9;&#x5DEE;&#x5747;&#x4E3A;0.5
])

train_ds = torchvision.datasets.MNIST("data",train = True,transform = tranform,download=True)

dataloader = torch.utils.data.DataLoader(train_ds,batch_size = 64,shuffle = True)

imgs, _ =next(iter(dataloader))
print(imgs.shape)  #torch.Size([64, 1, 28, 28])

batch_size=64 &#x56FE;&#x7247;&#x5927;&#x5C0F;&#xFF1A;1,28,28
&#x5B9A;&#x4E49;&#x751F;&#x6210;&#x5668;
&#x8F93;&#x5165;&#x662F;&#x957F;&#x5EA6;&#x4E3A;100&#x7684;&#x566A;&#x58F0;&#xFF08;&#x6B63;&#x6001;&#x5206;&#x5E03;&#x968F;&#x673A;&#x6570;&#xFF09;
&#x8F93;&#x51FA;&#x4E3A;&#xFF08;1,28,28&#xFF09;&#x7684;&#x56FE;&#x7247;

linear1:100---256
linear2:256---512
linear1:512---28*28
linear2:28*28---(1,28,28)

class Generator(nn.Module):
    def __init__(self):
        super(Generator,self).__init__()
        self.main = nn.Sequential(
            nn.Linear(100,256),
            nn.ReLU(),
            nn.Linear(256,512),
            nn.ReLU(),
            nn.Linear(512, 28*28),
            nn.Tanh()
        )

    def forward(self,x):  # x&#x8868;&#x793A;&#x957F;&#x5EA6;&#x4E3A;100&#x7684;&#x566A;&#x58F0;&#x8F93;&#x5165;
        img = self.main(x)
        img = img.view(-1,28,28)
        return img

&#x5B9A;&#x4E49;&#x5224;&#x522B;&#x5668;
&#x8F93;&#x5165;&#x4E3A;&#xFF08;1,28,28&#xFF09;&#x7684;&#x56FE;&#x7247;&#xFF0C;&#x8F93;&#x51FA;&#x4E3A;&#x4E8C;&#x5206;&#x7C7B;&#x7684;&#x6982;&#x7387;&#x503C;&#xFF0C;&#x8F93;&#x51FA;&#x4F7F;&#x7528;sigmoid&#x6FC0;&#x6D3B;
BCELose&#x8BA1;&#x7B97;&#x4EA4;&#x53C9;&#x71B5;&#x635F;&#x5931;
nn.LeakyReLU  f(x):x>0,&#x8F93;&#x51FA;x&#xFF0C;&#x5982;&#x679C;x<0,输出a*x，a表示一个很小的斜率，比如0.1 0 #判别器中一般推荐使用nn.leakyrelu class discriminator(nn.module): def __init__(self): super(discriminator, self).__init__() self.main="nn.Sequential(" nn.linear(28*28,512), nn.leakyrelu(), nn.linear(512,256), nn.linear(256, 1), nn.sigmoid() ) forward(self,x): x="x.view(-1,28*28)" return # device="cuda" if torch.cuda.is_available() else 'cpu' gen="Generator().to(device)" dis="Discriminator().to(device)" d_optim="torch.optim.Adam(dis.parameters(),lr=0.0001)" g_optim="torch.optim.Adam(gen.parameters(),lr=0.0001)" loss_fn="torch.nn.BCELoss()" gen_img_plot(model,test_input): prediction="np.squeeze(model(test_input).detach().cpu().numpy())" detach()截断梯度,np.squeeze可以去掉维度为1 fig="plt.figure(figsize=(4,4))" for i in range(16): prediction.size(0)="16" plt.subplot(4,4,i+1) plt.imshow((prediction[i]+1) 2) tanh 得到的是-1 - 1之间，-》0-1之间 plt.axis("off") plt.show() test_input="torch.randn(16,100,device=device)" 16个长度为100的正态随机数 print(test_input) d_loss="[]" g_loss="[]" 训练循环 epoch range(20): d_epoch_loss="0" g_epoch_loss="0" count="len(dataloader)" len(dataloader)返回批次数 len(dataset)返回样本数 step,(img,_) enumerate(dataloader): img="img.to(device)" size="img.size(0)" random_noise="torch.randn(size,100,device=device)" d_optim.zero_grad() real_output="dis(img)" 对判别器输入真实图片 real_output对真实图片的预测结果 #得到判别器在真实图像上面的损失 d_real_loss="loss_fn(real_output,torch.ones_like(real_output))" d_real_loss.backward() gen_img="gen(random_noise)" #detach()截断生成器梯度，更新判别器梯度 fake_output="dis(gen_img.detach())" 判别器输入生成图片。fake_output对生成图片的预测 得到判别器在生成图像上面的损失 d_fake_loss="loss_fn(fake_output,torch.zeros_like(fake_output))" d_fake_loss.backward() + d_optim.step() g_optim.zero_grad() 得到生成器的损失 g_loss.backward() g_optim.step() with torch.no_grad(): =count d_loss.append(d_epoch_loss) g_loss.append(g_epoch_loss) print("epoch",epoch) gen_img_plot(gen,test_input) < code></0,输出a*x，a表示一个很小的斜率，比如0.1>

Original: https://blog.csdn.net/qq_42233059/article/details/126579791
Author: 清泉_流响
Title: 深度学习（PyTorch）——生成对抗网络（GAN)

原创文章受到原创版权保护。转载请注明出处：https://www.johngo689.com/707266/

转载文章受原作者版权保护。转载请注明原作者出处！

人工智能

【自取】最近整理的，有需要可以领取学习：

Linux核心资料大放送~

全栈面试题汇总（持续更新&可下载）

一个提高学习100%效率的工具！

【超详细】深度学习面试题目！

LeetCode Python刷题答案下载！

LeetCode Java版刷题答案下载！

LeetCode C++ 版本，抓紧保存！

LeetCode GO语言刷题答案下载！

OPenCV – QML图像处理（1）：在QML中显示OPenCV图片

写在前面以前写过一个OPenCV图像处理的工具，界面是这样的：有兴趣的朋友用用：https://pan.baidu.com/s/16_DYfTnvp8cj7aqzXAlMGQ …

人工智能 2023年7月20日
0067
机器学习-卷积神经网络之深度残差网络CIFAR10实战（四）

背景介绍：MNIST数据集识别黑白的手写数字图片，不适合彩色模型的RGB三通道图片。本次实战对CIFAR10数据集进行分析与学习。如果你不理解，你可以在下面的代码中看到解释和解释…

人工智能 2023年5月25日
00138
三种方法实现UV分量转换成风速风向（转成气象学惯例）

torch实现方法（实现torch方法主要是为了训练网络时使用，需要传入tensor类型数据）： #定义一个&#x51FD…

人工智能 2023年7月23日
0055
送你一个Python 数据排序的好方法

摘要：学习 Pandas排序方法是开始或练习使用 Python进行基本数据分析的好方法。最常见的数据分析是使用电子表格、SQL或pandas 完成的。使用 Pandas 的一大优点…

人工智能 2023年7月7日
0075
python实现kmeans聚类

目录一、先上手撸代码！ 1、导库、导数据 2、核心算法 3、可视化部分二、调库代码！（sklearn）一、先上手撸代码！ 1、首先是导入所需要的库和数据 import pan…

人工智能 2023年7月4日
0067
yolo-V4-预测框解码部分

这部分主要关于对网络输出的三个不同大小的特征层（13，13）、（26，26）、（52，52）的预测框利用先验框anchors进行解码的过程（也就是利用先验框来对模型输出的预测框进行…

人工智能 2023年7月12日
0045
Kettle【实践 06】使用 HTTP client 获取 GPC 全球商品分类代码 JSON 数据处理入库全流程（云资源分享:ktr+数据.sql）

资源链接在文章末尾，包含文件： ; 1.介绍本次获取的数据是来自【中国商品信息服务平台】的 GPC分类代码（中文版）。 GPC分类代码是国际物品编码组织（ GS1）依据GPC标…

人工智能 2023年7月2日
0082
pytorch笔记：torch.sparse类

PyTorch 提供了 torch.Tensor 来表示一个包含单一数据类型元素的多维数组。默认情况下，数组元素连续存储在内存中，从而可以有效地实现各种数组处理算法，这些算法依赖…

人工智能 2023年7月23日
0074
【联邦学习】联邦学习的应用领域、开源平台

文章目录一、联邦学习的应用二、联邦学习的开源平台参考链接一、联邦学习的应用联邦学习已经被应用于计算机视觉领域，例如医学图像分析。联邦学习也被应用于自然语言处理和…

人工智能 2023年5月23日
0074
回归分析：多元线性回归模型白话解析与案例实现

文章目录 * – 线性学习 – 多元线性回归模型 – 多元线性回归模型的python实现线性学习回归分析是研究自变量x与因变量y的关系的方法…

人工智能 2023年6月18日
0087
Anaconda下载及安装（图文）

Anaconda下载及安装（图文）文章目录 * – Anaconda下载及安装（图文）* 1、Anaconda下载* 2、Anaconda 安装* 3、配置环境* 4…

人工智能 2023年7月27日
0068
【Tensorflow学习笔记】

按照要求生成tensor #数据为0 的初始化 z1=tf.zeros([1,2]) # [1,2] 代表二维一行两列（shape） print("z1:&quo…

人工智能 2023年5月23日
0081
安装Tensorflow的简单方法

Tensorflow tensorflow是干什么的这里就不多说了，既然你已经准备磨剑了，也许早就知道你需要它是做什么。之前安装tensorflow试过了种种方法，看了各种帖子，…

人工智能 2023年7月6日
0058
PyQt5(一) PyQt5安装及配置，从文件夹读取图片并显示，模拟生成素描图像

目录一、环境配置 1.1 安装PyQt5 1.2 安装Qt工具包 1.3 配置环境变量 1.4 测试PyQt5 1.5 配置PyCharm 二、QtDesigner 窗口简单介绍…

人工智能 2023年7月5日
0076
python数据分析案例，心脏病预测

心脏病是一类比较常见的循环系统疾病。它作为全球第一大杀手，是我们不得不提前防御的疾病。我从kaggle上下载了一份心脏病数据集，利用python找出一些规律，看下哪些特征对于确诊心…

人工智能 2023年7月16日
0060
深度理解相机中的各个参数（对比度、饱和度、亮度、曝光度、锐度）

相机中和很多参数，包括对比度、饱和度、亮度、曝光度、锐度等等。不论我们是在拍照还是后期的剪辑，都缺少不了对这些参数的调整。那么接下来来详细的叙述一下这些参数以及它们的作用。对比度…

人工智能 2023年6月17日
0084

2024 年 5 月
一	二	三	四	五	六	日
		1	2	3	4	5
6	7	8	9	10	11	12
13	14	15	16	17	18	19
20	21	22	23	24	25	26
27	28	29	30	31

深度学习（PyTorch）——生成对抗网络（GAN)

大家都在看