位置: IT常识 - 正文

WGAN(Wasserstein GAN)看这一篇就够啦,WGAN论文解读

编辑:rootadmin
WGAN(Wasserstein GAN)看这一篇就够啦,WGAN论文解读

推荐整理分享WGAN(Wasserstein GAN)看这一篇就够啦,WGAN论文解读,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

WGAN论文地址:[1701.07875] Wasserstein GAN (arxiv.org)

WGAN解决的问题原始GAN训练过程中经常遇到的问题:模式崩溃,生成器生成非常窄的分布,仅覆盖数据分 布中的单一模式。 模式崩溃的含义是生成器只能生成非常相似的样本(例如 ,MNIST中的单个数字),即生成的样本不是多样的。没有指标可以告诉我们收敛情况。生成器和判别器的 loss并没有告诉我们任何收敛相关信息。当然,我们可以通 过不时地查看生成器生成的数据来监控训练进度。但是, 这是一个手动过程。因此,我们需要有一个可解释的指标 可以告诉我们有关训练的进度。

一句话概括:判别器越好,生成器梯度消失越严重。

      GAN网络训练的重点在于均衡生成器与判别器,若判别器太 强,loss没有再下降,生成器学习不到东西,生成图像的质量 便不会再有提升。

        在最优判别器的下,我们可以把原始GAN定义的生成器loss 等价变换为最小化真实分布与生成分布之间的JS散度。 我们越训练判别器,它就越接近最优,最小化生成器的loss也 就会越近似于最小化真实分布与生成分布之间的JS散度。

关键点就在于如何评价生成图片和真实图片之间的距离

 JS散度存在的问题

如果希望两个分布之间越接近它们的JS散度越小,我们通过 优化JS散度就能将生成分布拉向真实分布,最终以假乱真。 这个希望在两个分布有所重叠的时候是成立的,但是如果两 个分布完全没有重叠的部分,或者它们重叠的部分可忽略, 那它们的JS散度就一直是 log2。

在原始GAN的(近似)最优判别器下,生成器loss面临梯度 消失问题。 也面临优化目标荒谬、梯度不稳定、对多样性与准确性惩罚 不平衡导致mode collapse问题。

原始GAN问题的根源可以归结为两点,

等价优化的距离衡量(JS散度)不合理生成器随机初始化后的生成分布很难与真实分布有不可 忽略的重叠

Wasserstein GAN(WGAN)就是希望解决上述两个问题

解决原始GAN问题的方法WGAN(Wasserstein GAN)看这一篇就够啦,WGAN论文解读

解决问题的关键在于使用 Wasserstein距离 衡量两个分布之间的距离 Wasserstein距离 优越性在于: 即使两个分布没有任何重叠,也可以反应他们之间的距离。

Wasserstein距离

P和Q为两个分布:P分布为一堆土,Q分布为要移到的目标,那么要移动P达到Q,哪种距离更小呢?

最好的移动方案: 

使用Wasserstein距离, 无论两个分布多远,都有梯度,都是可以更新的

WGAN设计 

原始的生成对抗网络,所要优化的目标函数为:

 此目标函数可以分为两部分来看: ①固定生成器 G,优化判别器 D, 则上式可以写成如下形式:

可以转化为最小化形式: 

②固定判别器 D,优化生成器 G,舍去前面的常数,

相当于最小化: 

我们要构建一个判别器 D,使得 D 的参数不超过某个固定的 常数,最后一层是非线性层,并且使下面式子最大化:

 这是一种数学的近似,同要求梯度变化的不要太猛。那么怎么梯度更新呢?因为D有了限制,无法直接利用SGD。 这里引入一种方法:Weight clipping 就是强制令权重w 限制在c ~ -c之间。在参数更新后,如果 w>c,则令w=c, 如果w<-c,则令w=-c

WGAN的实现

WGAN与原始GAN第一种形式相比,只改了四点:

判别器最后一层去掉sigmoid生成器和判别器的loss不取log每次更新判别器的参数之后把它们的值截断到不超过一个 固定常数c不要用基于动量的优化算法(包括momentum和 Adam),推荐RMSProp

WGAN本作引入了Wasserstein距离,由于它相对KL散度与JS 散度具有优越的平滑特性,理论上可以解决梯度消失问题。接 着通过数学变换将Wasserstein距离写成可求解的形式,利用 一个参数数值范围受限的判别器神经网络来较大化这个形式, 就可以近似Wasserstein距离。

WGAN既解决了训练不稳定的问题,也提供了一个可靠的训 练进程指标,而且该指标确实与生成样本的质量高度相关。

本文链接地址:https://www.jiuchutong.com/zhishi/297763.html 转载请保留说明!

上一篇:2023MathorcupC题电商物流网络包裹应急调运与结构优化问题建模详解+模型代码(一)(2021mathorcupc题答案)

下一篇:分享项目 - Vue3 + TS + element-ui-plus 项目 -- Table表格表单(分享项目成果)

  • 企业所得税税负率怎么算出来的
  • 存续分立的账务处理
  • 装修费用税法规定
  • 总公司是一般纳税人吗
  • 建筑工程怎么确定施工工程进度
  • 事业单位固定资产入账标准最新规定
  • 建筑企业外地预缴
  • 所得税申报表里季初资产是指什么
  • 记账凭证的附件包括哪些
  • 外购固定资产的计税基础
  • 未缴纳个人所得税承诺书模板
  • 工业企业小规模纳税人的认定标准
  • 借款合同印花税纳税期限
  • 辅导期一般纳税人预缴增值税
  • 提示涉税风险该怎么弄
  • 人工服务费发票
  • 烟草企业发生的广告和宣传费在当年营业收入15
  • 独立核算分公司可以享受小型微利企业优惠吗
  • 历史成本重置成本属于会计是什么
  • 公司缴纳递延所得税吗
  • 建筑队能开哪些项目
  • 劳务派遣个税怎么扣
  • 营改增后城建税怎么算
  • 商业企业向供货方收取的返还收入
  • 股东变更交印花税会计分录
  • 房屋出租收入是多少
  • 电脑怎么更新系统日期
  • 商业承兑汇票分为哪两种
  • 出售报废固定资产的净损失计入什么科目
  • 如何安全的处置电子邮件
  • 苹果15手机价格和图片颜色
  • 固定资产未计提完毕怎么报废
  • 车辆购买保险发票未回怎么做会计分录
  • php操作mysql的特点
  • php的运算符主要包括哪些?
  • 上市公司回购股票意味着什么
  • html调查问卷简单代码
  • 员工报销发票怎么做账
  • jsoup js
  • unity udim
  • PHP 中 DOMDocument保存xml时中文出现乱码问题的解决方案
  • php获取用户信息
  • lpstat命令
  • 命令启动服务管理
  • wordpress小工具开发
  • 其他综合收益属于什么类
  • 增值税申报表销项税额怎么算?
  • 核定征收的收入
  • 差旅费报销有哪些
  • 劳务费走应付职工薪酬
  • 填写记账凭证的日期一般是会计人员填制记账凭证的
  • 发票冲红和作废有啥区别
  • 本月发料凭证会计分录
  • 收据可以入账报销吗
  • 少数股东权益如何保障
  • 年金现值和年金终值的例题
  • 自来水差额征税申报表填写
  • 跨年度固定资产转为在建工程怎么计算
  • 新手入门会计
  • mysql 5.7.18 winx64 免安装 配置方法
  • Windows Server 2008下共享资源访问走捷径
  • freebsd 升级
  • windows的使用
  • win10系统怎么调整字体大小
  • win7卸载软件时显示program
  • linux命令tee
  • win10一直显示正在启动
  • js判断div是否有滚动条
  • json和ui
  • 将txt文件名批量导入excel
  • css中显示
  • python中数字运算
  • python怎么用命令行
  • node. js教程
  • 工具类的作用
  • imageview tint
  • python的读写文件
  • 点击电子税务局里的税务数字账户不跳转怎么回事
  • 专利转让个人所得税转换为经营所得
  • 党建共建的目的意义
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设