当前位置: 首页 > news >正文

制作网站常用软件小白如何做网站

制作网站常用软件,小白如何做网站,建网站需要买些什么,网站地图 用户体验论文下载:https://openreview.net/pdf?idr1xMH1BtvB 另一篇分析文章:ELECTRA 详解 - 知乎 一、概述 对BERT的token mask 做了改进。结合了GAN生成对抗模型的思路,但是和GAN不同。 不是对选择的token直接用mask替代,而是替换为…

论文下载:https://openreview.net/pdf?id=r1xMH1BtvB

另一篇分析文章:ELECTRA 详解 - 知乎

一、概述

对BERT的token mask 做了改进。结合了GAN生成对抗模型的思路,但是和GAN不同。

不是对选择的token直接用mask替代,而是替换为一个生成器网络产生的token。

然后训练模型时并不是只被破坏的token,而是训练一个辨别模型来预测这些被破坏的输入的每一个token是否是被生成模型生成的样本替代的。因为将GANs应用于文本很困难,所以生成损坏token的生成器是以最大似然进行训练的。

小generator和大discriminator共同训练,但判别器的梯度不会传给生成器

fine-tuning 时丢弃generator,只使用discriminator

二、网络结构和训练

1、模型训练两个网络G和D。

        G:给定位置t,将该位置token替换为mask,输入到G,G输出一个概率,结合softmax层,来产生mask位置的xt,从而G产生损坏的输入。输出只在mask的token中计算分数,不是所有的token。

        D:给定位置t,D预测xt是否是真的。输出只在mask的token中预测是不是真的,不是所有的。

        对于给定一个随机位置序列,原始输入对应位置替换为[MASK] token,输入G,G学习恢复原始序列。D来分辨哪些token是被生成器产生的样本替换的。

文本损坏过程描述为:

2、损失函数为:

MLM损失的计算只计算m个,即m个被masked tokens

Disc损失 t的取值到 1..n,每个token都会更新参数

        在训练过程中,discriminator的loss不会反向传播到generator(因为generator的sampling的步骤导致),在pre-training之后,只使用discriminator进行fine-tuning.

http://www.yayakq.cn/news/824640/

相关文章:

  • 各类网站排名深圳龙岗高端网站建设
  • 教育类手机网站模板海城百度公司 海城网站建设
  • 苏州那家公司做网站好关键词优化方法
  • 网站如何做用户的实名认证能打开任何网站浏览器下载
  • 网站制作方案有哪些20个简单的网页设计作品
  • 网站被别人做了跳转开发者模式有什么好处和坏处
  • 外贸营销网站怎么建站爱查企业在线查询
  • qq在线网站代码专业做邯郸网站优化
  • 打开有些网站显示建设中申请免费个人网站空间
  • 昆明凡科建站常州营销型网站建设
  • wordpress 托管建站龙岩做网站的
  • 深圳微商城网站制作报价832贫困地区农副产品网络销售平台
  • 营销型网站免费模板廊坊网站群建设
  • 网站运营的重要性wordpress 退出块引用
  • 网站常用布局方法成都有哪些软件开发公司
  • 网站推广需要数据整改吗济南网站建设seo优化
  • flash网站建设个人简介公司网站建设要注意什么
  • 做招标网站 如何网站首选域301如何做
  • 模板网站建设公司电话浙江鼎兴建设有限公司网站
  • ui设计通常是指如何进行网站优化设计
  • 石排仿做网站wordpress 提示
  • 泗水县建设局的网站怎么打开怎么制作自己的商城
  • 做网站和管理系统电器网站建设目的
  • 深圳建设网站排名深圳网站设计公司发展历程
  • 在工商局网站做变更需要多久物流网站的建设
  • html 5网站欣赏深圳双语网站制作
  • 网站设计过程怎么写陕西购物商城网站建设
  • logofree制作网站wordpress更改数据库密码
  • 建立一平台个网站需要多少钱海外网络推广定制
  • wordpress网站地图网站为什么打不开