当前位置: 首页 > news >正文

安徽省外经建设集团有限公司网站技校电子商务主要学什么

安徽省外经建设集团有限公司网站,技校电子商务主要学什么,量体定制,100个无水印短视频素材免费这是篇NIPS2023的 world model 论文文章提出,WM的误差会在训练过程中积累从而影响policy的训练,向WM中加噪声可以改善这一点。其他的流程和IRIS差不多,差别在以下几点: image encoder,IRIS用的VQVAE, 本文用的是VAE&am…

在这里插入图片描述

  • 这是篇NIPS2023的 world model 论文
  • 文章提出,WM的误差会在训练过程中积累从而影响policy的训练,向WM中加噪声可以改善这一点。
  • 其他的流程和IRIS差不多,差别在以下几点:
    • image encoder,IRIS用的VQVAE, 本文用的是VAE,用VAE的采样方式来生成zt,从而为zt加噪声。
    • sequence model,IRIS用GPT循环输出image的每个token,本文直接用MLP把生成的 z t z_t zt 和动作 a t a_t at 输出成一个token,这样GPT只需要在时序上循环而不需要在同一个 t 内的不同 token 上循环。换句话说,IRIS的一个图片是GPT中的16个token,而STORM的一个图片是GPT中的一个token。
    • hidden state,IRIS直接从 z 1 : t z_{1:t} z1:t 预测 z t + 1 z_{t+1} zt+1,相当于RNN,而 STORM先从 z 1 : t z_{1:t} z1:t 预测 h t h_{t} ht,也就是说上面的sequence model输出的不是 z ,而是hidden state h,再用一个MLP从 h t h_t ht来预测 z t + 1 z_{t+1} zt+1,这点是用了Dreamerv3的思路
    • loss function,用的也是dreamerv3的loss function
  • 完整公式和损失函数如下:
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述

Agent learning

  • 强化学习的部分和dreamerv3一样,不过强调了下value函数用的是移动平均:
    在这里插入图片描述
http://www.yayakq.cn/news/155049/

相关文章:

  • 网站建设php心得体会wordpress主题用不了
  • 织梦调用网站名称顺德搜索seo网络推广
  • 2017做哪些网站能致富企业网站托管新趋势
  • 站台建筑网站开发承诺函
  • 南京网站群建设公司如何做网站的关键词
  • 备案期间网站能用吗太原网站开发定制
  • 想自己做网站需要会什么互联网营销怎么赚钱
  • 爱站工具想说超人下拉系统景区网站建设的好处
  • 昆明网站建设开发网站开发需求文档prd模板
  • 李沧做网站广州网站设计公司推荐哪家
  • 哪里有做兼职的网站四川网站建设多少钱
  • 做外贸一般在什么网站东莞市企业网站制作平台
  • 一个域名绑定多个网站吗wordpress是不是一定要买服务器
  • 不同的网站 做301建网站的设备
  • 上海三凯监理建设管理咨询公司网站网页设计欣赏怎么做
  • 做房地产自己要花钱开网站关于汽车的网站
  • 网站开发与支付宝端口连接制作校园网站
  • 视觉品牌网站建设社交app开发公司
  • dede产品展示网站模板网站优化的主要任务
  • 无锡网站制作需要多少钱如何编写网站后台
  • 网站的下拉列表怎么做运营网站团队建设
  • 爱站站长工具收录网站工具
  • 广西建设职业学院官网网站集客营销软件
  • 网站优化要素公众号营销
  • saas和wordpresswin10一键优化工具
  • 网站建设用户需求三只松鼠有趣的软文
  • 网站建设的几大要素天津企业模板建站
  • 服务器放多个网站wordpress主题 淘客
  • 网站开发 教程网页制作培训班培训
  • 艺术家个人网站设计即时热榜