当前位置: 首页 > news >正文

网站版面的图文是怎么做的长沙seo排名优化公司

网站版面的图文是怎么做的,长沙seo排名优化公司,网站建设的参考文献,国内外高校门户网站建设前言 在NLP领域,预训练模型(准确的说应该是预训练语言模型)似乎已经成为各大任务必备的模块了,经常有看到文章称后BERT时代或后XXX时代,分析对比了许多主流模型的优缺点,这些相对而言有些停留在理论层面,可是有时候对于手上正在解决的任务,要用到预训练语言模型时,面…

前言

在NLP领域,预训练模型(准确的说应该是预训练语言模型)似乎已经成为各大任务必备的模块了,经常有看到文章称后BERT时代或后XXX时代,分析对比了许多主流模型的优缺点,这些相对而言有些停留在理论层面,可是有时候对于手上正在解决的任务,要用到预训练语言模型时,面对烟火缭乱的语言模型,需要如何挑选合适的模型应用到任务上来。

一个非常直接的方法就是把每一个候选模型针对任务都做一遍微调,因为微调涉及到模型训练,时间至少几个小时起步。有些预训练模型的微调还需要进行超参数搜索,想要决定一个预训练模型的迁移效果就需要将近50个小时!对于没有足够算力的我,苦苦寻觅一个能够高效的选择适合的预训练语言模型的方法,不过资料不好找呀,偶然间我才发现了这篇论文,里面提到的LogME方法值得一试。下图是该方法适配的任务:
在这里插入图片描述

多提一下,我这里说的是预训练语言模型,即在适用于NLP领域内的模型选择打分,而对于适用于CV的一些打分方案,像LEEP、NCE、H scores感兴趣的小伙伴可以找论文看看。

本文在LogME方法的相关描述上,组织基于论文作者所在学院的官方公众号上的一篇文章,可直戳原文阅读。原Paper中开源的代码使用Pytorch进行GPU加速,我在本文的最后附上我改成TensorFlow2的代码,方便直接应用在TensorFlow2的相关模型上。

前情提要

将上面提到的问题,描述成图模型,就是论文中所画出如下的这样:
在这里插入图片描述
在这个任务中,我们假设有 M M M 个预训练模型组成的集合 { ϕ m } m = 1 M \{\phi_m\}^M_{m=1} {ϕm}m=1M 和 含有 n n n 个标签的数据集 { ( x i , y i ) } i = 1 n \{(x_i,y_i)\}^n_{i=1} {(xi,yi)}i=1n,正常情况下,我们是通过微调使用各种评判指标作为衡量模型 ϕ \phi ϕ 的表现 T m T_m Tm,而现在我们想要通过一种方法得到 S m S_m S

http://www.yayakq.cn/news/947332/

相关文章:

  • 吉林网站推广公司如何创新网站建设模式
  • 平台网站设计wordpress阿里百秀5.4
  • 天门网站设计WordPress在线课堂
  • 英文网站建设 深圳开发公司组织架构及岗位职责
  • php网站开发有什么优点河南省建设厅陈华平官方网站
  • 网站开发使用什么软件建设部四库一平台查询网站
  • 未备案网站通知微商软文范例大全100
  • 学校网站建设解决方案wordpress已运行时间
  • 赞皇建站建设电商网站建设需要
  • 利用js做网站触屏手机网站建设
  • 好看的网站在哪里好找开发网站做什么
  • 炫丽的网站wordpress红酒主题
  • 建设网站管理规定太原网站制作计划
  • 芜湖新芜湖网站建设招标文件免费下载网站
  • 书法网站建站目标泉港网站建设推广服务公司
  • 卓商网站建设电商平台排行榜
  • p2p网站开发用什么平台企业分类信息网
  • 深圳网站建设外包公司排名用python 做网站
  • 建一个类似亨物说网站建设费用360建设网站免费
  • 深圳宝安建网站网站建设安全方案
  • 自己的网站怎么做app如何看一个站点是不是有wordpress
  • 保定网站制作专业外贸网站关键词
  • 公司网站设计建议北京百度seo代理
  • 给单位做网站需要多少钱帮做网站的网站
  • Paas网站建设网站备案填写电话号码
  • 做网站 南京如何在网上建立自己的网站
  • 中英文公司网站网络营销的相关知识
  • 嘉兴 网站 建设一亩田的网络营销方式
  • 信息发布网站模板下载监理网站建设价格多少
  • 网站开发 营业执照西城网站建设浩森宇特