当前位置: 首页 > news >正文

爱站网长尾关键词挖掘汕头房地产网

爱站网长尾关键词挖掘,汕头房地产网,品牌策划公司经营范围包括哪些,企业网站建设基本原则概述 共享变量 共享变量的工作原理Broadcast VariableAccumulator 共享变量 共享变量的工作原理 通常,当给 Spark 操作的函数(如 mpa 或 reduce) 在 Spark 集群上执行时,函数中的变量单独的拷贝到各个节点上,函数执行时,使用…

概述

  • 共享变量
    • 共享变量的工作原理
    • Broadcast Variable
    • Accumulator

共享变量

共享变量的工作原理

通常,当给 Spark 操作的函数(如 mpareduce) 在 Spark 集群上执行时,函数中的变量单独的拷贝到各个节点上,函数执行时,使用的是自己节点执行上的变量,节点上的变量更新不会更新至 driver ,在任务之间支持通用的读写共享变量是低效的;然而,Spark 的提供了两种有限类型的共享变量:broadcast variablesaccumulators

Broadcast Variable

Broadcast Variable会将使用到的变量,仅仅为每个节点拷贝一份,而不会为每个task都拷贝一份副本,因此其最大的作用,就是减少变量到各个节点的网络传输消耗,以及在各个节点上的内存消耗
通过调用SparkContextbroadcast()方法,针对某个变量创建广播变量
注意: 广播变量,是只读的,在算子函数内,使用到广播变量时,每个节点只会拷贝一份副本。可以使用广播变量的value()方法获取值。

由下图,深入理解 Broadcast Variable
在这里插入图片描述
由图可知,普通变量Broadcast Variable 区别就是,网络传输可以大大的降低,Broadcast Variable 是每个节点机器只有一份,而 普通变量 是每个 task 都会有一份,浪费内存存储。

可以想象一个极端情况,如果map算子有10个task,恰好这10个task还都在一个worker节点上,那么这个时候,map算子使用的外部变量就会在这个worker节点上保存10份,这样就很占用内存了。

接下来通过具体的案例,来使用一下这个广播案例;代码如下图:

object BroadcastOpScala {def main(args: Array[String]): Unit = {val conf = new SparkConf()conf.setAppName("BroadcastOpScala").setMaster("local")val sc = new SparkContext(conf)val dataRdd = sc.parallelize(Array(1, 2, 3, 4, 5))val variable = 2// 1.定义广播变量val variableBroadcast = sc.broadcast(variable)// 2.使用广播变量,调用其 value方法dataRdd.map(_ * variableBroadcast.value).foreach(println _)}
}

在这里插入图片描述

Accumulator

Spark 提供的 Accumulator,主要用于多个节点对一个变量进行共享性的操作。
正常情况下在 Spark的任务中,由于一个算子可能会产生多个 task 并行执行,所以在这个算子内部执行的聚合计算,都是局部的,想要实现多个 task 进行全局聚合计算,此时就需要用到 Accumulator 这个共享的累加变量 。

注意: Accumulator只提供了累加的功能。在task只能对Accumulator进行累加操作,不能读取它的值。只有在Driver进程中才可以读取Accumulator的值。

代码如下:

object AccumulatorOpScala {def main(args: Array[String]): Unit = {val conf = new SparkConf()conf.setAppName("AccumulatorOpScala").setMaster("local")val sc = new SparkContext(conf)val dataRDD = sc.parallelize(Array(1,2,3,4,5))// 1.定义累加变量val sumAccumulator = sc.longAccumulator// 2.使用累加变量dataRDD.foreach(sumAccumulator.add(_))println(sumAccumulator.value)}
}

在这里插入图片描述

结束

至此共享变量就结束了,如有问题,欢迎评论区提问。

http://www.yayakq.cn/news/666306/

相关文章:

  • 做网站互联网公司自己做的网站怎么备案
  • 江门网站建设优化怎么制作手机
  • 石家庄论坛建站模板怎么创立网站
  • 网站在线留言怎么做临沂网站建设公司
  • 电商网站 流程图郑州网站建设市场
  • 建设网站需要收费吗扬州做公司网站的公司
  • 做网站如何避免商标侵权成都到西安高铁
  • 三优科技 网站开发菏泽建设网站
  • 网站中全景是怎么做的培训加盟网站建设
  • 吉林市做网站公司石家庄规划建设局网站
  • 自助建站系统模板sae wordpress 安装插件
  • 网站安全建设模板lnmp wordpress 404
  • 宣传类的网站有哪些门户网站开发公司排名
  • 制作一个网站要花多少钱烟台网站建设4038gzs
  • WordPress仿站培训网络下载的网站模板能直接上传到虚拟主机
  • 网站流启博微分销系统
  • 电子商务网站设计案例知名企业的企业文化
  • 北京团建网站网页代理访问
  • 做淘口令网站网站维护费用怎么收
  • 个人建设图片分享网站ccg 搭建wordpress
  • 沈阳设计网站公司在中国做网站网站违法吗
  • 怎么自己写网站温州网站建设联系电话
  • wordpress+采集评论seo最新技巧
  • 网站建设合同用缴印花税吗免费公司网站模版
  • 课题组网站建设织梦网站多少钱
  • 可以制作网站的软件是什么销量不高的网站怎么做
  • 西安建站平台哪个好哪些网站可以做迁徙图
  • 手机网站建设哪儿好广西网络品牌推广哪家公司好
  • 怎么做公司免费网站韩国网站设计风格
  • 网站需要多少钱质量好网站建设加工