Advertisement

Spark Accumulator

阅读量:

Spark-core篇—累加器

文章结构概述

  • Spark-core篇—累加器
      • 1. 达成机制
      • 2. 整体系统累加器
      • 3. 用户自定义累加器

1. 实现原理

累加器的功能是将 Executor 端的变量信息汇总至 Driver 端。在 Driver 程序中所设定的变量,会在 Executor 端的每个 Task 中生成一个独立的副本。各个 Task 在完成对副本值的更新操作后,会将这些更新后的数据反馈至 Driver 端,并进行合并处理。

系统累加器设计与实现

复制代码
    package Acc
    
    import org.apache.spark.rdd.RDD
    import org.apache.spark.{SparkConf, SparkContext}
    
    object Spark02_Acc {
      def main(args: Array[String]): Unit = {
    val conf: SparkConf = new SparkConf().setAppName("Acc").setMaster("local[*]")
    val sc: SparkContext = new SparkCon

全部评论 (0)

还没有任何评论哟~