Spark Accumulator
发布时间
阅读量:
阅读量
Spark-core篇—累加器
文章结构概述
- Spark-core篇—累加器
-
- 1. 达成机制
- 2. 整体系统累加器
- 3. 用户自定义累加器
-
1. 实现原理
累加器的功能是将 Executor 端的变量信息汇总至 Driver 端。在 Driver 程序中所设定的变量,会在 Executor 端的每个 Task 中生成一个独立的副本。各个 Task 在完成对副本值的更新操作后,会将这些更新后的数据反馈至 Driver 端,并进行合并处理。
系统累加器设计与实现
package Acc
import org.apache.spark.rdd.RDD
import org.apache.spark.{SparkConf, SparkContext}
object Spark02_Acc {
def main(args: Array[String]): Unit = {
val conf: SparkConf = new SparkConf().setAppName("Acc").setMaster("local[*]")
val sc: SparkContext = new SparkCon
全部评论 (0)
还没有任何评论哟~
