设置 spark 6日志配置
发布时间
阅读量:
阅读量
spark yarn日志全解
-
- 一.前言
-
二.日志聚合功能的启动方式
-
- 2.1 启动MapReduce历史服务器以实现日志聚合
- 2.2 Spark历史服务器的日志聚合开启方法
-
三.未启用日志聚合的情况说明
-
四.log4j.properties文件的规范配置与应用
-
- 一.前言
一.前言
本内容仅针对yarn模式中的日志配置进行说明。
二.开启日志聚合是什么样的
在YARN模式运行环境下,Executor进程与ApplicationMaster进程均部署于Containers容器之中。YARN针对Container日志(即Spark日志)的处理方式有两种,分别为启用日志聚合功能与不启用日志聚合功能。
-
MapReduce history server:
作为Hadoop YARN的日志聚合服务,该服务会将已完成任务的日志文件存储至HDFS系统中,待复制操作完成后,各节点本地的日志文件将会被清除。此外,HDFS上所保存的所有日志内容均可设定保留期限,以防止磁盘空间被过度占用。该服务通常使用19888端口进行访问。 -
Spark history server:
这是Spark的UI界面服务,默认情况下仅在Spark任务运行期间能够访问UI页面。
全部评论 (0)
还没有任何评论哟~
