Hadoop的整理与面试题(第九)
发布时间
阅读量:
阅读量
文件默认容量设定为64M,若调整为128M将产生何种影响?
2.RPC的工作机制是怎样的?
3.NameNode与SecondaryNameNode之间存在哪些异同点?
4.请详细描述MapReduce的完整流程,并以WordCount为例,具体说明其执行过程(特别强调Shuffle阶段)?
5.MapReduce在运行过程中,单个节点承受的最大负载是多少?如何实现负载的均衡分配?
6.MapReduce是如何完成Top10计算的?
7.Hadoop底层的数据存储架构是怎样的?
8.Zookeeper具备哪些优势?通常应用于哪些场景中?
9.HBase中的metastore主要承担什么功能?
10.在HBase进行数据模型设计时,应重点关注哪些方面?一张表中设置多少个Column Family最为适宜?原因是什么?
11.有哪些方法可以提升HBase客户端的读写效率?请举例加以说明。
12.在Hadoop开发过程中,曾使用过哪些算法?这些算法分别适用于什么样的应用场景?
13.MapReduce程序是如何进行发布的?如果MapReduce任务中引入了第三方jar包,应该如何处理?
14.在实际工作中使用过哪些集群管理工具,请分别说明其具体功能和作用。
全部评论 (0)
还没有任何评论哟~
