Hadoop分布式存储系统(HDFS)
发布时间
阅读量:
阅读量
文章结构概述
-
-
HDFS 的设计目标:
- HDFS 的核心属性
- 数据副本的选取机制
- 元数据存储的磁盘异常问题
- 数据暂存处理
- 数据复制的流水线方式
- 文件访问模式
- 存储资源的释放机制
-
- 文件删除操作
- 降低副本数量
-
分布式文件系统架构
-
- 数据读取过程
- HDFS 中的数据写入操作:
-
HDFS 目标:
- 硬件错误在系统运行过程中属于常见现象而非特殊状况。
- 流式数据的访问方式
- 在HDFS中,一个标准文件的容量通常处于G字节至T字节之间
- 文件访问遵循“写入一次、读取多次”的模型。
- 文件在完成创建、写入并关闭后,其内容将不再发生变动。
- “移动计算比移动数据更划算”——将计算任务迁移至数据所在位置,相较于将数据传输至应用程序所在位置更具优势。
- 在不同软硬件平台之间的可迁移性
- Namenode 和 DataNode
基于master/slave架构进行部署。HDFS集群由一个Namenode以及若干数量的DataNodes构成。
Namenode作为集群的核心服务器,承担着管理文件系统命名空间以及处理客户端对
全部评论 (0)
还没有任何评论哟~
