Hbase的核心概念及其应用
发布时间
阅读量:
阅读量
Hbase
谷歌—BigTable论文
具备海量数据存储能力、列式存储结构、高度可扩展性(依托RS/HDFS)、支持高并发访问以及稀疏性特征(尤其体现在Hbase列的灵活性上,用户可在列族中定义任意数量的列,且在列数据为空时不会占用存储空间)
Hadoop Database是一种具备高可靠性、高性能、面向列设计、可扩展性强且支持实时读写的分布式数据库系统
采用Hadoop HDFS作为其底层文件存储架构,通过Hadoop MapReduce处理HBase中庞大的数据集,并借助Zookeeper实现分布式协调服务
主要用于存储非结构化及半结构化的松散数据类型
运行效率较高的原因在于:用户操作的是数据的标识符,而非直接操作原始数据,只有在后续进行数据合并或拆分时才会实际处理数据内容
一、HBASE数据模型
| Row Key | Time Stamp | CF1 | CF2 | CF3 |
|---|---|---|---|---|
| 11248112 | t6 | CF2:q1=val1 | CF3:q3=val3 | |
| 11248112 | t3 | |||
| 11248112 | t2 | CF1:q2=val2 |
RowKey
- RowKey:作为一种字节数组形式,其在表中扮演着每条记录“主键”的角色,能够实现高效的数据检索,因此其设计具有关键意义;
确定单行数据的唯
全部评论 (0)
还没有任何评论哟~
