Advertisement

快速掌握Hadoop上的数据仓库工具 Hive(附超实用示例)

阅读量:

Hive功能

基于Hadoop构建的一套数据分析平台

Hive不适用于在线事务操作,并不支持实时查询功能。它最适合应用于基于固定不变的数据集合的作业场景。它的特点包括:支持动态扩展资源,在分布式计算环境中灵活部署硬件资源;提供弹性扩展能力,在资源不足时自动增减计算资源以满足负载需求;具备容错机制,在节点故障时能够自动切换到备用节点以保证任务顺利完成;输入接口具有松散耦合特性,在数据转换时能灵活兼容多种输入格式而不受限制。

内部表

Hive的内部表与数据库中的Table在概念上类似于数据库中的关系表,在功能上也有许多相似之处。每个Table都对应有一个存储其相关元数据和原始数据的数据目录,默认情况下当删除某个表时,默认情况下其相关的元数据和原始数据也会被删除

内部表示例:

创建数据文件:test_inner_table.txt

创建表:create table test_inner_table (key string)

加载数据:LOAD DATA LOCAL INPATH ‘filepath’ INTO TABLE test_inner_table

全部评论 (0)

还没有任何评论哟~