快速掌握Hadoop上的数据仓库工具 Hive(附超实用示例)
发布时间
阅读量:
阅读量
Hive功能
基于Hadoop构建的一套数据分析平台

Hive不适用于在线事务操作,并不支持实时查询功能。它最适合应用于基于固定不变的数据集合的作业场景。它的特点包括:支持动态扩展资源,在分布式计算环境中灵活部署硬件资源;提供弹性扩展能力,在资源不足时自动增减计算资源以满足负载需求;具备容错机制,在节点故障时能够自动切换到备用节点以保证任务顺利完成;输入接口具有松散耦合特性,在数据转换时能灵活兼容多种输入格式而不受限制。
内部表
Hive的内部表与数据库中的Table在概念上类似于数据库中的关系表,在功能上也有许多相似之处。每个Table都对应有一个存储其相关元数据和原始数据的数据目录,默认情况下当删除某个表时,默认情况下其相关的元数据和原始数据也会被删除
内部表示例:
创建数据文件:test_inner_table.txt
创建表:create table test_inner_table (key string)
加载数据:LOAD DATA LOCAL INPATH ‘filepath’ INTO TABLE test_inner_table
全部评论 (0)
还没有任何评论哟~
