脚本宝典收集整理的这篇文章主要介绍了Hadoop上搭建hive;初始hhive;并运用zeppelin工具,脚本宝典觉得挺不错的,现在分享给大家,也给大家做个参考。
1.搭建好Hadoop的服务器。
2.hive压缩包 上传至/opt
3.zepPElin压缩包 上传至/opt
分区表操作:实际上就是建立一个个的文件夹,将数据按照你的分区约定,分别存放进去。分为静态分区和动态分区
创建一个分区表,id,name,birthmonth三列,其中按birthmonth分区:
%hive create table mydemo.my_part( id string, name string ) partITioned by (birthmonth string) -- 分区的那个列写在外面 row format delimited fields terminated by ','
%hive ALTER TABLE mydemo.my_part add partition(birthmonth='01') -- 实质上就是手工添加一个文件夹
此时去你的50070端口,你会发现在/hive/warehouse/mydemo.db/my_part路径下,为你生成好了一个 ‘birthmonth=01’ 文件夹
(overwrite全量表 : 会覆盖;不加就是增量表: 不会覆盖以前的数据,而是往后进行追加)
以上是脚本宝典为你收集整理的Hadoop上搭建hive;初始hhive;并运用zeppelin工具全部内容,希望文章能够帮你解决Hadoop上搭建hive;初始hhive;并运用zeppelin工具所遇到的问题。
本图文内容来源于网友网络收集整理提供,作为学习参考使用,版权属于原作者。
如您有任何意见或建议可联系处理。小编QQ:384754419,请注明来意。