hadoop4hive入门
·
1.使用hive处理数据底层都是执行的maprecuce程序
2.hive的基础架构:
(1)元数据存储:通过外置关系型数据存储,如mysql
元数据管理功能,即: 数据位置 数据结构 对数据进行描述 进行记录
(2)SQL解析器:SQL到maprecude程序的转换
3.hive执行步骤
用户编写sql--hive转为mapreduce--查询元数据--提交到yarn执行
4.hive是单机工具,但提交mapreduce可以分布式计算
5.hive启动
(1)首先启动metastore,再启动hive
(2)Hive的数据存储在HDFS的:/user/hive/warehouse中
6.图形化界面操作hive
HiveServer2是Hive内置的一个ThriftServer服务,提供Thrift端口供其它客户端链接

连接方法:
启动必须项:首先启动metastore服务,然后启动hiveserver2服务。最后再用图像化界面连接
更多推荐
所有评论(0)