1.使用hive处理数据底层都是执行的maprecuce程序

2.hive的基础架构:

(1)元数据存储:通过外置关系型数据存储,如mysql

元数据管理功能,即: 数据位置 数据结构 对数据进行描述 进行记录

(2)SQL解析器:SQL到maprecude程序的转换

3.hive执行步骤

用户编写sql--hive转为mapreduce--查询元数据--提交到yarn执行

4.hive是单机工具,但提交mapreduce可以分布式计算

5.hive启动

(1)首先启动metastore,再启动hive

(2)Hive的数据存储在HDFS的:/user/hive/warehouse中

6.图形化界面操作hive

HiveServer2是Hive内置的一个ThriftServer服务,提供Thrift端口供其它客户端链接

连接方法:

启动必须项:首先启动metastore服务,然后启动hiveserver2服务。最后再用图像化界面连接

更多推荐