logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

maven加速下载依赖的解决方法

1) clean,compile,build,package,install等应用编译打包的参数。2) 四个主要组成:我是谁、我的依赖仓库源、我依赖谁、如何构建3) 镜像:mirror,核心作用:加速依赖包的下载       中央仓库:maven官方提供的仓库源       第三方开放镜像仓库:阿里云、oschina、csdn等等。       第三方不开放的仓库:收费服务     ...

#maven
hive数据模型

Hive 中所有的数据都存储在 HDFS 中,Hive 中包含以下数据模型:Table,External Table,Partition,Bucket

#hive
hive架构设计与运行流程 图解

Hive是基于Hadoop的数据仓库,使用HQL作为查询接口、HDFS作为存储底层、mapReduce作为执行层,基于Hadoop平台解决了企业数据仓库构建的核心技术问题,证明了Hadoop平台的强大。从而进一步降低了Hadoop使用的准入门槛。以下为hive的架构设计与运行流程.用户接口主要有三个:CLI命令行,Client 和 Web UI.metaStore: hive 的元数据结构描述信.

#hive
hive中grouping sets的使用

GROUPING SETS:根据不同的维度组合进行聚合,等价于将不同维度的GROUP BY结果集进行UNION ALLGROUPING__ID:表示结果属于哪一个分组集合,属于虚字段CUBE:根据GROUP BY的维度的所有组合进行聚合。ROLLUP:为CUBE的子集,以最左侧的维度为主,从该维度进行层级聚合。关于grouping sets的使用...

文章图片
#hive
到底了