logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

spark streaming(实时流词频统计)

首先在idea里导入maven依赖包<dependency><groupId>org.apache.kafka</groupId><artifactId>kafka_2.11</artifactId><version>2.0.0</version></dependency><dependency&

#大数据#spark#kafka
hive函数及其性能优化

目录一、函数的分类二、Hive内置函数三、UDF开发流程四、hive事务五、hive的优化设计六、压缩算法一、函数的分类从输入输出角度分类标准函数:一行数据中的一列或多列为输入,结果为单一值聚合函数:多行的零列到多列为输入,结果为单一值表生成函数:零个或多个输入,结果为多列或多行从实现方式分类内置函数自定义函数UDF:自定义标准函数UDAF:自定义聚合函数UDTF:自定义表生成函数二、Hive内置

#hive#数据库
到底了