logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

spark:自定义分区,自定义排序,spark与jdbc,广播变量等

//自定义分区importorg.apache.spark.SparkConfimportorg.apache.spark.SparkConfimportorg.apache.spark.SparkCont...

#大数据#数据库#scala
linux 通过xmllint处理xml文件

再shell中可以通过xmllint处理xml文件,搜集别人的资料看了一下用起来不错,因为程序不止在一个机器上跑,不确定其他机器是否安装xmllint,经过实验在centos6.5版本最小化安装的情况下xmlli...

#java
通过spark将数据存储到elasticsearch

maven依赖<dependency><groupId>org.elasticsearch</groupId><artifactId>ela...

#大数据
到底了