logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

使用websocket遇到的一个小问题 The remote endpoint was in state [TEXT_PARTIAL_WRITING] which is an invalid stat

当使用websocket,向前端实时推送消息的时候,遇到如下异常:2018-06-29 13:42:55 ERROR 988 --- [container-699] org.springframework.data.redis.listener.adapter.MessageListenerAdapter : [TxId :, SpanId : ] Listener execution...

jenkins插件Git Parameter Plug-In分支构建项目

jenkins插件 Git Parameter Plug-In参数构建,可以在构建的时候选择git的某一个分支来构建服务,其中jenkins的老版本中用的Dynamic Choice Parameter这个插件,但是新版本这个插件已经被Git Parameter Plug-In它代替了。首先需要安装Git Parameter Plug-In这个插件,然后构建一个job,并且在参数化构建选

hbase和hive的相互整合(需要兼容)

也是前几天才知道,hive这玩意可以和hbase整合,就在网上找了些资料,准备用我的单节点试一试,单节点上面安装的apache版本的hbase和hive,导致整合的时候不兼容,一直报错:org.apache.hadoop.hbase.HTableDescriptor.addFamily找不到addFamily方法,所以只有用cdh的版本了(chd有对应的安装包的版本,兼容好)已经安装hbas

#hbase#hive
mongoDB同步数据到hive

sqoop作为很常用的数据同步工具,用于RDBMS和HDFS的数据迁移,但是不支持NoSql,比如说MongoDB,那如果我们需要同步mongoDB的数据到hive该怎么处理呢?下面提供下我的思路:1.我先去查询了一下mongoDB可以导出数据为CSV格式或者json格式的文件,CSV是以逗号分隔的,这样可以直接把这个文件put到hdfs中然后load到hive,但是有个问题就是:如果数据本身就自

#mongodb#nosql#hive +1
hive增量更新的新方案

之前是采用的join的方法来增量更新。详情见:http://blog.csdn.net/qq_20641565/article/details/52763663现在有一种新方案如下:Select b.id,b.name,b.addr,b.updated_dateFrom(select a.*,row_number() over(distribute by a.id sort by upd

#hive#sqoop
sparksql 简单使用

第一种:通过case classpackage cn.lijieimport org.apache.spark.{SparkConf, SparkContext}import org.apache.spark.sql.SQLContext/*** Created by jie on 2017/7/31.*/object SparkSql01 {def main(args:

hadoop集群的一些测试

hadoop的一些测试,做一个记录:一下操作都是在这个目录下面执行:/opt/cloudera/parcels/CDH/jars1.HDFS 写数据IO测试Throughput平均值: 86.73306Average IO rate平均值:89.33704IO rate std deviation平均值: 16.62124Test exec t

#hadoop#测试
使用eclipse开发spark程序 wordcount 事例

建立一个maven工程,把src下的java文件夹改为scala或者新添加scala文件夹项目结构如下:pom配置文件:<project xmlns="http://maven.apache.org/POM/4.0.0" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"xsi:schemaLocation="http://maven

#spark
hadoop dfs.datanode.du.reserved datanode预留空间

在使用hdfs存储的时候可能会遇到一个问题:明明设置hadoop dfs.datanode.du.reserved预留空间的,但是磁盘还是被写满了。当你挂载磁盘作为datanode的存储空间,如果磁盘大小为500G当你使用df -h 可能会发现上面显示(举个例子):总磁盘大小500G,使用了430G,剩余50G,这里就会有个问题:500G-(430G+50G)=20G,还差了20G空间。就是因为

#hadoop
部署Azkaban任务调度器demo

今天在虚拟机上面配置了一个Azkaban的任务调度器,这是由Linkedin公司开源的一个大批量工作流任务调度器(任务量不大的话crontab和hadoop的jobController 结合起来也可以实现任务的调度);下面我们来部署下Azkaban:1.需要下载三个包azkaban-web-server-2.5.0.tar.gzazkaban-executor-server-2.5.0.t

#hadoop
    共 16 条
  • 1
  • 2
  • 请选择