logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

hive表查询时使用中文别名

当前需求场景:每月要提供一份数据给客户,以excel表的形式,每次都要去Hive中取数据,但Hive表字段都为英文所以每次取了数据出来后还要手动处理修改成指定格式。手动操作较多较为麻烦。在hive查询时 使用英文别名是没有任何问题的,SELECT st.source_task_order A, st.creation_date B FROM tr_source_task st;但是有某些特殊需求,

#hive#大数据
hive on tez 执行任务报错

hive on tez,在执行任务的时候报错,这种情况原因是container资源被抢占或者是资源不足。而task最大的失败次数默认是4,am自己失败的最大重试次数默认是2次。分析:task_1442391298043_123239_1_01_000000,失败了4次,失败的原因是container被高优先级的任务抢占了。而task最大的失败次数默认是4。当集群上的任务比较多时,比较容易出现这个问

#大数据#hive#hdfs +1
hivesql常见的与不常见的日期格式转换 (持续更新)

12/31/2015 00:00:0012/31/2015 00:00:001/4/2016 00:00:001/4/2016 00:00:00故事起源于某日接手了 ↑ 这种日期格式的数据 mm/dd/yyyy HH:mm:ss ,需要将数据放进hive里,肯定得转成标准格式呀。baidu了很久没找到所需函数,只找到了类似的 :16/Mar/2017:12:25:01 +08...

#mysql#nosql#sql +1
删除pandas中产生的Unnamed:xx列

python在使用 pd.read_csv(xxx, sep='\t' ) 读文件时,结果df中多出了一列Unnamed:38,本来38个字段又多了一个,变成39个字段。看起来就很烦。解决方案一:pd.read_csv(path, index_col=0)pd.to_csv(path, index=False)解决方案二:用pandas处理数据是,产生了 Unnamed:0 列,解决方案如下:df

#mysql#python
记一次yum源报错解决:linux的yum命令报错Loaded plugins / Repository epel is listed more than once

执行yum install命令时报错 Loaded plugins: fastestmirror, langpacksRepository epel is listed more than once in the configuration执行yum list命令时报错Existing lock /var/run/yum.pid: another copy is running as pid 10

#linux#centos#hadoop
到底了