
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
1:hbase表和传统的数据库表结构的区别传统的数据库是一每行作为数据存储,在设计数据库的时候就需要设计好字段,增加字段主要修改表结构,会产生大量的冗余,hbase在设计表的时候不需要设计字段,字需要设计列族,字段在插入数据的时候再指定,并且不会造成冗余字段2:hbase的表是怎么存储的hbase是存储大量数据的数据库,所以说表一般都很大,这么大的数据不能够存储在一台机子上,所以存储的时
目录一、关系运算: 41. 等值比较: =42. 不等值比较: <>43. 小于比较: <44. 小于等于比较: <=45. 大于比较: >56. 大于等于比较: >=57. 空值判断: IS NULL58. 非空判断: IS NOT NULL69. LIKE比较: LIKE 610. JAVA的LIKE操作: RLIKE61
自定义函数有三种一:一个输入对应一个输出,比较常用,UDF二:多个输入对应一个输出,又称为聚合函数,跟count函数类似,名叫UDAF三:一个输入对应对个输出,即一个输入对应输出一张表,名叫UDTFUDF:写udf函数的时候需要继承UDF类,并且写至少一个evaluate方法,执行的时候会根据参数的多少调用对应的函数UDAF:写UDAF的时候需要继承UDAF类,并且需要实现以下方
idea的快捷键:Alt+回车 导入包,自动修正Ctrl+N查找类Ctrl+Shift+N 查找文件Ctrl+Alt+L格式化代码Ctrl+Alt+O 优化导入的类和包Alt+Insert 生成代码(如get,set方法,构造函数等)Ctrl+E或者Alt+Shift+C最近更改的代码Ctrl+R 替换文本Ctrl+F 查找文本Ctrl+Shift+Space 自动补
往消息队列里面发送数据import kafka.javaapi.producer.Producer;import kafka.producer.KeyedMessage;import kafka.producer.ProducerConfig;import java.io.IOException;import java.util.Properties;import scala.math.Num
描述:基于tcp的Socket与ServerSocket的通信,客户端和服务端的聊天实现语言:java一:服务端的代码1:服务端的键盘录入代码package chat;import java.io.BufferedReader;import java.io.BufferedWriter;import java.io.IOException;import java.io.In
国内大数据公司名单汇总大数据近几年来可谓蓬勃发展,它不仅是企业趋势,也是一个改变了人类生活的技术创新。大数据对行业用户的重要性也日益突出。掌握数据资产,进行智能化决策,已成为企业脱颖而出的关键。因此,越来越多的企业开始重视大数据战略布局,并重新定义自己的核心竞争力。本文整理了在中国境内活跃的大数据领域最具影响力的企业,它们有的是计算机或者互联网领域的巨头,有的则是刚刚创办不久的初创企业。但它...
本工具类主要用于json字符串和java对象的相互转换代码:import java.util.List;import com.fasterxml.jackson.core.JsonProcessingException;import com.fasterxml.jackson.databind.JavaType;import com.fasterxml.jackson.databind.Js
1、常规性能调优:分配资源、并行度。。。等2、JVM调优(Java虚拟机):JVM相关的参数,通常情况下,如果你的硬件配置、基础的JVM的配置,都ok的话,JVM通常不会造成太严重的性能问题;反而更多的是,在troubleshooting中,JVM占了很重要的地位;JVM造成线上的spark作业的运行报错,甚至失败(比如OOM)。3、shuffle调优(相当重要):spark在执行grou







