logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

elasticsearch详解(一)——es是什么、能做什么?

es是什么elasticsearch简写es,es是一个高扩展、开源的全文检索和分析引擎,它可以准实时地快速存储、搜索、分析海量的数据。什么是全文检索全文检索是指计算机索引程序通过扫描文章中的每一个词,对每一个词建立一个索引,指明该词在文章中出现的次数和位置,当用户查询时,检索程序就根据事先建立的索引进行查找,并将查找的结果反馈给用户的检索方式。这个过程类似于通过字典中的检索字表查字的过程。全文搜

#elasticsearch#全文检索
树莓派(四)树莓派上启动samba服务

一、摘要前面几篇文章讲了,给我们的树莓派挂载上了移动硬盘,安装了下载工具,下载了很多蓝光电影,此时我们只能通过sftp或者ftp来访问树莓派,并不是很方便。当开启samba服务后,就可以通过samba服务远程将树莓派的存储资源挂载在自己的电脑上,像浏览自己电脑上的资源一样浏览树莓派上的资源。现在很多智能电视也支持连接samba,例如小米电视的里面的应用"高清播放器",可直接连接samba服务...

部署gitlab

一直使用的gogs,但是发现很多人还是用gitlab,而且gitlab功能比较强大。部署采用docker部署,省去不少部署中出现的麻烦。镜像使用官方上传的社区版本。https://hub.docker.com/r/gitlab/gitlab-ce/安装docker环境熟练使用docker,且安装过docker运行环境的跳过。安装docker运行环境,我的博客里面有一条命...

hbase(十)-hbase查询,scan filter的使用

1.ScanHBase常用的查看数据方式有scan和get,get是一种特殊的scan,get是scan的startrow和endrow等于同一个值的特殊情况。hbase的rowkey是按照B+树的形式存放的,所以查找一个具体的rowkey速度是非常快的,所以查询数据的时候一般都会设置scan的startrow和endrow,这样可以缩小查找的范围,所以rowkey的设计在hbase里面是

#hbase
nginx给wordpress反向代理,实现多域名访问wordpress

问题1:搭建好的worpress服务器用的端口不是80端口,80端口被占用,想转换到80上来。问题2:搭建好的wordpress服务器向用多个域名来指向。但是简单的修改数据库中的wp_options中的home和siteurl可不行,而且也不支持多域名。我的做法是:1.首先配置nginxserver_name www.xxx.com blog.xxx.com;location / {prox

#nginx#服务器
spark-sql(四)---读写elasticsearch数据

sparksql读写elasticsearchsparksql将elasticsearch数据转换成RDD进行计算,测试下sparksql对elasticsearch的读和写的操作。1环境1.1软件环境hadoop 2.7.3spark 2.2elasticsearch 5.6.4jdk 1.81.2机器环境节点配置组件角色...

#spark#elasticsearch
用国内地址一键安装docker

用国内地址一键安装docker以上命令适用于 Ubuntu14.04、Debian、CentOS6 、CentOS7、Fedora、Arch Linux、openSUSE Leap 42.1

hive on spark入门安装(hive2.0、spark1.5)

简介 hive on hive是基于hadoop的数据仓库,hdfs为hive存储空间,mapreduce为hive的sql计算引擎。但是由于mapreduce很多计算过程都要经过硬盘读写等劣势,和spark等计算引擎相比,无论是计算速度,还是计算灵活度上都有很多劣势,这也导致了hive on mapreduce计算速度并不是令人很满意。本篇来讲下hive on spark,将hive的计算引擎替

#hive#spark
hive源代码开发(一)--开发调试环境搭建

需要阅读hive源代码了解hive运行原理修改hive部分代码来达到业务需求可以将hive源代码下载下来进行编译运行,在本地进行调试。1.环境准备开发需要在linux环境下可以在本机上装一个ubuntu操作系统或者一个虚拟机都可以。有条件的同学可以在macbook上开发也可以linux版本的eclipse2.开发环境hive2.3jdk 1.7mav

到底了