logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

大数据基础设施Apache Hadoop简介

一、项目起源在数据量很大的情况下,单机的处理能力无法胜任,必须采用分布式集群的方式进行处理,而用分布式集群的方式处理数据,实现的复杂度呈级数增加。早在 2003 年的时候,Google 就已经面对大于 600 亿的搜索量。但是数据的大规模处理技术还处在彷徨阶段。当时每个公司或者个人可能都有自己的一套工具处理数据。却没有提炼抽象出一个系统的方法。在海量数据处理的需求下,一个通用的分布式数据处理技术框

文章图片
#mapreduce#hadoop#hdfs +1
规则引擎在数据治理平台的实践

在数据治理时,经常会遇到个性化统计分析的场景:基于数据的某些属性进行组合筛选,只有符合条件的数据才进行统计分析。为了方便可视化筛选数据,基于规则引擎提供个性化配置能力

#大数据#java
使用命令行启动 VirtualBox 虚拟机

查看所有虚拟机"D:\Program Files\Oracle\VirtualBox\VBoxManage.exe" list vms查看正在运行的虚拟机"D:\Program Files\Oracle\VirtualBox\VBoxManage.exe" list runningvms无界面启动"D:\Pr

到底了