logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

数据仓库术语整理

一、度量、指标、指标器度量和维度构成OLAP的主要概念,对于在事实表或者一个多维立方体里面存放的数值型的、连续的字段,就是度量。这符合上面的意思,有标准,一个度量字段肯定是统一单位,例如元、户数。如果一个度量字段,其中的度量值可能是欧元又有可能是美元,那这个度量没法汇总。在OLAP中还有计算度量的说法,用一个总费用除以用户数,得到每户平均费用。但这究竟还算不算度量了呢?这已经不是原本意义上的度..

#数据仓库
一文详解微服务架构

本文将介绍微服务架构和相关的组件,介绍他们是什么以及为什么要使用微服务架构和这些组件。本文侧重于简明地表达微服务架构的全局图景,因此不会涉及具体如何使用组件等细节。要理解微服务,首先要先理解不是微服务的那些。通常跟微服务相对的是单体应用,即将所有功能都打包成在一个独立单元的应用程序。从单体应用到微服务并不是一蹴而就的,这是一个逐渐演变的过程。本文将以一个网上超市应用为例来说明这一过程。最初的需求几

#微服务
数据仓库知识点汇总

数据仓库形象解释业务场景如下图举例说明:在很久很久以前,世界上生活着许多种族,有人类,有矮人,有精灵......他们有着不同的信仰,不同的文化,彼此相安无事。可是,有一个猥琐男却偏偏想要统治整个世界。如何统治这么多不同文化信仰的种族呢?猥琐男想出一个馊主意,打造出几枚拥有魔力的戒指,免费送给不同种族的领袖,让他们可以更好地统治各自的族人。当各个种族的领袖美滋滋地戴上各自的魔戒,走上...

#数据仓库#数据分析#架构
大数据框架--hadoop、spark、storm、flink、Samza介绍

Hadoop、Spark、Storm、Flink是比较常用的分布式计算系统1)仅批处理框架:Hadoop常用于离线的复杂的大数据处理。2)仅流处理框架:Samza与YARN和Kafka紧密集成的流处理,Storm常用于在线的实时的大数据处理。3)混合框架:Spark常用于离线的快速的大数据处理(基于内存),Flink可扩展的批处理和流式数据处理的数据处理平台。关于HadoopH...

#hadoop#spark#flink +1
hadoop、spark各大数据组件介绍

hadoop相关组件hadoop体系结构,如图:hadoop核心设计,如图Hadoop CommonHadoop体系最底层的一个模块,为Hadoop各子项目提供各种工具,如:配置文件和日志操作等。HDFS是Hadoop应用程序中主要的分布式存储系统, HDFS集群包含了一个NameNode(主节点),这个节点负责管理所有文件系统的元数据及存储了真实数据的DataNo...

#zookeeper
hadoop离线分析(简单版)-Flume

目录Flume概述应用场景Flume优势Flume架构Flume与Kafka对比Flume+Kafka双剑合璧构建大数据平台日志采集Flume安装配置Flume概述flume是由cloudera软件公司产出的可分布式日志收集系统,后与2009年被捐赠了apache软件基金会,为hadoop相关组件之一。尤其近几年随着flume的不断被完善以及升级版本的逐一...

#flume#大数据#hadoop
云服务器安全防御记录

前言由于对安全防御缺乏认识,在管理阿里云服务器一年半时间后,出现了一次业务数据库被勒索事件。具体记录就是业务数据库被删除,勒索病毒自己创建一个数据库,插入一条数据,数据大概内容就是你们的数据库已经被我黑了,我们现在还保有备份,请在什么什么日期之前转多少比特币到哪,如果不转,我们将把数据库备份删除。大概这些内容,这件事发生在要为客户演示之前一天,演示数据库丢失,由于之前已经跟开发人员沟通做好数据..

数据中心架构设计

目录功能架构技术架构总体架构功能架构技术架构总体架构

#大数据
人工智能理解与解析

中国GDP增速放缓,互联网进入中国下半场,40万亿5G新基建,AI是绝对的主角,它将彻底改变世界,改变生活。到底什么是AI呢?用一句话概括,统计学的机器延展。人工智能又称为机器智能,核心是机器,人发明的机器。让机器具备甚至超越人类的推理、认知、统筹规划、学习、交流、移动、实用工具、操作机器,甚至第六感的能力人工智能相关的伦理、哲学方面争议颇多,维度高的生物统治维度低的生物,人类大部分在第三维度,特

#人工智能
    共 19 条
  • 1
  • 2
  • 请选择