logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

使用scala语言,实现以下功能:消费kafka数据,写入doris数据库

以下是一个使用Scala编写的示例代码,实现从Kafka消费数据并写入Doris数据库的功能。代码依赖spark-sql和库,采用Spark Structured Streaming实现流式处理。

文章图片
#scala#kafka
时序库influxdb基础信息

nfluxDB 是一种高性能的开源时序数据库,专门用于存储和查询时间序列数据。它由 InfluxData 开发,首次发布于 2013 年,用 Go 语言编写,注重性能、可扩展性和开发者的生产力。InfluxDB 适用于监控性能指标、物联网数据和实时数据分析等场景。

文章图片
#数据库#时序数据库
数据治理:数据指标管理平台解决方案

数据指标是数据化管理的核心内容之一,从事数据工作的同学相信都经历过以下场景:1.经营分析汇报会上,产品和运营的汇报内容都包含了AppMAU指标,但是数据却不一样,老板“什么情况,谁的数据是准的!”2.数据可视化平台上,经营概况页面上有一个指标叫券后营收,营销概况有一个指标叫优惠券抵扣营收,两个指标什么关系呢,数据相同(指标口径一样,名称不一样)。3.数据产品上很多指标看名称并不理解指标含义,指标文

文章图片
#大数据
云计算工程师(初级)认证

云计算工程师(初级)

文章图片
#云计算
Metadata(元数据)在 Data Fabric 中的作用与构建方法

元数据是数据编织的核心,通过增强数据目录、激活元数据和丰富知识图,数据编织可以实现从被动元数据到主动元数据的转换,并通过AI/ML技术自动化数据集成和管理任务。这种自动化不仅提高了数据管理的效率,还增强了数据治理和分析能力,为企业提供了更智能的数据管理解决方案。

文章图片
#运维
云计算工程师(初级)认证

云计算工程师(初级)

#云计算
到底了