logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【大数据体系】大数据开发能力体系增长——从初级大数据开发到高级,需要做什么

摘要 本文构建了大数据开发工程师的能力成长体系,聚焦企业级数据场景(数仓/湖仓/实时数仓/数据平台),提出以业务复杂度、系统可靠性和架构决策力为核心的职级划分标准。 能力框架分为5个维度: 数据开发与计算引擎(SQL/Spark/Flink等) 数据集成与实时同步(CDC/Kafka/调度系统) 存储与性能工程(分布式数据库/执行计划优化) 数据治理与安全(质量/血缘/指标管理) 工程化与平台能力

#大数据
【hive】一种高效增量表的实现

本文介绍了一种简洁的Hive数据更新算法,通过两阶段处理实现历史数据更新和新数据合并:1) 用CASE WHEN判断旧数据是否被更新,保留最新值;2) 用UNION ALL合并纯新增数据。算法巧妙利用LEFT JOIN和NULL判断,区分已更新数据与全新数据。参数化设计支持每日增量更新,将ODS当日数据与DWD历史数据合并生成新版本全量数据。相比row_number()去重等方法更高效,适用于Hi

#hive
(java.lang.ClassNotFoundException: oracle.jdbc.driver.OracleDriver)IDEA中连接Oracle数据库失败,缺少驱动

该问题出现在用idea连接Oracle数据库的时候,代码都写好了但是发现连不上Oracle。连接oracle数据库时,一直报错找不到驱动,后来发现自己没整驱动。3. 然后打开IDEA,如下操作:点击添加,把jar添加进去。然后把项目刷新一下就可以了,或者关掉IDEA重新打开。(或者是能连Oracle,但是只能连一半。首先要保证自己的Oracle数据库是启动了的噢。

文章图片
#java#数据库#oracle
(java.lang.ClassNotFoundException: oracle.jdbc.driver.OracleDriver)IDEA中连接Oracle数据库失败,缺少驱动

该问题出现在用idea连接Oracle数据库的时候,代码都写好了但是发现连不上Oracle。连接oracle数据库时,一直报错找不到驱动,后来发现自己没整驱动。3. 然后打开IDEA,如下操作:点击添加,把jar添加进去。然后把项目刷新一下就可以了,或者关掉IDEA重新打开。(或者是能连Oracle,但是只能连一半。首先要保证自己的Oracle数据库是启动了的噢。

文章图片
#java#数据库#oracle
Hive 数据导入到 Doris 的方法

将 Hive 数据导入到 Doris 的常见方法包括:1. Broker Load:通过 Doris 的 Broker 直接读取 HDFS 上的 Hive 数据文件,适用于离线批量导入历史数据。2. Spark Load:利用 Spark 进行数据转换和导入,适合复杂处理或大规模数据场景。3. Stream Load:先将 Hive 数据导出到本地文件,再通过 Stream Load 导入,适用于

文章图片
#hive#hadoop#数据仓库
到底了