
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
【摘要】本文梳理了腾讯和快手数据开发岗校招面试的核心考点。腾讯侧重技术深度,重点考察Spark/Flink线上问题排查(如任务慢、数据倾斜)、SQL优化及Java底层原理;快手则聚焦AI工具落地和业务方案设计,关注大模型应用和智能开发能力。两家公司均包含算法手撕环节(栈实现队列、合并有序数组等基础题)。面试建议:腾讯需掌握框架原理和调优经验,快手要准备AI编程工具实操案例,同时注意项目细节深挖和业

"最近面试了几家互联网大厂的大数据的岗位,经历了从数据仓库建设到标签开发,再到性能优化的全方位'拷问'。今天就把这些实战经验整理出来,希望能帮到正在准备面试或对数据开发感兴趣的朋友们!"先把面试题放在前面,以下问题和答案都是根据个人经验和技能总结整理的,我通过了该公司的面试,顺利拿到了offer,回答基本没什么问题,供大家参考。

执行hive定时任务,发现有个定时任务报如下错误,Error: Java heap space.查询平台日志,显示mapreduce都已经执行成功了,脚本没有问题,没有报错,那就是平台问题了查看hadoop日志发现,实际上有4个map没有执行成功,而reduce就没有执行,说明调度平台显示的日志信息不准确。进入对应的4个map中查看日志,发现真实报内存溢出错误...
win10安装oracle 11g,在安装时点击setup.exe之后,出现了:[INS-13001]环境不满足最低要。解决办法很简单,这是因为版本注册问题,默认oracle 11没有添加win10的注册信息,所以要讲win10的注册信息添加到oracle的配置文件里。打开oracle安装包,找到stage文件夹,找到cvu_prereq.xml文件,用记事本打开可以看到如下内容,在<
公司集群CLI命令行测试,发现Hive命令行输出不显示列名,或者显示的列名带表名,可读性很差哇。解决办法:进入hive cli后 set hive.cli.print.header=true;但是显示列名以后,又出现表名+列名的显示方式,可读性也不好。继续在hive cli中:set hive.resultset.use.unique.column.names=false; 因为在cl
有时候在使用maven管理项目时,打包一个jar包,会出现pom文件报错的情况。当出现xx\target\classes\META-INF\MANIFEST.MF (系统找不到指定的路径)可以选择如下方式解决。方法一: 1.找到eclipse的project菜单选择clean...选项 2.选择Clean all projects 或者 Clean
1.报错情况有个小伙伴hive任务报错,moving data时,报错如下Failded with exception:unable to move source hdfs://...........2.问题排查这种情况一般跟任务没有关系了,说明hive任务已经执行成功了。因为默认hive,spark任务数据先写到一个临时目录,等各个节点的数据都写完整以后,校验没问题了,在move到表的hdfs路

1.案例描述:hive有个定时任务平时正常,没有啥问题,正常一般大概执行1个小时左右,但是今天突然报错了,报错代码::running beyond physical memory limits. Current usage: 2.0 GB of 2 GB physical memory used; 3.9 GB of 4.2 GB virtual memory used. K...
Regular Expression,正则表达式,又称正规表示式、正规表示法、正则表达式、规则表达式、常规表示法(英语:Regular Expression,在代码中常简写为regex、regexp或RE),是计算机科学的一个概念。正则表达式是一个特殊的字符序列,它能帮助你方便的检查一个字符串是否与某种模式匹配。在很多文本编辑器里,正则表达式通常被用来检索、替换那些匹配某个模式的...
往hive分区表中插入数据时,如果需要创建的分区很多,比如以表中某个字段进行分区存储,则需要复制粘贴修改很多sql去执行,效率低。因为hive是批处理系统,所以hive提供了一个动态分区功能,其可以基于查询参数的位置去推断分区的名称,从而建立分区。 1.创建一个单一字段分区表hive>create table dpartition(id int ,name string







