logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

别再熬夜翻DAG图了!Spark任务优化,其实可以交给AI Agent

摘要:本文详细介绍了如何通过Spark WebUI定位和优化Spark任务问题。主要内容包括:通过Stages、Executor和SQL页面分析任务瓶颈,识别数据倾斜、资源不足等常见问题;优化思路从资源、并发、数据倾斜到异常问题分层排查;探讨了利用AI Agent提效的六环节工作流,包括任务发现、异常分析、方案生成、自动测试、报告确认和部署上线。相比传统人工优化,AI Agent能自动定位瓶颈、生

文章图片
#spark#人工智能#大数据
别再熬夜翻DAG图了!Spark任务优化,其实可以交给AI Agent

摘要:本文详细介绍了如何通过Spark WebUI定位和优化Spark任务问题。主要内容包括:通过Stages、Executor和SQL页面分析任务瓶颈,识别数据倾斜、资源不足等常见问题;优化思路从资源、并发、数据倾斜到异常问题分层排查;探讨了利用AI Agent提效的六环节工作流,包括任务发现、异常分析、方案生成、自动测试、报告确认和部署上线。相比传统人工优化,AI Agent能自动定位瓶颈、生

文章图片
#spark#人工智能#大数据
别再熬夜翻DAG图了!Spark任务优化,其实可以交给AI Agent

摘要:本文详细介绍了如何通过Spark WebUI定位和优化Spark任务问题。主要内容包括:通过Stages、Executor和SQL页面分析任务瓶颈,识别数据倾斜、资源不足等常见问题;优化思路从资源、并发、数据倾斜到异常问题分层排查;探讨了利用AI Agent提效的六环节工作流,包括任务发现、异常分析、方案生成、自动测试、报告确认和部署上线。相比传统人工优化,AI Agent能自动定位瓶颈、生

文章图片
#spark#人工智能#大数据
Flink Agents 深度剖析:这才是生产级 AI Agent 该有的底座!

FlinkAgents将AI Agent与分布式流处理引擎Flink深度整合,通过复用Flink的Exactly-Once语义、状态管理和背压机制等核心能力,构建了生产级的多Agent流式处理框架。其设计基于三层抽象:Agent(封装行为与资源)、AgentPlan(执行计划生成)和RunnerContext(运行时能力入口),将LLM调用视为异步I/O操作,与数据库查询同级处理。框架采用单线程推

文章图片
#flink#人工智能#大数据
Flink Agents 深度剖析:这才是生产级 AI Agent 该有的底座!

FlinkAgents将AI Agent与分布式流处理引擎Flink深度整合,通过复用Flink的Exactly-Once语义、状态管理和背压机制等核心能力,构建了生产级的多Agent流式处理框架。其设计基于三层抽象:Agent(封装行为与资源)、AgentPlan(执行计划生成)和RunnerContext(运行时能力入口),将LLM调用视为异步I/O操作,与数据库查询同级处理。框架采用单线程推

文章图片
#flink#人工智能#大数据
Flink Agents 深度剖析:这才是生产级 AI Agent 该有的底座!

FlinkAgents将AI Agent与分布式流处理引擎Flink深度整合,通过复用Flink的Exactly-Once语义、状态管理和背压机制等核心能力,构建了生产级的多Agent流式处理框架。其设计基于三层抽象:Agent(封装行为与资源)、AgentPlan(执行计划生成)和RunnerContext(运行时能力入口),将LLM调用视为异步I/O操作,与数据库查询同级处理。框架采用单线程推

文章图片
#flink#人工智能#大数据
Claude Code 额度用完别急着掏钱:4 个环境变量,让它跑在你自己的电脑上

文章摘要:针对ClaudeCode面临的实名制和API额度双重限制问题,本文提出基于Ollama的本地化解决方案。通过配置环境变量将请求重定向到本地模型服务,实现了代码补全功能脱离云端依赖。测试显示,30B参数量的本地模型虽响应速度较慢(1分20秒vs云端7秒),但能保障基础开发需求。方案优势包括:零身份认证、无额度限制、数据不出本地,特别适合国内开发者在账号受限时作为应急方案。建议采用&quot

文章图片
#elasticsearch#大数据#搜索引擎
老板问我 “能不能用 AI 代替”?我反手换了个 “AI 数据架构师” 的头衔!

朋友们,大模型现在真的真的真的(重要的事情说3遍)在企业中开始落地了,算法大佬们在卷大模型训练,后端老哥们在卷多Agent架构和Harness工程,咱们数据开发呢?是不是感觉手里刚写完的、优化了三遍的SQL脚本突然就不香了?是不是半夜惊醒,脑补出老板那张严肃的脸,拍着你的肩膀说:“小张啊,模型已经觉醒了,不仅能写代码还能做报表还能做分析,你这天天跑数的岗位,咱们就优化掉吧。

文章图片
#人工智能#大数据#数据挖掘
AI对大数据的冲击如何?一起看看5月最新的就大数据就业数据?

5月大数据行业就业形势分析显示,行业门槛明显提高,市场逐步淘汰低学历、低能力者,但优质机会仍存。涤生教育就业数据亮眼,社招25人成功上岸,薪资涨幅显著,部分非科班学员斩获40w+高薪。中大厂面试更重AI技术和实战能力,难度提升;外包公司门槛较低,掌握八股文即可获取15k-22k岗位。典型案例包括:7年非科班学员获50w中大厂offer、应届生被裁后快速斩获35w+岗位等。数据显示学历弱势者通过能力

文章图片
#人工智能#大数据
数据团队减负60%的真相:智能问数成败,根本不在大模型

《智能问数落地指南:从技术路线到企业实践》 摘要:智能问数技术虽发展六年,但实际落地效果两极分化。文章系统梳理四代技术演进(规则模板、深度学习NL2SQL、大模型+语义层、Agent化协同),指出当前主流方案是统一语义层+指标平台路线。企业落地需遵循"三步走":需求诊断(聚焦高频场景)、POC验证(业务准确率≥85%)、规模化运营(持续迭代)。关键避坑建议包括:优先单场景做透、

文章图片
#大数据#spark#分布式
    共 97 条
  • 1
  • 2
  • 3
  • 10
  • 请选择