
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
9月7日至9日,全球云原生与 AI 基础设施顶级盛会 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026 将于上海国际会议中心召开,本届会上,Volcano社区将在议题演讲、展览展示等区域全方位与开发者展开技术交流。

本文聚焦华为云Agent Harness Infra云原生托管体系,阐述其在 AI Agent 规模化落地中的核心价值,剖析冷启动延迟、状态持久化、执行安全三大痛点,并给出完整基础设施解决方案,同时展望面向 AI Agent 与 Serverless 场景的轻量化、极速启动、安全隔离的云原生沙箱演进方向,助力企业构建高可靠、低成本、易治理的智能服务运行底座,加速 AI 代理从原型走向生产级应用。

随着大语言模型(LLM)成为现代 AI 应用的核心引擎,支撑其运行的基础设施范式也随之进化。在解决了“智能路由”与“模型编排”等空间维度的请求分发问题后,运维的核心焦点转向了时间维度的资源博弈:如何实时、动态地确定最佳推理实例规模?Kthena Autoscaler 便是针对这一命题的标准答案。本文将深入剖析 Kthena Autoscaler 的架构拓扑、通用策略逻辑以及多样化的绑定形态。

华为云云容器引擎CCE近期推出多项核心能力升级,从可观测性、技术栈前沿性、操作便捷性等维度,全面进化您的云原生体验,助力业务高效、稳定、安全地运行。欢迎体验!

本文介绍基于 KubeEdge-Ianvs 分布式协同AI基准测试框架的大语言模型联邦微调系统。该系统针对企业应用大模型面临的算力门槛高、数据孤岛严重等挑战,通过联邦学习实现"数据不动模型动"的隐私保护训练模式。

Karmada v1.18版本现已发布,本版本包含下列新增特性:支持混合云场景下的溢出式集群亲和调度、引入调度超分保护机制。这些更新进一步增强了 Karmada 在混合云和大规模调度场景中的可用性与灵活性。我们鼓励您升级到 v1.18.0,体验这些新能力带来的价值!

Kthena v1.0.0 现已正式发布。这是 Kthena 在 Kubernetes 原生大模型推理领域迈出的重要一步。本次发布全面聚焦生产就绪能力:提升 Gateway API 路由准确性;为预填充/解码(P/D)分离工作负载提供原生的角色级自动扩缩容,大幅提升资源利用率;提供更安全的角色级滚动更新,保障服务发布零中断;增强Router调度等性能。

云容器引擎 CCE 2026-Q2 优化升级一览

Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。围绕这些问题,华为云Agent技术体系采用了三段式Skill自进化机制,目标是让有价值的Skill从真实办公行为中被自动发现和沉淀,在隔离环境中持续进化,最终打磨成可靠且精准的Skill。

在智能体技术从概念探索迈向规模化落地的关键节点,行业智能体规模化应用正面临安全合规严、开发门槛高与运维成本高等挑战。6月6日,在2026华为云INSPIRE创想者大会期间,华为云智果AgentArts企业级智能体平台举办了“打造Harness最佳实践,加速行业智能体规模化落地”主题论坛,汇聚行业客户、生态伙伴、开源社区分享最新Agent实践与趋势洞察,共探破局之道。








