登录社区云,与社区用户共同成长
邀请您加入社区
依托昇腾与麒麟NPU同源的达芬奇(DaVinci)架构,以及CANN软件开发能力,开发者在昇腾上完成的部分模型适配与算子实现,可以继续沿用于麒麟端侧,在降低开发投入的同时,也有助于降低云侧推理成本。通过量化与裁剪,形成约0.6B的端侧版本模型,其核心计算模块及相关算子结构与云侧保持一致,面向昇腾的计算设计仍然适用,也为底层代码的端云共用创造了条件。昇腾与麒麟NPU均基于DaVinci架构,底层统一
📲 关注【昇腾CANN】视频号,锁定最新直播信息,干货福利不错过!🎥 视频号、B站、昇腾社区多平台同步直播。🎁 戳链接参与互动,赢惊喜定制好礼。
👉 立即挑战,赢定制周边:https://gitcode.com/cann/cann-learning-hub/issues/777。📅 活动截止时间:10月29日 24:00。
参与报名链接:CANN社区任务-昇腾社区
定义LeNet模型华为的深度学习算法体系,以MindSpore框架为核心,以昇腾芯片为底座,以盘古大模型为标杆,构建了一个完整的国产AI技术栈。软硬协同:算法设计与芯片架构深度绑定,实现极致性能自动并行:大幅降低大规模分布式训练的门槛全栈自主:从芯片到框架再到模型,实现全链路自主可控展望未来,随着昇腾910B等新一代芯片的推出,以及盘古大模型向多模态、具身智能方向的演进,华为的深度学习算法将在更多
📅 活动截止时间:10月22日 24:00。
假设我们有一组独立同分布的观测数据Xx1x2xNXx1x2xN,它们来自某个概率分布px∣θpx∣θ,其中θ\thetaθ是待估计的参数。对于给定的参数θ\thetaθLθpX∣θ∏i1Npxi∣θLθpX∣θi1∏Npxi∣θ这个关于参数θ\thetaθ的函数LθL(\theta)Lθ被称为似然函数在参数空间中寻找一组参数θθ。
1、CANN整体技术架构与软件栈2、昇腾AI处理器计算核心概览3、主流算子开发编程语言对比4、 如何选择适合你的开发方式
CANN兴趣小组上新:多模态智能计算CANN代码仓上新:oil-gas-ops-prospect、crypto、cannbot-knowledgeCANN样例上新:GLM-5.3-Flash。
本文以图像分类中的卷积算子优化为例。卷积运算是深度学习中最核心、最耗时的算子之一。在昇腾AI平台上,我们可以通过自定义算子(Custom Operator)的方式,针对特定场景优化卷积计算效率。输入:形状为的特征图卷积核:形状为输出:形状为"""昇腾TBE自定义卷积算子"""# 定义计算过程# 使用TVM表达式描述卷积计算# 卷积计算逻辑# ... 此处省略具体TVM表达式# 调度与编译# ...
在昇腾异构架构中,AI Core 计算单元只能直接读写片上 Local Memory,无法直接访问全局内存 GM。DataCopy:AscendC 提供的内存拷贝内置函数,负责在全局内存。
【昇腾CANN】视频号、B站、昇腾社区多平台直播 ,观看直播,参与互动赢取惊喜定制礼品。扫码关注【昇腾CANN】视频号,掌握最新直播信息。
👉 抢先解锁课前学习资源:2026昇腾CANN训练营-昇腾社区
B站预约链接:点击预约
本文详细介绍了将PyTorch超分辨率模型通过昇腾CANN工具链部署到昇腾硬件的完整实战流程。核心路径为PyTorch -> ONNX -> OM模型转换,重点讲解了动态输入设置、ATC工具编译优化及使用AscendCL/ACLlite进行推理的步骤与技巧,旨在帮助开发者实现高效的边缘AI推理优化。
📅 活动截止时间:10月15日 24:00。
本文详细介绍了在Ubuntu系统上使用昇腾CANN 8.2和msame工具包进行OM模型推理的完整流程,包括环境配置、交叉编译、部署与性能优化。特别针对x86到arm64的跨平台编译难点提供了实用解决方案,帮助开发者高效完成AI模型部署。
本文为2025昇腾CANN训练营第二季的实战指南,详细解析了从零基础环境搭建到算子开发与优化的全流程。内容涵盖Ubuntu系统配置、驱动与CANN工具包安装、Ascend C算子实现、CPU/NPU孪生调试,以及通过数据分块、向量化等手段进行性能调优,帮助开发者快速掌握昇腾平台算子开发的核心技能。
本文深入探讨了昇腾CANN算子开发的全栈技术,从基础的Abs算子实现到复杂模型的优化与部署。通过昇腾NPU硬件加速和CANN架构的全流程实践,开发者可以显著提升AI模型的性能落地效率。文章详细介绍了算子开发环境搭建、优化策略及真实案例,为AI计算领域提供了实用的技术指南。
本文详细介绍了2025昇腾CANN训练营第二季的30天速成计划,帮助零基础学员快速掌握Ascend C算子开发技能。从环境搭建到算子开发、性能调优和融合算子实战,训练营通过分阶段教学和丰富案例,使学员能够高效开发高性能AI算子,适用于异构计算和并行编程场景。
本文总结了昇腾CANN训练营学员在环境配置、算子开发与性能优化中常见的7个典型错误,并提供了实战解决方案。内容涵盖驱动版本匹配、环境变量设置、内存管理、核函数设计、调试技巧及性能调优等关键环节,特别针对算子开发中的内存越界、性能瓶颈等问题给出了代码示例与优化建议,帮助开发者高效避坑。
本文为2025昇腾训练营学员提供了一份详尽的实战避坑指南,涵盖从环境搭建到算子调试的全流程。针对昇腾CANN平台,重点解析了环境配置、算子开发中的常见问题与解决方案,帮助零基础开发者高效入门,避免在环境搭建和算子调试环节浪费宝贵时间。
本文详细解析了在昇腾AI硬件上进行模型推理的全流程。从环境准备、交叉编译msame工具,到使用CANN的atc工具转换OM模型,再到最终在开发板上执行推理并分析结果。文章重点介绍了在x86主机上为ARM架构昇腾设备交叉编译可执行程序的方法,并分享了模型转换与部署过程中的常见问题与实战解决方案,帮助开发者高效完成从编译到部署的完整链路。
本文提供了一份详细的昇腾CANN实战指南,专注于将PyTorch训练的超分辨率模型,通过ONNX中间格式,完整转换为昇腾硬件专用的OM离线模型。文章深入剖析了从模型导出、ATC工具编译到使用AscendCL进行推理部署的全流程,并分享了动态形状处理、算子兼容性等关键技巧与避坑指南,助力开发者高效完成模型迁移与部署。
B站直播预约:点击预约
CANN
——CANN
联系我们(工作时间:8:30-22:00)
400-660-0108 kefu@csdn.net