logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

实测openPangu-2.0-Pro:昇腾原生, 505B大模型的开源答卷

MoE Dispatch,也就是把 token 送给不同专家的过程,则改成一个 token 只读取、只量化一次,再发给多个专家,分发延迟下降 25% 到 30%,端到端最多改善约 5%。除了已经上线的模型权重、基础推理代码和技术报告,Ascend Tribe 当前还能看到 ascend-training-system、openPangu-2.0-Infer、openPangu-2.0-Op、asc

文章图片
#人工智能#华为#昇腾 +1
实测openPangu-2.0-Pro:昇腾原生, 505B大模型的开源答卷

MoE Dispatch,也就是把 token 送给不同专家的过程,则改成一个 token 只读取、只量化一次,再发给多个专家,分发延迟下降 25% 到 30%,端到端最多改善约 5%。除了已经上线的模型权重、基础推理代码和技术报告,Ascend Tribe 当前还能看到 ascend-training-system、openPangu-2.0-Infer、openPangu-2.0-Op、asc

文章图片
#人工智能#华为#昇腾 +1
Pi0机器人VLA大模型在昇腾A2平台上的测评

随着人工智能技术的持续神户以及人形机器人产业的快速发展,算力在提升机器人运动控制精度、实时响应能力与智能化水平方面的作用日益凸显。为实现降本增效,国产化算力代替需求不断攀升,本文基于国产化适配的 Pi0机器 VLA大模型,在昇腾 Atlas 800I A2服务器上完成部署与测试,结果表明:该模型在推理性能、推理精度及功能完整性等方面,不仅实现了与英伟达同级别硬件相当的算力表现,更在部分场景下表现出

文章图片
#机器人#昇腾
【CANN】Pi0机器人大模型 × 昇腾A2 测评

今天,我们一起把当下最火的 Pi0 机器人视觉-语言-动作大模型,完完整整地部署在国产算力平台上,也就是华为的昇腾 Atlas 800I A2 服务器上。

文章图片
#机器人#昇腾#华为snap
具身智能:原创漫画,从零开始讲明白具身智能

🌌你好!这里是👋 欢迎添加好友 is_yu_ei,不定期掉落福利资讯。

文章图片
#人工智能#大数据#算法 +1
openPangu-2.0_技术报告_全文中文翻译

我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。

文章图片
#前端#人工智能#AIGC +2
openPangu-2.0_技术报告_全文中文翻译

我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。

文章图片
#前端#人工智能#AIGC +2
openPangu-2.0_技术报告_全文中文翻译

我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。

文章图片
#前端#人工智能#AIGC +2
openPangu-2.0 技术报告全文翻译(1):摘要、引言与混合注意力架构

我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。

文章图片
#架构#交互#人工智能 +2
openPangu-2.0 技术报告全文翻译(1):摘要、引言与混合注意力架构

我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。

文章图片
#架构#交互#人工智能 +2
    共 159 条
  • 1
  • 2
  • 3
  • 16
  • 请选择