logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

昇腾架构及编程模型解读-I

计算单元是AI Core中提供强大算力的核心单元,相当于AI Core的主力军,主要包括:Cube Unit(矩阵计算单元)、Vector Unit(向量计算单元)和Scalar Unit(标量计算单元),完成AI Core中不同类型的数据计算。Ascend C编程范式把算子内部的处理程序,分成多个流水任务(Stage),以张量(Tensor)为数据载体,以队列(Queue)进行任务之间的通信与同

文章图片
#人工智能#gpt-3#AIGC +1
大模型时代来临,GPGPU vs NPU架构路线对比

从CV领用开始兴起,到自然语言处理、生成对抗模型,再到现在蓬勃发展的大语言模型,随着人工智能大模型的快速发展,算力需求呈现出爆发式增长,传统的CPU芯片已经无法满足算力增长的需求,异构加速卡成为当前大模型领域最常用的计算硬件。为了更好的了解的国内外主流的大模型AI芯片,本文以NVIDIA A100 GPGPU和华为Ascend 910B NPU为例,详细对比分析GPGPU和NPU底层硬件架构和设计

文章图片
#架构#nlp#gpt-3
昇腾架构及编程模型解读-I

计算单元是AI Core中提供强大算力的核心单元,相当于AI Core的主力军,主要包括:Cube Unit(矩阵计算单元)、Vector Unit(向量计算单元)和Scalar Unit(标量计算单元),完成AI Core中不同类型的数据计算。Ascend C编程范式把算子内部的处理程序,分成多个流水任务(Stage),以张量(Tensor)为数据载体,以队列(Queue)进行任务之间的通信与同

文章图片
#人工智能#gpt-3#AIGC +1
大模型时代来临,GPGPU vs NPU架构路线对比

从CV领用开始兴起,到自然语言处理、生成对抗模型,再到现在蓬勃发展的大语言模型,随着人工智能大模型的快速发展,算力需求呈现出爆发式增长,传统的CPU芯片已经无法满足算力增长的需求,异构加速卡成为当前大模型领域最常用的计算硬件。为了更好的了解的国内外主流的大模型AI芯片,本文以NVIDIA A100 GPGPU和华为Ascend 910B NPU为例,详细对比分析GPGPU和NPU底层硬件架构和设计

文章图片
#架构#nlp#gpt-3
到底了