logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

国产加速器海光DCU&GPGPU深算处理器与NVIDIA等其它厂商GPU性能测试对比

本文主要介绍国产DCU加速处理器与其它品牌GPU加速卡实测性能对比

文章图片
#人工智能#GPU
nvidia GPU HPL&Linpack性能测试及调优建议

HPL是针对现代并行计算机提出的测试方式。用户在不修改任意测试程序的基础上,可 以调节问题规模大小(矩阵大小)、使用CPU、GPU数目、使用各种优化方法等等来执行该测试程序,以获取最佳的性能。HPL采用高斯消元法求解线性方程组。求解 问题规模为N时,浮点运算次数为(2/3 * N^3-2*N^2)。因此,只要给出问题规模N,测得系统计算时间T,峰值=计算量(2/3 * N^3-2*N^2)/计算时

文章图片
#机器学习#人工智能
NVME硬盘如何使用Intel VROC创建RAID&各RAID级别FIO性能测试?

本文主要介绍intel VROC技术及使用VROC详细创建、删除RAID、各种RAID级别性能测试步骤

文章图片
#服务器
HPC&AI并行计算集群Slurm作业调度系统快速上手

Slurm 是一个开源、容错、高度可扩展的集群管理和作业调度系统,适用于大型和小型 Linux 集群。Slurm 的操作不需要修改内核,而且相对独立。作为集群工作负载管理器,slurm 有三个关键功能。首先,它在一段时间内为用户分配对资源(计算节点)的独占和/或非独占访问权,以便他们能够执行工作。其次,它提供了一个框架,用于在分配的节点集上启动、执行和监视工作(通常是一个并行作业)。最后,它通过管

文章图片
#HPC#人工智能#AI
HPC应用&生命科学领域&生物信息海光DCU加速库genomeworks

Genomeworks生物信息分析软件是一个开源的基因比对加速库,该项目原生由NVIDIA维护仅支持cuda,目前已经做了DCU适配。该基因比对库利用GPU资源加速基因序列比对过程。目前有两个模块可供使用: 1)cudaaligner 用于双序列的全局比对 2)cudapoa 多序列比对的偏序比对,主要有两个功能:(1)生成公有序列、(2)多序列比对(MSA)的生成由于原项目cudamapper在

文章图片
#c++#开发语言
什么是并行计算?

本文主要介绍并行计算相关概念、并行计算条件、层次、并行计算机体系结构、并行程序设计基础等。

文章图片
#HPC
国产海光CPU平台兼容性指南-基础软件分册-20231013(附各系统下载链接)

本文主要整理了海光平台兼容的Windows、Linux操作系统、虚拟化操作系统、虚拟机操作系统、分布式存储软件、数据库、中间件、大数据、云平台、大数据平台、人工智能平台、科学与工程计算平台、操作系统下载链接等

文章图片
#服务器#云计算#大数据 +1
Linux基础-vim命令详解(理论+实战)

本文主要内容为vim命令介绍、命令模式介绍、vim操作、vim命令可视化模式及用法

文章图片
#linux#vim#运维
u-kan_pytorch基于KAN设计,精度高于Mamba、Transformer构建的Unet模型

KAN已成为MLP的一个有前景的替代方案,U-KAN将新兴算法KAN的优势融入到成熟的U-Net Pipeline 中提升精度,同时增加可解释性。

文章图片
#pytorch#transformer#人工智能
yolo11_pytorch在CPU上提速明显,支持目标检测、实例分割、图像分类、姿态估计

YOLO11与YOLOv8一致提供了五个不同尺度大小的网络,延续了YOLOv10无NMS的训练策略,引入了C3k2和C2PSA两个全新模块。

文章图片
#pytorch#目标检测#分类
    共 80 条
  • 1
  • 2
  • 3
  • 8
  • 请选择