logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

基于鲲鹏服务器的金仓数据库调优参考实践

一共部署2台服务器进行组网,其中1台为鲲鹏920新型号服务器,采用物理机部署的方式部署金仓数据库,另外1台服务器作为独立压测机,与数据库服务器通过高速网络互联。其上部署的BenchmarkSQL测试套件将模拟前端业务压力,向金仓数据库发起连续、并发的TPC-C标准负载,以检验其在真实业务场景下的tpmC吞吐量、响应时间及稳定性。

#服务器
使用动态内存一致性工具自动完成上证信息所弱内存序问题排查案例

采用鲲鹏DevKit命令行工具包中的 dr-check 动态内存一致性检测功能。该工具无需修改源码,通过动态执行目标程序,在程序运行时记录共享内存的地址相关读写操作,能够精准检测出因弱内存序导致的数据竞争问题,并给出插入内存屏障(如dmb指令)的具体建议。工具获取。

#算法#服务器
使用DevKit精度分析工具定位LAMMPS应用多个算例的精度问题案例

为了修复此问题,找到文件src/MAKE/Makefile.serial(若编译时使用的不是make serial而是make mpi,同目录下有对应的Makefile.mpi文件),在其第10行的CCFLAGS后面添加选项-ffp-contract=off。在可见的输出中,鲲鹏服务器的计算结果与x86的相同,可再与软件内deposit文件夹中给出的样例输出文件log.27Nov18.deposi

#矩阵#线性代数
鲲鹏统一并行加速库KUPL--众核并行能力介绍

/ Step1:将数组操作定义成函数,函数类型符合所示要求 void axb_func(kupl_nd_range_t *nd_range, void *args, int tid, int tnum) { for (int i = nd_range->nd_range[0].lower;数组计算d[] = a[] * b[] + c[]可以拆分成两个任务,分别是计算d[] = a[] * b[]

#java#网络#开发语言
鲲鹏统一并行加速库KUPL——众核并行调度介绍

对于单一的调度机制不能适应所有的问题类型, KUPL 引入了多层调度的概念,提出了算子内并行和算子间并行的调度逻辑,弥补了单一调度机制存在的缺陷。同时分层调度的模式能很好的适配算子内并行和算子间并行的调度逻辑,外层调度器专门应对算子内并行需要低延迟、高性能的特点,内层调度器处理算子间并行更灵活和高效,也能充分利用多核资源实现负载均衡。其核心原理是在 static_mq 的静态多队列基础上,引入了工

#网络
鲲鹏统一并行加速库KUPL--异步数据拷贝

CUDA异步数据拷贝实现了数据传输操作在指定的CUDA流中异步执行,通过流机制实现计算与数据传输的重叠,提升GPU利用率,避免等待数据传输时的空闲。二维数据拷贝,即为两个维度上的数据的拷贝,如下图所示,将width*height大小的数据,从src拷贝到dst位置,其中src数据每拷贝width长度,间隔spitch-width长度;如下图所示,当计算任务©与数据拷贝任务(A->B)不存在数据依赖

#矩阵#线性代数#算法 +1
鲲鹏统一并行加速库KUPL--矩阵编程MMA

## 什么是tiled_mma。store_atom_shape是KUPL用于扩展store_atom_ops的Shape尺寸,其是一个二维尺寸,分别表示M/N存储形状上扩展的大小,基于该方式可以扩展store_atom_ops原子方法存储的形状从而实现能力的扩展。mma_atom_shape是KUPL用于扩展mma_atom_ops的Shape尺寸,其是一个三维尺寸,分别表示M/N/K计算方向上

#矩阵#线性代数
鲲鹏通信组件HMPI之参数使用篇

更多 UCG 算法细节可参考其 代码仓库 ,具体接口算法位于 src/planc/ucx/ 目录下(如 allreduce.c 包含 MPI_Allreduce 的算法实现)。

#性能优化#服务器#矩阵 +1
鲲鹏数学库FFT与_NumPy的兼容性适配及实践总结

所有面向用户的函数( fft 、 ifft 、 rfft 、 irfft 、 hfft 等)均定义在 numpy/fft/_pocketfft.py 中。该层负责处理参数标准化,包括:轴归一化​:将用户指定的 axis 转换为内部使用的正整数索引,并支持负数轴。长度调整​:若 n 大于输入数组在目标轴的长度,自动进行零填充(zero-padding);若 n 小于原长度,则执行截断。规范化​:根据

#numpy
鲲鹏数学库(KML)天元直接法求解器(DSS)开发实践

include “kml_solver.h”#### 稀疏矩阵 CSR 格式示例采用 CSR(压缩稀疏行) 格式存储稀疏矩阵:int n = 8;// 矩阵阶数 int ia[9] = {0, 2, 4, 6, 7, 8, 10, 12, 14};字段说明 :section: 鲲鹏数学库(KML)天元直接法求解器(DSS)开发实践 基于鲲鹏社区官方示例《示例1-求解器函数-DSS-函数定义(单机版

#算法
    共 29 条
  • 1
  • 2
  • 3
  • 请选择