logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

时间同步协议NTP-原理和实践

是一种用于网络时间同步的协议。它旨在确保计算机和其他网络设备具有准确的时间,并通过与时间服务器进行通信来同步其时钟。NTP服务器: 是提供时间服务的特定服务器,它们通过网络向客户端提供准确的时间信息。这些服务器通常与原子钟或其他高精度时间源同步,以确保提供高度准确的时间。ntpd作为守护进程运行在后台,默默校正本地系统与时钟源服务器之前的时间,以便保证本地系统时间的准确性。本文简单介绍了NTP时间

文章图片
#java#mysql#数据库
开源替代Cursor与Windsurf:VSCode Cline插件集成DeepSeek的终极开发方案

2025.08.20 21:24浏览量:514简介:本文深度解析Cursor和Windsurf的开源替代方案,详细介绍如何通过VSCode Cline插件与DeepSeek大模型结合构建高效开发环境,包括技术选型对比、具体配置步骤、实战案例及性能优化策略。

#开源#vscode#ide
NCCL中QP和Channel是什么关系(来自deepseek)

是 RDMA 的底层队列,负责“干活”(执行数据传输)。

#c++
NCCL Reduce-Scatter 操作详解 (来自deepseek)

将所有进程的数据按元素进行某种操作(如求和、求最大值等):将结果数据分散到各个进程中换句话说,Reduce-Scatter 首先对所有输入缓冲区进行逐元素的 Reduce 操作,然后将结果均匀地分散到所有输出缓冲区中。

#算法
RoCE 的概念 (来自deepseek)

是一种网络协议,允许通过以太网实现,结合了RDMA的高性能和以太网的普及性。

#AIGC
LightGBM 从入门到精通 (来自deepseek)

LightGBM(Light Gradient Boosting Machine)是微软开发的一款基于决策树算法的梯度提升框架,专为高效和可扩展的机器学习任务设计。基于直方图的决策树算法:将连续特征离散化为k个整数,减少内存占用和计算复杂度Leaf-wise(按叶子)生长策略:相比传统的Level-wise策略,减少更多损失,获得更好的精度单边梯度采样(GOSS):保留大梯度的样本,对小梯度样本进

#python
NCCL中的IB网络是指?(来自deepseek)

IB 网络在 NCCL 中指的是InfiniBand 网络,它是一种高性能、低延迟的网络技术。NCCL 利用 InfiniBand 的 RDMA 和高带宽特性,优化了分布式深度学习训练中的通信效率。启用 InfiniBand 支持需要正确的硬件、软件配置以及环境变量设置。

mpirun的运行原理 (来自deepseek)

组件角色类比mpirun总司令公司的CEO,制定总体战略(命令行参数)。orted经理层公司的中层经理(本地和远程)。他们听从CEO,管理基层员工。MPI 进程工作者公司的基层员工,负责具体工作(执行计算)。他们只和直属经理打交道。管理网络内部管理通道经理之间的电话会议/内部邮件系统。数据网络工作协作通道员工之间为了完成项目而进行的直接沟通和文件传输。PMI工作流程接口员工向经理汇报工作和获取资源

#AIGC
GPU内存结构解析 (来自deepseek)

分层设计:GPU内存是分层的,越靠近SM核心,速度越快,容量越小。编程的目标是尽可能让数据留在高速内存中(寄存器和共享内存),减少对低速全局内存的访问。并行带宽 vs 延迟:GPU不追求单个访问的低延迟,而是用巨大的并行带宽来掩盖延迟。成千上万个线程交替执行,当一个线程束在等待内存数据时,SM可以立即切换到另一个就绪的线程束执行计算。程序员可控性共享内存是性能优化的核心。程序员需要主动地将数据从全

#java#开发语言
__syncthreads ,__threadfence 和__threadfence_system的比较 (来自deepseek)

让线程“停下脚步”等待队友到齐。主要保证块内共享内存的可见性。让数据“被看见”。不等待线程,但保证之前的写入对整个GPU全局可见。让数据无处不在地被看见。是前者的系统级版本,保证写入对整个系统(多GPU、CPU)可见。

#java#jvm#开发语言
    共 35 条
  • 1
  • 2
  • 3
  • 4
  • 请选择